文字轉圖像 AI

直接使用文字生成並編輯圖像,完全不必編寫程式碼

使用 Gemini 3 Pro ImageImagen 圖像生成模型,搭配採用 Python、Java、Go 等程式設計語言的 API,即可在數秒內根據文字敘述生成及編輯圖像。

新客戶最多可獲得價值 $300 美元的免費抵免額,在 Gemini Enterprise Agent Platform 生成圖像及其他內容。

總覽

什麼是文字轉圖像 AI?

文字轉圖像 AI 是一種人工智慧技術,可根據文字敘述,生成及編輯圖片。這項技術有望改變大眾製作視覺內容及與其互動的方式。Google Cloud 在 Agent Platform 提供多種文字轉圖像 AI 工具和資源,包括 ImagenGemini 3 Pro ImageVeo 等預先訓練的 AI 模型,可讓開發人員輕鬆將文字轉圖像生成技術導入應用程式。

如何將文字轉圖像用於應用程式開發作業?

文字轉圖像 AI 可用於應用程式開發,專門生成模擬圖、原型、插圖、測試資料、教育內容和偵錯結果圖表。Google Cloud 的 Agent Platform 和 Cloud Vision API 為開發人員提供一系列圖像處理功能,包括文字偵測、物件偵測和圖像分類功能。Document AI 可從掃描的文件中擷取文字敘述,然後根據敘述生成圖像。

如何使用這些 Google 模型?

您可以透過 Google Cloud 的 Agent PlatformGoogle AI Studio,存取這些文字轉圖像 AI 模型。只要向模型提供文字提示並選取參數,最後生成圖像即可。部分模型可讓使用者選取參數,來控制生成圖像的風格、創意和準確率。

運作方式

文字轉圖像 AI 會使用自然語言處理 (NLP) 技術,將文字敘述轉換成機器可讀的格式,轉換成機器可讀格式後,以龐大的文字和圖像資料集,訓練機器學習模型學習辨識模式,並運用這些模式生成或編輯圖像。

生成式 AI 產品使用者介面
從文字到圖像:AI 圖像生成簡介
常見用途

使用 AI 生成圖像

使用文字提示詞來生成圖像

瞭解如何使用 Agent Platform 的 Imagen 文字轉圖像生成功能,並匯出生成圖像的高解析度版本。本快速入門導覽課程說明如何在 Google Cloud 控制台中使用 Imagen 圖像生成功能。

使用 Imagen 生成的圖像
使用文字提示詞來生成圖像

瞭解如何使用 Agent Platform 的 Imagen 文字轉圖像生成功能,並匯出生成圖像的高解析度版本。本快速入門導覽課程說明如何在 Google Cloud 控制台中使用 Imagen 圖像生成功能。

使用 Imagen 生成的圖像

AI 輔助編輯圖像

多圖像融合和對話式修圖

Gemini 可將不同圖像合併成一張全新的無縫影像內容。使用多張參考圖像,生成單一的整合圖像。此外,您也能以簡單的自然語言指令編輯圖片。無論是從團體照中移除某人,還是修正污漬等小細節,都能透過簡單的對話完成。

此外,透過 Agent Platform 中的 Imagen,您還能編輯 Imagen 生成的圖片或現有圖片。您可以在輸入圖像更新的文字說明時,另外指定要修改的部分 (遮蓋型編輯)。

多圖像融合和對話式修圖

Gemini 可將不同圖像合併成一張全新的無縫影像內容。使用多張參考圖像,生成單一的整合圖像。此外,您也能以簡單的自然語言指令編輯圖片。無論是從團體照中移除某人,還是修正污漬等小細節,都能透過簡單的對話完成。

此外,透過 Agent Platform 中的 Imagen,您還能編輯 Imagen 生成的圖片或現有圖片。您可以在輸入圖像更新的文字說明時,另外指定要修改的部分 (遮蓋型編輯)。

使用 AI 生成圖像說明文字

使用圖像說明生成功能產生圖像說明文字

生成圖像相關說明,包括詳細中繼資料、產品和視覺素材資源簡要說明,以及自動產生說明文字。

圖像說明生成產品使用者介面
使用圖像說明生成功能產生圖像說明文字

生成圖像相關說明,包括詳細中繼資料、產品和視覺素材資源簡要說明,以及自動產生說明文字。

圖像說明生成產品使用者介面

開始驗證概念

新客戶最多可獲得價值 $300 美元的免費抵免額,在 Agent Platform 生成圖像及其他內容。

要進行大型專案嗎?

瞭解可以建立的圖像類型

瞭解如何使用文字提示生成圖像

在 Colab 中試用 Imagen

Google Cloud