使用 Gemini 3 Pro Image 和 Imagen 圖像生成模型,搭配採用 Python、Java、Go 等程式設計語言的 API,即可在數秒內根據文字敘述生成及編輯圖像。
新客戶最多可獲得價值 $300 美元的免費抵免額,在 Gemini Enterprise Agent Platform 生成圖像及其他內容。
總覽
文字轉圖像 AI 是一種人工智慧技術,可根據文字敘述,生成及編輯圖片。這項技術有望改變大眾製作視覺內容及與其互動的方式。Google Cloud 在 Agent Platform 提供多種文字轉圖像 AI 工具和資源,包括 Imagen、Gemini 3 Pro Image 和 Veo 等預先訓練的 AI 模型,可讓開發人員輕鬆將文字轉圖像生成技術導入應用程式。
文字轉圖像 AI 可用於應用程式開發,專門生成模擬圖、原型、插圖、測試資料、教育內容和偵錯結果圖表。Google Cloud 的 Agent Platform 和 Cloud Vision API 為開發人員提供一系列圖像處理功能,包括文字偵測、物件偵測和圖像分類功能。Document AI 可從掃描的文件中擷取文字敘述,然後根據敘述生成圖像。
您可以透過 Google Cloud 的 Agent Platform 或 Google AI Studio,存取這些文字轉圖像 AI 模型。只要向模型提供文字提示並選取參數,最後生成圖像即可。部分模型可讓使用者選取參數,來控制生成圖像的風格、創意和準確率。
瞭解如何使用 Agent Platform 的 Imagen 文字轉圖像生成功能,並匯出生成圖像的高解析度版本。本快速入門導覽課程說明如何在 Google Cloud 控制台中使用 Imagen 圖像生成功能。
瞭解如何使用 Agent Platform 的 Imagen 文字轉圖像生成功能,並匯出生成圖像的高解析度版本。本快速入門導覽課程說明如何在 Google Cloud 控制台中使用 Imagen 圖像生成功能。
Gemini 可將不同圖像合併成一張全新的無縫影像內容。使用多張參考圖像,生成單一的整合圖像。此外,您也能以簡單的自然語言指令編輯圖片。無論是從團體照中移除某人,還是修正污漬等小細節,都能透過簡單的對話完成。
此外,透過 Agent Platform 中的 Imagen,您還能編輯 Imagen 生成的圖片或現有圖片。您可以在輸入圖像更新的文字說明時,另外指定要修改的部分 (遮蓋型編輯)。
Gemini 可將不同圖像合併成一張全新的無縫影像內容。使用多張參考圖像,生成單一的整合圖像。此外,您也能以簡單的自然語言指令編輯圖片。無論是從團體照中移除某人,還是修正污漬等小細節,都能透過簡單的對話完成。
此外,透過 Agent Platform 中的 Imagen,您還能編輯 Imagen 生成的圖片或現有圖片。您可以在輸入圖像更新的文字說明時,另外指定要修改的部分 (遮蓋型編輯)。