文生图 AI

根据文本创建和编辑图片,无需编写任何代码

使用 Gemini 3 Pro ImageImagen 图片生成模型,搭配 Python、Java 和 Go 编程语言的可用 API,短短几秒钟内就能根据文本描述生成和修改图片。

新客户最高可获享 300 美元赠金,用于在 Gemini Enterprise Agent Platform 上生成图片及完成其他任务。

概览

什么是文生图 AI?

文生图 AI 是一种可以根据文本描述生成和编辑图像的人工智能。这项技术有望改变我们与视觉内容互动的方式以及创作视觉内容的方式。Agent Platform 中提供的 Google Cloud 文生内容 AI 工具和资源(包括 ImagenGemini 3 Pro ImageVeo 等预训练 AI 模型)旨在帮助开发者在其应用中轻松实现文生图。

文生图功能在应用开发中有哪些用途?

在应用开发中,文生图 AI 能够大显身手,助力生成视觉稿、原型、插图、测试数据、教育内容和可视化内容,让调试工作事半功倍。Google Cloud 的 Agent Platform 和 Cloud Vision API 为开发者打开了一扇门,让他们能够尽情探索一系列图像处理功能的强大潜力,无论是文本检测、对象检测还是图片分类,都能轻松驾驭。Document AI 能够从扫描文档中智能提取文本,进而生成生动的文本描述图。

如何使用这些 Google 模型?

您可以通过 Google Cloud 上的 Agent PlatformGoogle AI Studio 访问这些文生图 AI 模型。如需使用这些模型,只需提供文本提示,选择参数(某些模型允许您选择参数来控制所生成图片的风格、创意和准确率),最后生成图片。

工作方式

文生图 AI 运用自然语言处理 (NLP) 技术,将文字描述转化为机器能够理解的格式。一旦转化为机器可读的格式,机器学习模型便能通过海量的文本和图像数据进行训练,从而掌握识别蕴含的模式,并运用这些模式来生成或编辑图像。

生成式 AI 产品界面
从文本到视觉:AI 图片生成简介
常见用途

使用 AI 生成图片

使用文本提示生成图片

了解如何使用 Agent Platform 上的 Imagen 的文本到图像功能并导出生成的图片的放大版本。本快速入门介绍如何在 Google Cloud 控制台中使用 Imagen 图片生成功能。

使用 Imagen 创建的图片
使用文本提示生成图片

了解如何使用 Agent Platform 上的 Imagen 的文本到图像功能并导出生成的图片的放大版本。本快速入门介绍如何在 Google Cloud 控制台中使用 Imagen 图片生成功能。

使用 Imagen 创建的图片

利用 AI 技术编辑图片

多图片融合和对话式智能修图

借助 Gemini,您可以将多张图片巧妙地融合成一张浑然天成的新视觉作品。融合多张参考图片,打造一张浑然一体的全新图片。您还可以通过简单的自然语言指令,随心所欲地编辑图片。无论是从合照中移除某个人,还是修复污渍这样的小细节,你只需通过简单的对话就能轻松搞定。

此外,借助 Agent Platform 上的 Imagen,您可以随心所欲地修改 Imagen 生成的图片或现有图片。除了提供文本说明来更新图片之外,您还可以精确指定图片中需要修改的特定区域(即基于蒙版的编辑)

多图片融合和对话式智能修图

借助 Gemini,您可以将多张图片巧妙地融合成一张浑然天成的新视觉作品。融合多张参考图片,打造一张浑然一体的全新图片。您还可以通过简单的自然语言指令,随心所欲地编辑图片。无论是从合照中移除某个人,还是修复污渍这样的小细节,你只需通过简单的对话就能轻松搞定。

此外,借助 Agent Platform 上的 Imagen,您可以随心所欲地修改 Imagen 生成的图片或现有图片。除了提供文本说明来更新图片之外,您还可以精确指定图片中需要修改的特定区域(即基于蒙版的编辑)

利用 AI 生成视觉标注

使用视觉标注功能,获取图片说明

为图片生成相关说明,包括详细的元数据、自动标注以及商品和视觉资源的简要说明。

图片说明产品界面
使用视觉标注功能,获取图片说明

为图片生成相关说明,包括详细的元数据、自动标注以及商品和视觉资源的简要说明。

图片说明产品界面

开始概念验证

新客户最高可获享 300 美元赠金,用于在 Agent Platform 中生成图片及完成其他任务

需要支持大型项目?

探索你能创造出怎样的精彩图片

了解如何使用文本提示生成图片

在 Colab 中试用 Imagen

Google Cloud