在 Agent Platform 中构建和部署 AI 模型的费用

所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

只有返回 200 响应代码的请求才会产生费用。对于返回任何其他响应代码(例如 4xx 和 5xx 代码)的请求,不会收取输入或输出费用。

本页面介绍了 Agent Platform 上的生成式 AI 的价格。如需了解所有其他 Agent Platform 价格(包括机器学习平台和 MLOps 服务),请参阅 Agent Platform 价格页面

灵活节省计划 (FSP) 是一种基于支出的承诺使用折扣,可帮助您节省 Google Cloud 上符合条件的产品的使用费用。如需详细了解 FSP 的运作方式和适用产品,请参阅灵活节省方案

Google 模型

Gemini 3

模型

类型

区域

价格(/100 万个 token)<= 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

价格(/100 万个 token)<= 20 万个缓存输入 token

价格(/100 万个 token)> 20 万个缓存输入 token

Gemini 3 Pro 预览版

输入(文本、图片、视频、音频)

全局

US$2.00US$4.00US$0.20US$0.40

文本输出(回答和推理)

全局

US$12.00US$18.00

不适用

不适用

Gemini 3.5 Flash

输入(文本、图片、视频、音频)

全局

US$1.50US$1.50US$0.15US$0.15

非全球*


US$1.65US$1.65US$0.165US$0.165

文本输出(回答和推理)

全局

US$9.00US$9.00

不适用

不适用

非全球*

US$9.90US$9.90

不适用

不适用

Gemini 3.6 Flash

输入(文本、图片、视频、音频)

全局

US$1.50US$1.50US$0.15US$0.15

文本输出(回答和推理)

全局

US$7.50US$7.50

不适用

不适用

Gemini 3.5 Flash-Lite


输入(文本、图片、视频、音频)

全局

US$0.30US$0.30US$0.03US$0.03

非全球*

US$0.33US$0.33US$0.033US$0.033

文本输出(回答和推理)

全局

US$2.50US$2.50

不适用

不适用

非全球*

US$2.75US$2.75

不适用

不适用

Gemini 3 Flash 预览版

输入(文本、图片、视频)

全局

US$0.50US$0.50US$0.05US$0.05

输入(音频)

全局

US$1.00US$1.00US$0.10US$0.10

文本输出(回答和推理)

全局

US$3.00US$3.00

不适用

不适用

Gemini 3.1 Flash-Lite

输入(文本、图片、视频)

全局

US$0.25US$0.25US$0.025US$0.025

非全球*

US$0.275US$0.275US$0.0275US$0.0275

输入(音频)

全局

US$0.50US$0.50US$0.05US$0.05

非全球*

US$0.55US$0.55US$0.055US$0.055

文本输出(回答和推理)

全局

US$1.50US$1.50

不适用

不适用

非全球*

US$1.65US$1.65

不适用

不适用

Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite)

输入(文本、图片、视频)

全局

US$0.25

不适用

US$0.025

不适用

文本输出(回答和推理)

全局

US$1.50

不适用

不适用

不适用

图片输出****

全局

US$30.00

不适用

不适用

不适用

Gemini 3.1 Flash Image (Nano Banana 2)

输入(文本、图片、视频)

全局

US$0.50

不适用

US$0.05

不适用

文本输出(回答和推理)

全局

US$3.00

不适用

不适用

不适用

图片输出***

全局

US$60.00

不适用

不适用

不适用

Gemini 3 Pro Image (Nano Banana Pro)

输入(文本、图片)

全局

US$2.00

不适用

$0.20

不适用

文本输出(回答和推理)

全局

12.00 美元

不适用

不适用

不适用

图片输出**

全局

US$120.00

不适用

不适用

不适用

模型

类型

区域

价格(/100 万个 token)<= 20 万个输入 token(优先级)

价格(/100 万个 token)> 20 万个输入 token(优先级)

价格(/100 万个 token)<= 20 万个具有优先级的缓存输入 token

价格(/100 万个 token)> 20 万个缓存输入 token(优先级)

Gemini 3 Pro 预览版

输入(文本、图片、视频、音频)

全局

US$3.60US$7.20US$0.36US$0.72

文本输出(回答和推理)

全局

US$21.60US$32.40

不适用

不适用

Gemini 3.5 Flash

输入(文本、图片、视频、音频)

全局

US$2.70US$2.70US$0.27US$0.27

非全球*

US$2.97US$2.97US$0.297US$0.297

文本输出(回答和推理)

全局

US$16.20US$16.20

不适用

不适用

非全球*

US$17.82US$17.82

不适用

不适用

Gemini 3.6 Flash

输入(文本、图片、视频、音频)

全局

US$2.70US$2.70US$0.27US$0.27

文本输出(回答和推理)

全局

US$13.50US$13.50

不适用

不适用

Gemini 3.5 Flash-Lite

输入(文本、图片、视频、音频)

全局

US$0.54US$0.54US$0.054US$0.054

非全球*

US$0.594US$0.594US$0.0594US$0.0594

文本输出(回答和推理)

全局

US$4.50US$4.50

不适用

不适用

非全球*

US$4.95US$4.95

不适用

不适用

Gemini 3 Flash 预览版

输入(文本、图片、视频)

全局

US$0.90US$0.90US$0.09US$0.09

输入(音频)

全局

US$1.80US$1.80US$0.18US$0.18

文本输出(回答和推理)

全局

US$5.40US$5.40

不适用

不适用

Gemini 3.1 Flash-Lite

输入(文本、图片、视频)

全局

US$0.45US$0.45US$0.045US$0.045

非全球*

US$0.495US$0.495US$0.0495US$0.0495

输入(音频)

全局

US$0.90US$0.90US$0.09US$0.09

非全球*

US$0.99US$0.99US$0.099US$0.099

文本输出(回答和推理)

全局

US$2.70US$2.70

不适用

不适用

非全球*

US$2.97US$2.97

不适用

不适用

Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite)

输入(文本、图片、视频)

全局

不适用

不适用

不适用

不适用

文本输出(回答和推理)

全局

不适用

不适用

不适用

不适用

图片输出****

全局

不适用

不适用

不适用

不适用

Gemini 3.1 Flash Image (Nano Banana 2)

输入(文本、图片、视频)

全局

不适用

不适用

不适用

不适用

文本输出(回答和推理)

全局

不适用

不适用

不适用

不适用

图片输出***

全局

不适用

不适用

不适用

不适用

Gemini 3 Pro Image (Nano Banana Pro)

输入(文本、图片、视频、音频)

全局

不适用

不适用

不适用

不适用

文本输出(回答和推理)

全局

不适用

不适用

不适用

不适用

图片输出**

全局

不适用

不适用

不适用

不适用

模型

类型

区域

价格(/100 万个 token)<= 20 万个输入 token(灵活/批量)

价格(/100 万个 token)> 20 万个输入 token(灵活/批量)

价格(/100 万个 token)<= 20 万个缓存输入 token(使用 Flex/Batch)

价格(/100 万个 token)> 20 万个缓存输入 token(使用 Flex/Batch)

Gemini 3 Pro 预览版

输入(文本、图片、视频、音频)

全局

US$1.00US$2.00

不适用

不适用

文本输出(回答和推理)

全局

US$6.00US$9.00

不适用

不适用

Gemini 3.5 Flash

输入(文本、图片、视频、音频)

全球(批量)

US$0.75US$0.75US$0.075US$0.075

全球(灵活)

US$0.75US$0.75US$0.075US$0.075

非全球*

US$0.825US$0.825US$0.0825US$0.0825

文本输出(回答和推理)

全局

US$4.50US$4.50

不适用

不适用

非全球*

US$4.95US$4.95

不适用

不适用

Gemini 3.6 Flash

输入(文本、图片、视频、音频)

全局

US$0.75US$0.75US$0.075US$0.075

文本输出(回答和推理)

全局

US$3.75US$3.75

不适用

不适用

Gemini 3.5 Flash-Lite

输入(文本、图片、视频、音频)

全局

US$0.15US$0.15US$0.015US$0.015

非全球*

US$0.165US$0.165US$0.0165US$0.0165

文本输出(回答和推理)

全局

US$1.25US$1.25

不适用

不适用

非全球*

US$1.375US$1.375

不适用

不适用

Gemini 3 Flash 预览版

输入(文本、图片、视频)

全局

US$0.25US$0.25

不适用

不适用

输入(音频)

全局

US$0.50US$0.50

不适用

不适用

文本输出(回答和推理)

全局

US$1.50US$1.50

不适用

不适用

Gemini 3.1 Flash-Lite

输入(文本、图片、视频)

全局

US$0.125US$0.125US$0.0125US$0.0125

非全球*

US$0.1375US$0.1375US$0.01375US$0.01375

输入(音频)

全局

US$0.25US$0.25US$0.025US$0.025

非全球*

US$0.275US$0.275US$0.0275US$0.0275

文本输出(回答和推理)

全局

US$0.75US$0.75

不适用

不适用

非全球*

US$0.825US$0.825

不适用

不适用

Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite)

输入(文本、图片、视频)

全局

US$0.125

不适用

US$0.0125

不适用

文本输出(回答和推理)

全局

US$0.75

不适用

不适用

不适用

图片输出****

全局

US$15.00

不适用

不适用

不适用

Gemini 3.1 Flash Image (Nano Banana 2)

输入(文本、图片、视频)

全局

US$0.25

不适用

US$0.025

不适用

文本输出(回答和推理)

全局

US$1.50

不适用

不适用

不适用

图片输出***

全局

US$30.00

不适用

不适用

不适用

Gemini 3 Pro Image (Nano Banana Pro)

输入(文本、图片)

全局

$1.00

不适用

$0.10

不适用

文本输出(回答和推理)

全局

$6.00

不适用

不适用

不适用

图片输出***

全局

$60.00

不适用

不适用

不适用

基于接地的定价

特性

用法

价格 (USD)

依托 Google 搜索进行接地和依托 Enterprise Web Search 进行接地

每月免费提供 5,000 次接地查询,在所有 Gemini 3 模型之间汇总。

超出这些限制的接地查询按 $14/1,000 次接地查询收费。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。

接地提示”是指客户向 Gemini 提交的最终用户提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询均为“接地查询”)。每次执行接地查询都将单独计费。结算将于 2026 年 1 月 5 日开始。

依托 Google 搜索进行接地或依托企业版 Web 进行接地提供的输入词元不收费。

对于每天少于 100 万条接地提示的客户应用,客户可以选择不以标准价格展示带有接地结果的搜索建议。

0 count to 5,000 count
US$0.00 (Free)
5,000 count and above
US$14.00

依托 Google 地图进行接地

包括每月 5,000 次免费搜索查询,在所有 Gemini 3 模型中汇总计算。

超出这些限制的 Maps 查询按每 1,000 次查询 14 美元的价格计费。客户向 Gemini 提交的请求可能会触发一次或多次 Google 地图查询。每次执行查询都将单独计费。结算周期开始时间:2026 年 1 月 5 日

Google 地图提供的输入 token 不收费。

0 count to 5,000 count
US$0.00 (Free)
5,000 count and above
US$14.00

基于数据进行接地

每 1,000 个提示 $2.50。

US$2.50

计算机使用工具

价格取决于发送给模型的输入 token 总数以及生成的输出 token。Token 价格取决于所使用的相应模型

从 Gemini 3.5 开始,函数声明将计入输入 token 数量。

如需了解更多详情,请参阅文档

* 对于非全球端点,正式版 Gemini 3 及更高版本模型系列的价格将于 2026 年 7 月 1 日生效。2026 年 7 月 1 日之前,非全球端点将采用全球端点价格。

* 如果查询输入上下文长度超过 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

* 调优后的模型端点将是基本模型的 1.5 倍。

** Gemini 3 Pro Image 对每张输入图片收取 560 个 token 的费用,输出图片费用则根据分辨率而定:1K 和 2K(大约 100 万像素和 400 万像素)为 1120 个 token(0.134 美元),4K(大约 1600 万像素)为 2000 个 token(0.24 美元)。

*** Gemini 3.1 Flash Image 对每张输入图片收取 1120 个 token,输出图片费用则根据分辨率而定:512(约 0.25MP)为 747 个 token(0.045 美元),1K(约 1MP)为 1120 个 token(0.067 美元),2K(约 4MP)为 1680 个 token(0.101 美元),4K(约 16MP)为 2,520 个 token(0.15 美元)。

**** Gemini 3.1 Flash-Lite Image 对每张输入图片收取 1120 个 token 的费用,对 1K(约 100 万像素)输出图片收取 1120 个 token(0.034 美元)的费用

Gemini 2.5

模型

类型

Token 价格 <= 20 万个 token

价格 > 20 万个 token

价格 <= 20 万个缓存输入 token

价格 > 20 万个缓存输入 token

Gemini 2.5 Pro

输入(文本、图片、视频、音频)

US$1.25US$2.50US$0.125US$0.25

文本输出(回答和推理)

US$10.00US$15.00

不适用

不适用

Gemini 2.5 Pro

计算机使用 - 预览版

输入(文本、图片、视频、音频)

US$1.25US$2.50

不适用

不适用

文本输出(回答和推理)

US$10.00US$15.00

不适用

不适用

Gemini 2.5 Flash

输入(文本、图片、视频)

US$0.30US$0.30US$0.03US$0.03

音频输入

US$1.00US$0.30US$0.10US$0.10

文本输出(回答和推理)

US$2.50US$2.50

不适用

不适用

Gemini 2.5 Flash 图片

输入(文本、图片)***

US$0.30

不适用

不适用

不适用

文本输出(回答和推理)

$2.50

不适用

不适用

不适用

图片输出***

US$30.00

不适用

不适用

不适用

Gemini 2.5 Flash Live API

输入文本

US$0.50

$0.50

不适用

不适用

输入(视频、图片)

US$3.00

$3.00

不适用

不适用

音频输入

US$3.00

$3.00

不适用

不适用

文本输出

US$2.00US$2.00

不适用

不适用

100 万个输出音频 token

US$12.00

12.00 美元

不适用

不适用

Gemini 2.5 Flash Lite

输入(文本、图片、视频)

US$0.10

$0.10

US$0.01

$0.01

音频输入

US$0.30

$0.30

US$0.03

$0.03

文本输出(回答和推理)

US$0.40US$0.40

不适用

不适用

模型

类型

价格(/100 万个 token)<= 20 万个输入 token(优先级)

价格(/100 万个 token)> 20 万个输入 token(优先级)

价格(/100 万个 token)<= 20 万个具有优先级的缓存输入 token

价格(/100 万个 token)> 20 万个缓存输入 token(优先级)

Gemini 2.5 Pro

输入(文本、图片、视频、音频)

US$2.25US$4.50US$0.225US$0.45

文本输出(回答和推理)

US$18.00US$27.00

不适用

不适用

Gemini 2.5 Pro

计算机使用 - 预览版

输入(文本、图片、视频、音频)

不适用

不适用

不适用

不适用

文本输出(回答和推理)

不适用

不适用

不适用

不适用

Gemini 2.5 Flash

输入(文本、图片、视频)

US$0.54US$0.54US$0.054US$0.054

音频输入

US$1.80US$1.80US$0.18US$0.18

文本输出(回答和推理)

US$4.50US$4.50

不适用

不适用

Gemini 2.5 Flash 图片

输入(文本、图片)***

不适用

不适用

不适用

不适用

文本输出(回答和推理)

不适用

不适用

不适用

不适用

图片输出***

不适用

不适用

不适用

不适用

Gemini 2.5 Flash Live API

100 万个输入文本 token

不适用

不适用

不适用

不适用

100 万个输入音频 token

不适用

不适用

不适用

不适用

100 万个输入视频/图片 token

不适用

不适用

不适用

不适用

100 万个输出文本 token

不适用

不适用

不适用

不适用

100 万个输出音频 token

不适用

不适用

不适用

不适用

Gemini 2.5 Flash Lite

输入(文本、图片、视频)

US$0.18US$0.18US$0.018US$0.018

音频输入

US$0.54US$0.54US$0.054US$0.054

文本输出(回答和推理)

US$0.72US$0.72

不适用

不适用

模型

类型

价格(/100 万个 token)<= 20 万个输入 token(灵活/批量)

价格(/100 万个 token)> 20 万个输入 token(灵活/批量)

Gemini 2.5 Pro

输入(文本、图片、视频、音频)

US$0.625US$1.25

文本输出(回答和推理)

US$5.00US$7.50

Gemini 2.5 Pro

计算机使用 - 预览版

输入(文本、图片、视频、音频)

不适用

不适用

文本输出(回答和推理)

不适用

不适用

Gemini 2.5 Flash

输入(文本、图片、视频)

US$0.15US$0.15

音频输入

US$0.50US$0.50

文本输出(回答和推理)

US$1.25US$1.25

Gemini 2.5 Flash 图片

输入(文本、图片、视频)***

$0.15

不适用

文本输出(回答和推理)

$1.25

不适用

图片输出***

$15.00

不适用

Gemini 2.5 Flash Live API

100 万个输入文本 token

不适用

不适用

100 万个输入音频 token

不适用

不适用

100 万个输入视频/图片 token

不适用

不适用

100 万个输出文本 token

不适用

不适用

100 万个输出音频 token

不适用

不适用

Gemini 2.5 Flash Lite

输入(文本、图片、视频)

US$0.05US$0.05

音频输入

US$0.05US$0.05

文本输出(回答和推理)

US$0.20US$0.20

基于接地的定价

特性

用法

价格 (USD)

使用 Google 搜索建立依据

Gemini 2.0 Flash、2.5 Flash 和 2.5 Flash-Lite 每天提供 1,500 条接地提示,不收取额外费用。Gemini 2.5 Pro 每天免费提供 10,000 个接地提示。

超出这些限制的接地提示按 $35/1,000 个接地提示计费。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。

接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。

0 count to 10,000 count
US$0.00 (Free)
10,000 count and above
US$35.00

适用于企业的 Web 接地

每 1,000 个接地提示$45。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。

接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。

US$45.00

基于数据进行接地

每 1,000 个请求 $2.5。

US$2.50

依托 Google 地图进行接地

每 1,000 条接地提示 25 美元。

接地提示是指发送给 Gemini 的请求,该请求至少会向 Google 地图发出 1 次查询。

0 count to 1,500 count
US$0.00 (Free)
1,500 count and above
US$25.00

* 如果查询输入上下文长度超过 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

* 调优后的模型端点的预测价格与基本模型相同。

** 仅当依托 Google 搜索进行接地和企业版网络接地功能的接地提示成功返回来源(即包含至少一个来自网络的接地支持网址的结果)时,才会对其计费。Gemini 模型使用费另行收取。

*** 一张 1024x1024 的图片消耗 1290 个 token(每张 1K 输出图片 0.039 美元)。每张图片的 token 数量因图片分辨率而异。如需详细了解如何计算词元,请参阅我们的文档

****“计算机使用”结算使用 Gemini 2.5 Pro SKU,如需拆分“计算机使用”费用,请应用结算标记。如需了解详情,请点击此处

  • LiveAPI 会话的上下文窗口结算方式说明:系统会根据会话上下文窗口中存在的所有词元按轮次向您收费。会话上下文窗口包括新词元(当前轮次)+ 前几轮次中累积的所有词元。这意味着,系统会在每个新回合中重新处理并考虑过去回合中的词元,直到达到您配置的上下文窗口大小。“轮次”是指用户的一次输入和模型的一次回答。
  • 主动音频模式:启用后,LiveAPI 在监听时会收取输入词元费用。只有在 API 回答时,才会对输出词元收费。
  • 启用音频转写为文本功能后,系统将按文本词元输出费率对转写生成的所有文本词元收费。

Gemini 2.0

Gemini 2.0 按词元数计费。如需在发送请求之前计算请求中的输入 token 数,可以使用 SDK 词元化器countTokens API。如果您的请求因 400 或 500 错误而失败,则不会向您收取所用词元的费用。

使用价格表中的切换开关,比较基于 token 的定价和基于模态的定价。

模型

类型

价格 /100 万个 token(美元)

使用 Batch API 的价格(美元 /100 万个 token)

Gemini 2.0 Flash

输入文本

US$0.15US$0.075

输入音频

US$1.00US$0.50

输出文本

US$0.60US$0.30

调整训练

US$0.003

Gemini 2.0 Flash 图片生成

输入令牌

US$0.15

输入音频 token

US$1.00

输入视频 token 数

US$0.15

输出文本 token

US$0.60

输出图片 token 数

US$30.00

Gemini 2.0 Flash Live API

输入文本 token 数

US$0.50

输入音频 token

US$3.00

输入视频/图片 token 数

US$3.00

输出文本 token

US$2.00

输出音频 token

US$12.00

Gemini 2.0 Flash Lite

输入令牌

US$0.075US$0.0375

输入音频 token

US$0.075US$0.0375

输出文本 token

US$0.30US$0.15

针对训练词元进行调优

US$0.001

* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

* 训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。

* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。

* 调优后的模型端点的预测价格与基本模型相同。

* Gemini 2.0 Flash Live API:每秒音频(输入/输出)25 个词元,每秒视频(输入)258 个词元。在 Gemini 2.0 Flash Live API 处于预览版阶段时,依托 Google 搜索进行接地仍不收取费用。

以下模态价格仅供参考,基于平均用例。实际结算将仅基于词元:

  • 4 个字符大约会生成 1 个文本词元(包括空格)。
  • 对于 1024x1024 的图片,它会消耗 1290 个 token。每张图片的 token 数量因图片分辨率而异。如需详细了解如何计算词元,请参阅我们的文档
  • 视频输入按每秒一帧的采样率,每秒消耗 258 个词元。视频(含音频)既要按视频 token 计费,也要按音频 token 计费。
  • 音频输入每秒消耗 25 个 token,不包括时间戳。

模型

类型

价格(/100 万个词元)(美元)

使用 Batch API 的价格(美元/100 万个词元)

Gemini 2.0 Flash

输入文本(美元/100 万个字符)

$0.0375

$0.01875

输入图片($/张)

$0.0001935

$0.00009675

输入视频(美元/秒)

$0.0000387

$0.00001935

输入音频(美元/秒)

$0.000025

$0.0000125

输出文本(美元/百万字符)

$0.15

$0.075

Gemini 2.0 Flash 图片生成

输入文本(美元/100 万个字符)

$0.0375

输入图片($/张)

$0.0001935

输入视频(美元/秒)

$0.0000387

输入音频(美元/秒)

$0.000025

输出文本(美元/百万字符)

$0.15

输出图片 image ($/image)

$0.04

Gemini 2.0 Flash Lite

输入文本(美元/100 万个字符)

$0.01875

$0.009375

输入图片($/张)

$0.00009675

$0.000048375

输入视频(美元/秒)

$0.00001935

$0.000009675

输入音频(美元/秒)

$0.000001875

$0.000000938

输出文本(美元/百万字符)

$0.075

$0.0375

* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

* 训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。

* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。

* 调优后的模型端点的预测价格与基本模型相同。

* Gemini 2.0 Flash Live API:每秒音频(输入/输出)25 个词元,每秒视频(输入)258 个词元。在 Gemini 2.0 Flash Live API 处于预览版阶段时,依托 Google 搜索进行接地仍不收取费用。

价格(含接地)

特性

用法

价格 (USD)

依托 Google 搜索进行接地*, **

Gemini 2.0 Flash、2.5 Flash 和 2.5 Flash-Lite 每天提供 1,500 条接地提示,不收取额外费用。Gemini 2.5 Pro 每天免费提供 10,000 个接地提示。

超出这些限制的接地提示按 $35/1,000 个接地提示计费。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。

接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。

0 count to 10,000 count
US$0.00 (Free)
10,000 count and above
US$35.00

适用于企业的 Web 接地*, **

每 1,000 个接地提示$45。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。

接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。

US$45.00

使用您的数据进行接地*

每 1,000 个请求 $2.5。

US$2.50

Grounding with Google Maps*

Gemini 模型每天提供一些接地提示,无需额外费用:

  • Gemini Flash 和 Flash-Lite:每天最多可使用 1,500 个接地提示。
  • Gemini Pro:每天 10,000 个接地提示。

接地提示超出这些限制时,按每 1,000 个接地提示 25 美元的价格计费。

接地提示是指发送给 Gemini 的请求,该请求至少会向 Google 地图发出 1 次查询。

如果您每天需要超过 100 万条接地提示,请与您的客户支持团队联系。

0 count to 1,500 count
US$0.00 (Free)
1,500 count and above
US$25.00

* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

* 训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。

* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。

* 调优后的模型端点的预测价格与基本模型相同。

* Gemini 2.0 Flash Live API:每秒音频(输入/输出)25 个词元,每秒视频(输入)258 个词元。在 Gemini 2.0 Flash Live API 处于预览版阶段时,依托 Google 搜索进行接地仍不收取费用。

** 仅当提示成功返回来源(即包含至少一个来自网络的接地支持网址的结果)时,才会对使用依托 Google 搜索进行接地和企业版网络接地功能计费。Gemini 模型使用费另行收取。

  • LiveAPI 会话的上下文窗口结算方式说明:系统会根据会话上下文窗口中存在的所有词元按轮次向您收费。会话上下文窗口包括新词元(当前轮次)+ 前几轮次中累积的所有词元。这意味着,系统会在每个新回合中重新处理并考虑过去回合中的词元,直到达到您配置的上下文窗口大小。“轮次”是指用户的一次输入和模型的一次回答。
  • 启用音频转写为文本功能后,系统将按文本词元输出费率对转写生成的所有文本词元收费。

其他 Gemini 模型

Gemini 2.0 或 Gemini 2.5 以外的所有 Gemini 模型均按模态计费,例如字符数、图片数、视频/音频秒数。

  • 文本输入按每 1,000 个字符的输入(提示)和每 1,000 个字符的输出(回答)计费。
  • 字符按 UTF-8 码位计数,计数中不包括空格,因此每个词元大约包含 4 个字符。
  • 生成过滤后响应的预测请求仅针对输入计费。
  • 在每个结算周期结束时,1 美分的小数部分 ($0.01) 会四舍五入到 1 美分。媒体输入按图片数量或秒数(视频)收费。
  • 如果您的请求因 400 或 500 错误而失败,则不会向您收取所用词元的费用。

Gemini 1.5

模型

特性

类型

价格(=< 12.8 万个输入 token)

价格(> 12.8 万个输入 token)

Gemini 1.5 Flash

多模态

图片输入

US$0.00002 / 1 countUS$0.00004 / 1 count

视频输入

US$0.00002 / 1 countUS$0.00004 / 1 count

文本输入

US$0.00001875 / 1,000 countUS$0.0000375 / 1,000 count

音频输入

US$0.000002 / 1 countUS$0.000004 / 1 count

文本输出

US$0.000075 / 1,000 countUS$0.00015 / 1,000 count

调优*

训练代币

US$0.008 / 1,000 count

Gemini 1.5 Pro

多模态

图片输入

US$0.00032875 / 1 countUS$0.0006575 / 1 count

视频输入

US$0.00032875 / 1 countUS$0.0006575 / 1 count

文本输入

US$0.0003125 / 1,000 countUS$0.000625 / 1,000 count

音频输入

US$0.00003125 / 1 countUS$0.0000625 / 1 count

文本输出

US$0.00125 / 1,000 countUS$0.0025 / 1,000 count

调优*

训练代币

US$0.08 / 1,000 count

Gemini 1.0 Pro

多模态

图片输入

US$0.0025 / 1 count

视频输入

US$0.002 / 1 count

文本输入

US$0.000125 / 1,000 count

文本输出

US$0.000375 / 1,000 count

* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

* 如果查询上下文长度超过 128K,则所有 token 均按长上下文费率计费。

* Gemini 模型在批量模式下可享受 50% 的折扣。

* Gemini 1.0 Pro 仅支持最大 32K 的上下文窗口。

* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。

* 调优后的模型端点的预测价格与基本模型相同。

** 仅当提示成功返回来源(即包含至少一个来自网络的接地支持网址的网络结果)时,才会对使用依托 Google 搜索进行接地和企业版网络接地功能计费。Gemini 模型使用费另行收取。

接地定价

特性

价格 (USD)

使用 Google 搜索建立依据

每 1,000 个接地提示 35 美元

接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。

适用于企业的 Web 接地

每 1,000 个接地提示 45 美元

接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。

基于数据进行接地

自 2025 年 6 月 16 日起,每 1,000 个请求 2.5 美元。

** 仅当提示成功返回来源(即包含至少一个来自网络的接地支持网址的网络结果)时,才会对使用依托 Google 搜索进行接地和企业版网络接地功能计费。Gemini 模型使用费另行收取。

Imagen

借助 Agent Platform 上的 Imagen,您可以生成新图片并根据您提供的文本提示修改图片,或使用您定义的遮盖区域以及许多其他功能仅修改图片的某些部分。

模型

特性

说明

输入

输出

价格 / 1 个计数(美元)

Imagen 4 Ultra

图片生成

生成图片

文本提示

映像

US$0.06

Imagen 4

提升

将生成的图片的分辨率提高到 2K、3K 和 4K

映像

映像

$0.06

Imagen 4

图片生成

生成图片

文本提示

映像

US$0.04

Imagen 4 Fast

图片生成

生成图片

文本提示

映像

US$0.02

Imagen 3

图片生成

生成图片

修改图片

自定义图片

文本提示

映像

US$0.04

Imagen 3 Fast

图片生成

生成图片

文本提示

映像

US$0.02

Imagen 2、Imagen 1

图片生成

生成图片

文本提示

映像

US$0.02

Imagen 2、Imagen 1

图片修改

使用无蒙版或蒙版方法修改图片

图片/文字提示

映像

US$0.02

Imagen 1

提升

将生成的图片的分辨率提高到 2K 和 4K

映像

映像

US$0.003

Imagen 1

微调

启用用户提供的“主题”以用于 Imagen 提示(少样本训练)

带有文本标识符的主题,每个主题 4-8 张图片

微调后的模型(使用用户提供的主题进行训练后)

每节点时 $(Agent Platform 自定义训练价格)

Imagen

视觉标注

为图片生成短文本或长文本字幕

映像

文本字幕

US$0.0015

Imagen

视觉问答

根据引用图片的问题提供回答

图片/文字提示

文本回答

US$0.0015

Imagen

Product Recontext

在新的场景中重新构想产品

1-3 张同一产品的图片,以及描述所需场景的文本提示

映像

$0.12

虚拟试穿

生成人物穿着不同服装的图片

1 张人物图片和 1 张服装图片

映像

US$0.06

所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

Veo

模型

特性

说明

输入

输出

输出分辨率

价格 (USD)

Veo 3.1

生成视频 + 音频

根据文本提示或参考图片生成高质量视频,并同步添加语音/音效

文本/图片提示

视频 + 音频

720p、1080p

US$0.40 / 1 count

4000

US$0.60 / 1 count

视频生成

根据文本提示或参考图片生成高质量视频

文本/图片提示

视频

720p、1080p

US$0.20 / 1 count

4000

US$0.40 / 1 count

Veo 3.1 Fast

生成视频 + 音频

根据文本提示或参考图片,更快地生成带有同步语音/音效的视频

文本/图片提示

视频 + 音频

720p

US$0.10 / 1 count

1080p

US$0.12 / 1 count

4000

US$0.30 / 1 count

视频生成

根据文本提示或参考图片更快地生成视频

文本/图片提示

视频

720p

US$0.08 / 1 count

1080p

US$0.10 / 1 count

4000

US$0.25 / 1 count

Veo 3.1 Lite

生成视频 + 音频

根据文本提示或参考图片,以最快的速度生成带有同步语音/音效的视频

文本/图片提示

视频 + 音频

720p

$0.05 / 1 次

1080p

$0.08 / 1 次

视频生成

根据文本提示或参考图片快速生成视频

文本/图片提示

视频

720p

$0.03 / 1 次

1080p

$0.05 / 1 次

Veo 3

生成视频 + 音频

根据文本提示或参考图片生成高质量视频,并同步添加语音/音效

文本/图片提示

视频 + 音频

720p、1080p

US$0.40 / 1 count

视频生成

根据文本提示或参考图片生成高质量视频

文本/图片提示

视频

720p、1080p

US$0.20 / 1 count

Veo 3 Fast

生成视频 + 音频

根据文本提示或参考图片,更快地生成带有同步语音/音效的视频

文本/图片提示

视频 + 音频

720p

US$0.10 / 1 count

1080p

US$0.12 / 1 count

视频生成

根据文本提示或参考图片更快地生成视频

文本/图片提示

视频

720p

US$0.08 / 1 count

1080p

US$0.10 / 1 count

Veo 2

视频生成

根据文本提示或参考图片生成视频

文本/图片提示

视频

720p

US$0.50 / 1 count

高级控制功能

通过起始帧和结束帧插值生成视频,延长生成的视频,并应用镜头控制

文本/图片/视频提示

视频

720p

US$0.50 / 1 count

Lyria

Lyria 模型系列可生成高质量的音乐创作,非常适合复杂的乐曲创作和详细的创意探索,在这些场景中,细致入微的输出至关重要。

模型

特性

说明

输入

输出

价格 (USD)

Lyria 3 Pro

生成完整歌曲

Lyria 3 Pro 可根据文本或图片等多模态输入创作完整的音乐作品

文字、图片

完整歌曲

US$0.08 / 1 count

Lyria 3

生成 30 秒的音乐片段

Lyria 3 可根据文本或图片提示生成高保真 30 秒音频片段

文字、图片

30 秒音乐片段

US$0.04 / 1 count

Lyria 2

音乐生成

根据文本提示生成音乐

文本提示

音乐

US$0.06 / 1 count

嵌入费用

Gemini API 提供嵌入模型,可为文本、图片、视频和其他内容生成嵌入。

模型

类型

区域

请求类型

价格 / 1,000 个计数(美元)

Gemini Embedding

输入

全局

在线请求

US$0.00015

批量请求

US$0.00012

输出

全局

在线请求

免费

批量请求

免费

Embeddings for Text(不包括 Gemini Embedding)

输入

全局

在线请求

US$0.000025

批量请求

US$0.00002

输出

全局

在线请求

免费

批量请求

免费

Gemini Omni

模型

类型

Token 价格 /100 万(美元)

Gemini Omni Flash

输入(文本、图片、视频、音频)

US$1.50

文本输出(回答和推理)

US$9.00

视频输出*

US$17.50

* Gemini Omni Flash 的输入费用为每张图片 2,040 个词元、每秒音频 32 个词元、每秒视频 5,792 个词元。对于视频输出,Gemini Omni Flash 按每秒 720p 视频输出(含音频)5, 792 个代币收费。

代理

模型

类型

价格(/100 万个词元)

价格(/百万个缓存输入 token)

Gemini Deep Research 智能体

输入(文本)

$2

$0.2

文本输出(回答和推理)

$12

不适用

基于接地的定价

特性

用法

价格 (USD)

依托 Google 网页搜索和图片搜索进行接地,以及适用于企业的 Web 接地*

包括每月 5,000 次免费搜索查询,在所有 Gemini 3 模型中汇总计算。

超出这些限制的搜索查询按每 1,000 次搜索查询 14 美元的价格计费。客户向 Gemini 提交的请求可能会触发一次或多次 Google 搜索查询(或 Enterprise 版的 Web 接地)。每一次搜索查询都将单独计费。结算将于 2026 年 1 月 5 日开始。

依托 Google 搜索进行接地或依托企业版 Web 进行接地提供的输入词元不收费。

如果您每天需要超过 100 万条接地提示,请与您的客户支持团队联系。

客户可能会决定不在其客户应用界面中以标准价格显示基于接地结果的搜索建议。


0 count to 5,000 count
US$0.00 (Free)
5,000 count and above
US$14.00

基于数据进行接地

US$2.50

CodeMender

CodeMender 的价格基于 token,由所使用的模型决定

模型

类型

模型价格 /100 万个词元(美元)

CodeMender 价格 /100 万个 token(美元)

Gemini 3.5 Flash

输入令牌

US$1.50US$1.50

缓存的 token 数

US$0.15US$0.15

输出令牌

US$9.00US$9.00

Gemini 3.1 Pro

输入令牌

US$2.00US$2.00

缓存的 token 数

US$0.20US$0.20

输出令牌

US$12.00US$12.00

Gemini 3 Flash

输入令牌

US$0.50US$0.50

缓存的 token 数

US$0.05US$0.05

输出令牌

US$3.00US$3.00

Gemma

模型

类型

价格(/100 万个词元,美元)

Gemma 4 26B

输入

US$0.15

输出

US$0.60

缓存命中

US$0.015

Agent Platform Model Optimizer 价格(实验性功能)*

Agent Platform Model Optimizer 为 Gemini 模型请求提供了一个元端点,简化了企业客户对 Gemini 的使用。使用此服务的客户无需指定使用 Flash、Pro 还是特定版本。他们只需提供可配置的设置(费用、质量或平衡),指明自己的偏好,Model Optimizer 就会通过将每个查询发送到最合适的模型,应用适合任务的适当智能水平。

Agent Platform Model Optimizer 采用动态定价。也就是说,每个词元的平均价格取决于用于完成任务的模型智能水平。因此,下面提供了价格示例,以根据您的配置设置说明可能出现的场景(请参阅下表)。Model Optimizer SKU 是 1 美元的 SKU,用作购买单位来申请结算,您在使用模型后仍按用量计费。

示例 1 聊天机器人:5:1 的 I/O 比率

注意: 这些范围并非保证,各个客户的实际成效可能会有所不同

客户偏好

发送到 MO 的客户输入 token 数

发送给 MO 的客户输出 token 数

每百万个词元的平均输入价格(高范围)

每百万个词元的平均输出价格(高范围)

每百万词元的平均输入价格(低范围)

每百万个词元的平均输出价格(低范围)

费用

1000 万

200 万

$0.63

$2.50

$0.16

$0.63

平衡

1000 万

200 万

$1.26

$5.00

$0.63

$2.50

品质

1000 万

200 万

$1.89

$7.50

$1.26

$5.00

示例 2 内容生成:1:20 的 I/O 比率

客户偏好

发送到 MO 的客户输入 token 数

发送给 MO 的客户输出 token 数

每百万个词元的平均输入价格(高范围)

每百万个词元的平均输出价格(高范围)

每百万词元的平均输入价格(低范围)

每百万个词元的平均输出价格(低范围)

费用

100 万

2000 万

$0.63

$2.50

$0.16

$0.63

平衡

100 万

2000 万

$1.26

$5.00

$0.63

$2.50

品质

100 万

2000 万

$1.89

$7.50

$1.26

$5.00

* Model Optimizer 是一项付费实验性产品,可能会将请求路由到 Agent Platform 上的 Gemini 实验性版本。

多模态嵌入

模型

类型

说明

请求类型

价格 /100 万个 token(美元)

Gemini Embedding 2(统一多模态,预览版)

输入文本

使用文本作为输入来生成嵌入

在线请求

US$0.20

批量请求

US$0.10

输入图片

使用图片作为输入来生成嵌入

在线请求

US$0.45

批量请求

US$0.225

输入视频

使用视频作为输入来生成嵌入

在线请求

US$12.00

批量请求

US$6.00

输入音频

使用音频作为输入来生成嵌入

在线请求

US$6.50

批量请求

US$3.25

*输出 token 不收费。

模型

特性

说明

输入

输出

价格 (USD)

multimodalembedding

Embeddings for Multimodal:文本

使用文本作为输入来生成嵌入

文字

Embeddings

US$0.0002 / 1,000 count

Embeddings for Multimodal:图片

使用图片作为输入来生成嵌入

映像

Embeddings

US$0.0001 / 1 count

Embeddings for Multimodal:视频 Plus

Video Plus

视频

嵌入(每分钟视频最多 15 项嵌入)

US$0.002 / 1 count

Embeddings for Multimodal:视频标准

Video Standard

视频

嵌入(每分钟视频最多 8 项嵌入)

US$0.001 / 1 count

Embeddings for Multimodal:视频基础知识

Video Essential

视频

嵌入(每分钟视频最多 4 项嵌入)

US$0.0005 / 1 count

开源模型

类型

请求类型

价格 /100 万个 token(美元)

multilingual-e5-small

输入

在线请求

US$0.015

输出

在线请求

免费

批量输入

批量请求

US$0.0075

批量输出

批量请求

免费

multilingual-e5-large

输入

在线请求

US$0.025

输出

在线请求

免费

批量输入

批量请求

US$0.0125

批量输出

批量请求

免费

所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

Agent Platform 代码补全的定价

Agent Platform 上的生成式 AI 按每 1,000 个字符的输入(提示)和每 1,000 个字符的输出(回答)计费。字符按 UTF-8 码位计数,计数中不包括空格。在预览版阶段,费用享受 100% 的折扣。生成过滤后响应的预测请求仅针对输入计费。在每个结算周期结束时,1 美分的小数部分 ($0.01) 会四舍五入到 1 美分。

注意:调优后的模型端点的预测价格与基本基础模型相同。

模型

类型

区域

请求类型

价格 /1,000 个词元(美元)

Codey for Code Completion

输入

全局

在线请求

US$0.00025

输出

全局

在线请求

US$0.0005

所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

翻译(文本)

使用 Agent Platform API 和翻译 LLM 来翻译文本。与经典翻译模型相比,LLM 翻译往往更流畅、更像人说的话,但支持的语言更少 (了解详情)

模型

方法

用法

价格 价格 /100 万个词元(美元)

LLM

文本翻译*

每月输入字符数

US$10.00

每月输出字符数

US$10.00

翻译 LLM 002

文本翻译*

每月输入字符数

US$20.00

每月输出字符数

US$20.00

所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

*价格按模型处理的字符数计算。如需详细了解会对哪些字符计费,请参阅计费字符

显式缓存的上下文缓存存储价格

此表包含基于输入(文本、图片、视频、音频)的上下文缓存存储价格

模型

价格 Tok/小时<= 20 万个输入 token

价格(每小时 Token 数 > 20 万个输入 token)

Gemini 3.1 Pro

US$0.0000045US$0.0000045

Gemini 3.6 Flash、Gemini 3.5 Flash、Gemini 3 Flash

US$0.000001US$0.000001

Gemini 3.5 Flash Lite、Gemini 3.1 Flash Lite

US$0.000001US$0.000001

Gemini 3 Pro

US$0.0000045US$0.0000045

Gemini 2.5 Pro

US$0.0000045US$0.0000045

Gemini 2.5 Flash

US$0.000001US$0.000001

Gemini 2.5 Flash Lite

1 小时 $0.000001

$0.000001

Gemini 2.0 模型

模型

类型

存储空间(百万词元-小时)

价格 /1(美元)

Gemini 2.0 Flash

输入令牌

US$0.000001US$0.0375

输入音频 token

US$0.000001US$0.25

输出文本 token

不适用

不适用

Gemini 2.0 Flash Lite

输入令牌

US$0.000001US$0.01875

输入音频 token

US$0.000001US$0.01875

输出文本 token

不适用

不适用

* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。

* 调优后的模型端点的预测价格与基本模型相同。

以下模态价格仅供参考,基于平均用例。实际结算将仅基于词元:

  • 4 个字符大约会生成 1 个文本词元(包括空格)。
  • 对于 1024x1024 的图片,它会消耗 1290 个 token。每张图片的 token 数量因图片分辨率而异。如需详细了解如何计算词元,请参阅我们的文档
  • 视频输入按每秒一帧的采样率,每秒消耗 258 个词元。视频(含音频)既要按视频 token 计费,也要按音频 token 计费。
  • 音频输入每秒消耗 25 个 token,不包括时间戳。

模型

类型

存储空间(模态小时)

价格 (USD)

Gemini 2.0 Flash

输入文本(美元/100 万个字符)

$0.25

$0.009375

输入图片($/张)

$0.00129

$0.000048375

输入视频(美元/秒)

$0.000258

$0.000009675

输入音频(美元/秒)

$0.000025

$0.00000625

输出文本(美元/百万字符)

不适用

不适用

Gemini 2.0 Flash Lite

输入文本(美元/100 万个字符)

$0.25

$0.0046875

输入图片($/张)

$0.00129

输入视频(美元/秒)

$0.000258

$0.000009675

输入音频(美元/秒)

$0.000258

$0.0000048375

输出文本(美元/百万字符)

不适用

不适用

* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。

* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。

* 调优后的模型端点的预测价格与基本模型相同。

基于接地的定价

特性

价格 (USD)

依托 Google 搜索进行接地*

Gemini 2.0 Flash 每天最多可处理 1,500 个接地请求,无需额外付费。每天超过 1,500 次的接地请求按每 1,000 次请求 35 美元计费(每天最多 100 万次请求)。

如果您每天需要超过 100 万次请求,请与您的客户支持团队联系。

客户可能会决定不在其客户应用界面中显示基于接地结果的搜索建议;不过,这需要采用另一种定价模式。请与您的 Google Cloud 客户支持团队联系,申请免除此费用。

适用于企业的 Web 接地*

自 2025 年 5 月 5 日起,每 1,000 个请求 45 美元(每天最多 100 万个请求)。

如果您每天需要超过 100 万次请求,请与您的客户支持团队联系。

客户可能会决定不在其客户应用界面中显示基于接地结果的搜索建议;不过,这需要采用另一种定价模式。请与您的 Google Cloud 客户支持团队联系,申请免除此费用。

* 这适用于基于模态的定价。

注意:仅当请求返回的结果中包含至少一个来自网络的接地支持网址时,才会针对依托 Google 搜索进行接地的请求收费。此外,还需支付标准 Gemini 模型使用费。

预配吞吐量

预配吞吐量可确保满足您的生成式 AI 需求,并通过生成式 AI 扩缩单元 (GSU) 进行交易。如需详细了解每个 GSU 提供的吞吐量,请点击此处,并使用我们的在线估算器(点击此处)。

时长

全球每 GSU 小时价格 (USD)

非全球*每 GSU 小时价格 (USD)

1 周承诺

US$7.14US$7.854

1 个月承诺期

US$3.698630137US$4.068493151

3 个月承诺期

US$3.287671233US$3.616438356

1 年期承诺

US$2.739726027US$3.01369863

* 对于非全球端点,正式版 Gemini 3 及更高版本模型系列的价格将于 2026 年 7 月 1 日生效。2026 年 7 月 1 日之前,非全球端点将采用全球端点价格。

费用计算示例

用户需要确保可以使用 gemini-2.0-flash 支持每秒 10 次查询 (QPS),每次查询的输入为 1,000 个文本 token 和 500 个音频 token,并接收 300 个文本 token 的输出。

使用吞吐量和消耗率,对于 gemini-2.0-flash,我们知道输入文本 token 的消耗率为 1 个 token,输入音频 token 的消耗率为 7 个 token,输出文本 token 的消耗率为 4 个 token。

用户的输入 token 总数为 1,000*(每个输入文本 token 1 个 token)+ 500*(每个输入音频 token 7 个 token)= 4,500 个按消耗调整后的输入 token。用户的总输出 token 数为 300 *(每个输出文本 token 4 个 token)= 1,200 个按消耗调整后的输出 token。将它们相加,得到 4,500 个按消耗调整后的输入 token + 1,200 个按消耗调整后的输出 token = 每次查询 5,700 个总 token。

将每次查询的 token 总数乘以 QPS,即可得出每秒的总 token 数:5,700 个 token/查询 * 10 QPS = 57,000 个 token/秒。

将此值除以每 GSU 每秒的总吞吐量,得到每秒 57,000 个总 token ÷ 每 GSU 每秒 3,360 吞吐量 = 16.96 GSU。此模型的最小 GSU 购买增量为 1,因此用户需要 17 个 GSU。

如果用户想要以这种吞吐量持续运行 1 周,则费用为 $1,200 * 17 GSU = 每周 $20,400。如果他们想以这种吞吐量持续运行 1 个月,则费用为 $2,700 * 17 GSU = 每月 $45,900。如果他们想将此吞吐量维持 3 个月,则每月需要支付 $2,400 * 17 GSUs = $40,800。最后,如果他们想将此吞吐量维持 1 年,则每月需要支付 $2,000 * 17 GSU = $34,000。

模型调优

模型调优是针对任务自定义大型模型的有效方法。这是提高模型质量和效率的关键步骤。模型调优具有以下优势:

  • 针对您的特定任务提供更高的质量
  • 提高模型稳健性
  • 提示较短,因此推理延迟时间和费用更低

调优按每百万个训练 token 收费。训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。从 Gemini 3 开始,调优后的模型端点预测价格将是基本模型的 1.5 倍。旧 Gemini 模型(Gemini 2.5 及更早版本)的预测价格与基础模型相同。

模型

类型

价格 (USD)

Gemini 3.5 Flash

监督式微调

强化学习微调

US$0.01

Gemini 3.1 Flash Lite

监督式微调

US$0.003

Gemini 2.5 Pro

监督式微调

US$0.025

Gemini 2.5 Flash

监督式微调

偏好调优

US$0.005

Gemini 2.5 Flash Lite

监督式微调

偏好调优

US$0.0015

Gemma 3 1B IT

监督式微调

US$0.47

Gemma 3 4B IT

监督式微调

US$1.14

Gemma 3 12B IT

监督式微调

US$1.82

Gemma 3 27B IT

监督式微调

US$6.83

Medgemma 1.5 4B IT

监督式微调

US$1.14

Llama 3.1 8B

监督式微调

US$0.67

Llama 3.2 1B

监督式微调

US$0.28

Llama 3.2 3B

监督式微调

US$0.61

Llama 3.3 70B

监督式微调

US$6.72

Llama 4 Scout 17B 16E

监督式微调

US$5.77

Qwen 3 4B

监督式微调

US$1.35

Qwen 3 8B

监督式微调

US$4.18

Qwen 3 14B

监督式微调

US$8.46

Qwen 3 32B

监督式微调

US$6.57

* 训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。

* 对于从 Gemini 3 开始的模型推理,调优后的模型端点预测价格将是基本模型的 1.5 倍。旧 Gemini 模型的预测价格与基础模型相同。

按字符数收费的特殊情况

模型

类型

价格 /100 万(美元)

翻译 LLM 002

监督式微调

US$6.25

AlphaEvolve

AlphaEvolve 的费用由所用 Gemini 模型的费用加上 AlphaEvolve 智能体的费用决定。

Gemini 模型

类型

Gemini 模型价格 /100 万(美元)

AlphaEvolve 智能体价格 /100 万(美元)

总价格 /100 万(美元)

Gemini 3 Pro 预览版

每 100 万个输入 token 的价格

US$2.00US$4.00

$6.00

每 100 万个输出和思考 token 的价格

US$12.00US$24.00

$36.00

Gemini 3.5 Flash

每 100 万个输入 token 的价格

US$1.50US$3.00

$4.50

每 100 万个输出和思考 token 的价格

US$9.00US$18.00

$27.00

Agent Platform 上的合作伙伴模型

合作伙伴模型是由 Google 合作伙伴开发的一系列精选生成式 AI 模型。合作伙伴模型以托管式 API 的形式提供。如需了解详情,请参阅合作伙伴模型概览。以下部分列出了 Google 合作伙伴模型的价格详情。

Anthropic 的 Claude 模型

采用区域定价的模型

模型

类型

模型价格(/100 万个词元)=< 20 万个输入词元

价格(/100 万个 token)> 20 万个输入 token

Opus 5

输入

$5.00

$5.00

输出

$25.00

$25.00

批量输入

$2.50

批量输出

$12.50

5 分钟缓存写入

$6.25

$6.25

1 小时缓存写入

$10.00

$10.00

缓存命中

$0.50

$0.50

5 分钟批量缓存写入

$3.125

1 小时批处理缓存写入

$5.00

批量缓存命中

$0.25

Claude Sonnet 5(推广价截至 2026 年 8 月 31 日)

输入

$2.00

$2.00

输出

$10.00

$10.00

批量输入

$1.00

$1.00

批量输出

$5.00

$5.00

5 分钟缓存写入

$2.50

$2.50

1 小时缓存写入

$4.00

$4.00

缓存命中

$0.20

$0.20

Claude Sonnet 5(标准价格自 2026 年 9 月 1 日起生效)

输入

$3.00

$3.00

输出

$15.00

$15.00

批量输入

$1.50$1.50

批量输出

$7.50

$7.50

5 分钟缓存写入

$3.75

$3.75

1 小时缓存写入

$6.00

$6.00

缓存命中

$0.30

$0.30

Claude Fable 5

输入

$10.00

$10.00

输出

$50.00

$50.00

批量输入

$5.00

批量输出

$25.00

5 分钟缓存写入

$12.50

$12.50

1 小时缓存写入

20.00 美元

20.00 美元

缓存命中

$1.00

$1.00

5 分钟批量缓存写入

$6.25

1 小时批处理缓存写入

$10.00

批量缓存命中

$0.50

Claude Opus 4.8

输入

$5.00

$5.00

输出

$25.00

$25.00

批量输入

$2.50

批量输出

$12.50

5 分钟缓存写入

$6.25

$6.25

1 小时缓存写入

$10.00

$10.00

缓存命中

$0.50

$0.50

5 分钟批量缓存写入

$3.125

1 小时批处理缓存写入

$5.00

批量缓存命中

$0.25

Claude Opus 4.7

输入

$5.00

$5.00

输出

$25.00

$25.00

批量输入

$2.50

批量输出

$12.50

5 分钟缓存写入

$6.25

$6.25

1 小时缓存写入

$10.00

$10.00

缓存命中

$0.50

$0.50

5 分钟批量缓存写入

$3.125

1 小时批处理缓存写入

$5.00

$5.00

批量缓存命中

$0.25

Claude Opus 4.6

输入

$5.00

$5.00

输出

$25.00

$25.00

批量输入

$2.50

批量输出

$12.50

5 分钟缓存写入

$6.25

$6.25

1 小时缓存写入

$10.00

$10.00

缓存命中

$0.50

$0.50

5 分钟批量缓存写入

$3.125

1 小时批处理缓存写入

$5.00

批量缓存命中

$0.25

Claude Opus 4.5

输入

$5.00

输出

$25.00

批量输入

$2.50

批量输出

$12.50

5 分钟缓存写入

$6.25

1 小时缓存写入

$10.00

缓存命中

$0.50

5 分钟批量缓存写入

$3.125

1 小时批处理缓存写入

$5.00

批量缓存命中

$0.25

Claude Sonnet 4.6

输入

$3.00

$3.00

输出

$15.00

$15.00

批量输入

$1.50

批量输出

$7.50

5 分钟缓存写入

$3.75

$3.75

1 小时缓存写入

$6.00

$6.00

缓存命中

$0.30

$0.30

5 分钟批量缓存写入

$1.88

1 小时批处理缓存写入

$3.00

批量缓存命中

$0.15

Claude Sonnet 4.5

输入

$3.00

$6.00

输出

$15.00

$22.50

批量输入

$1.50

批量输出

$7.50

5 分钟缓存写入

$3.75

$7.50

1 小时缓存写入

$6.00

12.00 美元

缓存命中

$0.30

$0.60

5 分钟批量缓存写入

$1.88

1 小时批处理缓存写入

$3.00

批量缓存命中

$0.15

5 分钟批量缓存写入

$1.00

Claude Haiku 4.5

输入

$1.00

输出

$5.00

批量输入

$0.50

批量输出

$2.50

5 分钟缓存写入

$1.25

批量缓存命中

$0.05

1 小时缓存写入

$2.00

缓存命中

$0.10

5 分钟批量缓存写入

$0.625

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

模型

类型

价格(/100 万个 token)=< 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

Opus 5

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Sonnet 5(推广价截至 2026 年 8 月 31 日)

输入

$2.20

$2.20

输出

$11.00

$11.00

批量输入

$1.10

$1.10

批量输出

$5.50

$5.50

5 分钟缓存写入

$2.75

$2.75

1 小时缓存写入

$4.40

$4.40

缓存命中

$0.22

$0.22

Claude Sonnet 5(标准价格自 2026 年 9 月 1 日起生效)

输入

$3.30

$3.30

输出

$16.50

$16.50

批量输入

$1.65

$1.65

批量输出

$8.25

$8.25

5 分钟缓存写入

$4.125

$4.125

1 小时缓存写入

$6.60

$6.60

缓存命中

$0.33

$0.33

Claude Fable 5

输入

 $11.00

 $11.00

输出

$55.00

$55.00

批量输入

$5.50

批量输出

$27.50

5 分钟缓存写入

$13.75

$13.75

1 小时缓存写入

$22.00

$22.00

缓存命中

$1.10

$1.10

5 分钟批量缓存写入

$6.875

1 小时批处理缓存写入

$11.00

批量缓存命中

$0.55

Claude Opus 4.8

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Opus 4.7

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

模型

类型

价格(/100 万个 token)=< 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

Opus 5

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Sonnet 5(推广价截至 2026 年 8 月 31 日)

输入

$2.20

$2.20

输出

$11.00

$11.00

批量输入

$1.10

$1.10

批量输出

$5.50

$5.50

5 分钟缓存写入

$2.75

$2.75

1 小时缓存写入

$4.40

$4.40

缓存命中

$0.22

$0.22

Claude Sonnet 5(标准价格自 2026 年 9 月 1 日起生效)

输入

$3.30

$3.30

输出

$16.50

$16.50

批量输入

$1.65

$1.65

批量输出

$8.25

$8.25

5 分钟缓存写入

$4.125

$4.125

1 小时缓存写入

$6.60

$6.60

缓存命中

$0.33

$0.33

Claude Fable 5

输入

$11.00

$11.00

输出

$55.00

$55.00

批量输入

$5.50

批量输出

$27.50

5 分钟缓存写入

$13.75

$13.75

1 小时缓存写入

$22.00

$22.00

缓存命中

$1.10

$1.10

5 分钟批量缓存写入

$6.875

1 小时批处理缓存写入

$11.00

批量缓存命中

$0.55

Claude Opus 4.8

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Opus 4.7

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

模型

类型

价格(/100 万个 token)=< 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

Claude Opus 4.6

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Opus 4.5

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Sonnet 4.6

输入

$3.30

$3.30

输出

$16.50

$16.50

批量输入

$1.65

批量输出

$8.25

5 分钟缓存写入

$4.13

$4.13

1 小时缓存写入

$6.60

$6.60

缓存命中

$0.33

$0.33

5 分钟批量缓存写入

$2.06

1 小时批处理缓存写入

$3.30

批量缓存命中

$0.17

输入

$6.60

输出

$24.75

Claude Sonnet 4.5

输入

$3.30

$6.60

输出

$16.50

$24.75

批量输入

$1.65

批量输出

$8.25

5 分钟缓存写入

$4.13

$8.25

1 小时缓存写入

$6.60

$13.20

缓存命中

$0.33

$0.66

5 分钟批量缓存写入

$2.06

1 小时批处理缓存命中

$3.30

批量缓存命中

$0.17

Claude Haiku 4.5

输入

$1.10

输出

$5.50

批量输入

$0.55

批量输出

$2.75

5 分钟缓存写入

$1.375

1 小时缓存写入

$2.20

缓存写入

$1.375

缓存命中

$0.11

5 分钟批量缓存写入

$0.688

1 小时批处理缓存写入

$1.10

批量缓存命中

$0.055

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

模型

类型

价格(/100 万个 token)=< 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

Claude Opus 4.6

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Opus 4.5

输入

$5.50

输出

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

1 小时缓存写入

$11.00

缓存命中

$0.55

5 分钟批量缓存写入

$3.438

1 小时缓存写入

$5.50

批量缓存命中

$0.275

Claude Sonnet 4.6

输入

$3.30

$3.30

输出

$16.50

$16.50

批量输入

$1.65

批量输出

$8.25

5 分钟 批量写入

$4.13

$4.13

1 小时缓存写入

$6.60

$6.60

缓存命中

$0.33

$0.33

5 分钟批处理缓存命中

$2.06

1 小时批处理缓存写入

$3.30

批量缓存命中

$0.17

Claude Sonnet 4.5

输入

$3.30

$6.60

输出

$16.50

$24.75

批量输入

$1.65

批量输出

$8.25

5 分钟缓存写入

$4.13

$8.25

1 小时缓存写入

$6.60

$13.20

缓存命中

$0.33

$0.66

5 分钟批量缓存写入

$2.06

1 小时批处理缓存写入

$3.30

批量缓存命中

$0.17

Claude Haiku 4.5

输入

$1.10

输出

$5.50

批量输入

$0.55

批量输出

$2.75

5 分钟缓存写入

$1.375

1 小时缓存写入

$2.20

缓存命中

$0.11

5 分钟批量缓存写入

$0.688

1 小时批处理缓存写入

$1.10

批量缓存命中

$0.055

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

模型

类型

价格(/100 万个 token)=< 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

Claude Opus 4.6

输入

$5.50

$5.50

输出

$27.50

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

$6.875

1 小时缓存写入

$11.00

$11.00

缓存命中

$0.55

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Opus 4.5

输入

$5.50

输出

$27.50

批量输入

$2.75

批量输出

$13.75

5 分钟缓存写入

$6.875

1 小时缓存写入

$11.00

缓存命中

$0.55

5 分钟批量缓存写入

$3.438

1 小时批处理缓存写入

$5.50

批量缓存命中

$0.275

Claude Sonnet 4.6

输入

$3.30

$3.30

输出

$16.50

$16.50

批量输入

$1.65

批量输出

$8.25

5 分钟缓存写入

$4.13

$4.13

1 小时缓存写入

$6.60

$6.60

缓存命中

$0.33

5 分钟批量缓存写入

$2.06

1 小时批处理缓存写入

$3.30

批量缓存命中

$0.17

Claude Sonnet 4.5

输入

$3.30

$6.60

输出

$16.50

$24.75

批量输入

$1.65

批量输出

$8.25

5 分钟缓存写入

$4.13

$8.25

1 小时缓存写入

$6.60

$13.20

缓存命中

$0.33

$0.66

5 分钟批量缓存写入

$2.06

1 小时批处理缓存写入

$3.30

批量缓存命中

$0.17

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

模型

类型

价格(/100 万个 token)=< 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

Claude Haiku 4.5

输入

$1.10

输出

$5.50

批量输入

$0.55

批量输出

$2.75

5 分钟缓存写入

$1.375

1 小时缓存写入

$2.20

缓存命中

$0.11

5 分钟批量缓存写入

$0.688

1 小时批处理缓存写入

$1.10

批量缓存命中

$0.055

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

所有区域的价格都相同的模型

模型

类型

价格(/100 万个 token)=< 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

Claude Opus 4.1

输入

$15

不适用

输出

$75

不适用

批量输入

$7.50

不适用

批量输出

$37.50

不适用

5 分钟缓存写入

$18.75

不适用

1 小时缓存写入

$30

不适用

缓存命中

$1.50

不适用

5 分钟批量缓存写入

$9.375

不适用

1 小时批处理缓存写入

$15.00

不适用

批量缓存命中

$0.75

不适用

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

工具价格

工具

价格 (USD)

Web 搜索请求

每 1,000 次搜索 10 美元

支持的模型:Claude Haiku 4.5、Claude Sonnet 4.5、Claude Sonnet 4.6、Claude Sonnet 4、Claude Opus 4.1、Claude Opus 4、Claude Opus 4.5 和 Claude Opus 4.6。

* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。

xAI 的 Grok 模型

模型

类型

价格(/100 万个 token)=< 20 万个输入 token

价格(/100 万个 token)> 20 万个输入 token

Grok 4.20 推理

输入

$1.25

$2.50

输出

$2.50

$5.00

缓存命中

$0.20

$0.40

Grok 4.20 非推理

输入

$1.25

$2.50

输出

$2.50

$5.00

缓存命中

$0.20

$0.40

Grok 4.3

输入

$1.25

$2.50

输出

$2.50

$5.00

缓存命中

$0.20

$0.40

* 如果查询输入上下文长度超过 20 万个词元,则所有词元均按长上下文费率计费。

模型

类型

价格 / 100 万个 token(美元)

Grok 4.1 Fast Reasoning

输入

$0.20

输出

$0.50

缓存命中

$0.05

Grok 4.1 Fast Non-Reasoning

输入

$0.20

输出

$0.50

缓存命中

$0.05

Deepseek 的模型

模型

类型

价格 /100 万(美元)

DeepSeek-V3.1

输入

US$0.60

输出

US$1.70

缓存命中

US$0.06

批量输入

US$0.30

批量输出

US$0.85

DeepSeek-V3.2

输入

US$0.56

输出

US$1.68

缓存命中

US$0.056

批量输入

$0.28

批量输出

$0.84

DeepSeek-R1 (0528)

输入

US$1.35

输出

US$5.40

批量输入

US$0.675

批量输出

US$2.70

DeepSeek-OCR

输入

US$0.30

输出

US$1.20

MiniMax 的模型

模型

类型

价格 /100 万(美元)

MiniMax-M2

输入

US$0.30

输出

US$1.20

缓存命中

US$0.03

Moonshot 的模型

模型

类型

价格 /100 万(美元)

Kimi-K2-Thinking

输入

US$0.60

输出

US$2.50

缓存命中

US$0.06

Qwen 的模型

模型

类型

价格 /100 万(美元)

Qwen3-Next-80B-Thinking

输入

US$0.15

输出

US$1.20

Qwen3-Next-80B-Instruct

输入

US$0.15

输出

US$1.20

Qwen3-Coder-480B-A35B-Instruct

输入

US$0.22

输出

US$1.80

缓存命中

US$0.022

批量输入

US$0.11

批量输出

US$0.90

Qwen3-235B-A22B-Instruct-2507

输入

US$0.22

输出

US$0.88

批量输入

US$0.11

批量输出

US$0.44

GLM 的模型

模型

类型

价格 /100 万(美元)

GLM-4.7

输入

US$0.60

输出

US$2.20

缓存命中

US$0.06

GLM-5 *

输入

US$1.00

输出

US$3.20

缓存命中

US$0.10

OpenAI 的模型

模型

类型

价格 /100 万(美元)

gpt-oss-120b

输入

US$0.09

输出

US$0.36

批量输入

US$0.045

批量输出

US$0.18

gpt-oss-20b

输入

US$0.07

输出

US$0.25

缓存命中

US$0.007

批量输入

US$0.035

批量输出

US$0.125

Meta 的 Llama 模型

模型

类型

价格 /100 万(美元)

Llama 3.3 70B

输入

US$0.72

输出

US$0.72

批量输入

US$0.36

批量输出

US$0.36

Llama 4 Scout

输入

US$0.25

输出

US$0.70

批量输入

US$0.125

批量输出

US$0.35

Llama 4 Maverick

输入

US$0.35

输出

US$1.15

批量输入

US$0.175

批量输出

US$0.575

Mistral AI 的模型

模型

类型

价格 /100 万(美元)

Mistral OCR (25.05)

输入

$0.0005(或 $0.0005/页)

输出

$0.0005(或 $0.0005/页)

Mistral Medium 3

输入

$0.40

输出

$2.00

Mistral Small 3.1 (25.03)

输入

$0.10

输出

$0.30

Codestral 2

输入

$0.30

输出

$0.90

获取定制报价

Google Cloud 采用随用随付的价格模式,您只需为实际使用的服务付费。请与我们的销售团队联系,获取为贵组织量身定制的报价。
Google Cloud