所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
只有返回 200 响应代码的请求才会产生费用。对于返回任何其他响应代码(例如 4xx 和 5xx 代码)的请求,不会收取输入或输出费用。
本页面介绍了 Agent Platform 上的生成式 AI 的价格。如需了解所有其他 Agent Platform 价格(包括机器学习平台和 MLOps 服务),请参阅 Agent Platform 价格页面。
灵活节省计划 (FSP) 是一种基于支出的承诺使用折扣,可帮助您节省 Google Cloud 上符合条件的产品的使用费用。如需详细了解 FSP 的运作方式和适用产品,请参阅灵活节省方案。
模型 | 类型 | 区域 | 价格(/100 万个 token)<= 20 万个输入 token | 价格(/100 万个 token)> 20 万个输入 token | 价格(/100 万个 token)<= 20 万个缓存输入 token | 价格(/100 万个 token)> 20 万个缓存输入 token |
|---|---|---|---|---|---|---|
Gemini 3 Pro 预览版 | 输入(文本、图片、视频、音频) | 全局 | US$2.00 | US$4.00 | US$0.20 | US$0.40 |
文本输出(回答和推理) | 全局 | US$12.00 | US$18.00 | 不适用 | 不适用 | |
Gemini 3.5 Flash | 输入(文本、图片、视频、音频) | 全局 | US$1.50 | US$1.50 | US$0.15 | US$0.15 |
非全球* | US$1.65 | US$1.65 | US$0.165 | US$0.165 | ||
文本输出(回答和推理) | 全局 | US$9.00 | US$9.00 | 不适用 | 不适用 | |
非全球* | US$9.90 | US$9.90 | 不适用 | 不适用 | ||
Gemini 3.6 Flash | 输入(文本、图片、视频、音频) | 全局 | US$1.50 | US$1.50 | US$0.15 | US$0.15 |
文本输出(回答和推理) | 全局 | US$7.50 | US$7.50 | 不适用 | 不适用 | |
Gemini 3.5 Flash-Lite | 输入(文本、图片、视频、音频) | 全局 | US$0.30 | US$0.30 | US$0.03 | US$0.03 |
非全球* | US$0.33 | US$0.33 | US$0.033 | US$0.033 | ||
文本输出(回答和推理) | 全局 | US$2.50 | US$2.50 | 不适用 | 不适用 | |
非全球* | US$2.75 | US$2.75 | 不适用 | 不适用 | ||
Gemini 3 Flash 预览版 | 输入(文本、图片、视频) | 全局 | US$0.50 | US$0.50 | US$0.05 | US$0.05 |
输入(音频) | 全局 | US$1.00 | US$1.00 | US$0.10 | US$0.10 | |
文本输出(回答和推理) | 全局 | US$3.00 | US$3.00 | 不适用 | 不适用 | |
Gemini 3.1 Flash-Lite | 输入(文本、图片、视频) | 全局 | US$0.25 | US$0.25 | US$0.025 | US$0.025 |
非全球* | US$0.275 | US$0.275 | US$0.0275 | US$0.0275 | ||
输入(音频) | 全局 | US$0.50 | US$0.50 | US$0.05 | US$0.05 | |
非全球* | US$0.55 | US$0.55 | US$0.055 | US$0.055 | ||
文本输出(回答和推理) | 全局 | US$1.50 | US$1.50 | 不适用 | 不适用 | |
非全球* | US$1.65 | US$1.65 | 不适用 | 不适用 | ||
Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite) | 输入(文本、图片、视频) | 全局 | US$0.25 | 不适用 | US$0.025 | 不适用 |
文本输出(回答和推理) | 全局 | US$1.50 | 不适用 | 不适用 | 不适用 | |
图片输出**** | 全局 | US$30.00 | 不适用 | 不适用 | 不适用 | |
Gemini 3.1 Flash Image (Nano Banana 2) | 输入(文本、图片、视频) | 全局 | US$0.50 | 不适用 | US$0.05 | 不适用 |
文本输出(回答和推理) | 全局 | US$3.00 | 不适用 | 不适用 | 不适用 | |
图片输出*** | 全局 | US$60.00 | 不适用 | 不适用 | 不适用 | |
Gemini 3 Pro Image (Nano Banana Pro) | 输入(文本、图片) | 全局 | US$2.00 | 不适用 | $0.20 | 不适用 |
文本输出(回答和推理) | 全局 | 12.00 美元 | 不适用 | 不适用 | 不适用 | |
图片输出** | 全局 | US$120.00 | 不适用 | 不适用 | 不适用 |
基于接地的定价
特性 | 用法 | 价格 (USD) |
|---|---|---|
依托 Google 搜索进行接地和依托 Enterprise Web Search 进行接地 | 每月免费提供 5,000 次接地查询,在所有 Gemini 3 模型之间汇总。 超出这些限制的接地查询按 $14/1,000 次接地查询收费。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。 “接地提示”是指客户向 Gemini 提交的最终用户提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询均为“接地查询”)。每次执行接地查询都将单独计费。结算将于 2026 年 1 月 5 日开始。 依托 Google 搜索进行接地或依托企业版 Web 进行接地提供的输入词元不收费。 对于每天少于 100 万条接地提示的客户应用,客户可以选择不以标准价格展示带有接地结果的搜索建议。 | 0 count to 5,000 count US$0.00 (Free) 5,000 count and above US$14.00 |
依托 Google 地图进行接地 | 包括每月 5,000 次免费搜索查询,在所有 Gemini 3 模型中汇总计算。 超出这些限制的 Maps 查询按每 1,000 次查询 14 美元的价格计费。客户向 Gemini 提交的请求可能会触发一次或多次 Google 地图查询。每次执行查询都将单独计费。结算周期开始时间:2026 年 1 月 5 日 Google 地图提供的输入 token 不收费。 | 0 count to 5,000 count US$0.00 (Free) 5,000 count and above US$14.00 |
基于数据进行接地 | 每 1,000 个提示 $2.50。 | US$2.50 |
计算机使用工具 | 价格取决于发送给模型的输入 token 总数以及生成的输出 token。Token 价格取决于所使用的相应模型。 从 Gemini 3.5 开始,函数声明将计入输入 token 数量。 如需了解更多详情,请参阅文档。 |
* 对于非全球端点,正式版 Gemini 3 及更高版本模型系列的价格将于 2026 年 7 月 1 日生效。2026 年 7 月 1 日之前,非全球端点将采用全球端点价格。
* 如果查询输入上下文长度超过 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。
* 调优后的模型端点将是基本模型的 1.5 倍。
** Gemini 3 Pro Image 对每张输入图片收取 560 个 token 的费用,输出图片费用则根据分辨率而定:1K 和 2K(大约 100 万像素和 400 万像素)为 1120 个 token(0.134 美元),4K(大约 1600 万像素)为 2000 个 token(0.24 美元)。
*** Gemini 3.1 Flash Image 对每张输入图片收取 1120 个 token,输出图片费用则根据分辨率而定:512(约 0.25MP)为 747 个 token(0.045 美元),1K(约 1MP)为 1120 个 token(0.067 美元),2K(约 4MP)为 1680 个 token(0.101 美元),4K(约 16MP)为 2,520 个 token(0.15 美元)。
**** Gemini 3.1 Flash-Lite Image 对每张输入图片收取 1120 个 token 的费用,对 1K(约 100 万像素)输出图片收取 1120 个 token(0.034 美元)的费用
模型 | 类型 | Token 价格 <= 20 万个 token | 价格 > 20 万个 token | 价格 <= 20 万个缓存输入 token | 价格 > 20 万个缓存输入 token |
|---|---|---|---|---|---|
Gemini 2.5 Pro | 输入(文本、图片、视频、音频) | US$1.25 | US$2.50 | US$0.125 | US$0.25 |
文本输出(回答和推理) | US$10.00 | US$15.00 | 不适用 | 不适用 | |
Gemini 2.5 Pro 计算机使用 - 预览版 | 输入(文本、图片、视频、音频) | US$1.25 | US$2.50 | 不适用 | 不适用 |
文本输出(回答和推理) | US$10.00 | US$15.00 | 不适用 | 不适用 | |
Gemini 2.5 Flash | 输入(文本、图片、视频) | US$0.30 | US$0.30 | US$0.03 | US$0.03 |
音频输入 | US$1.00 | US$0.30 | US$0.10 | US$0.10 | |
文本输出(回答和推理) | US$2.50 | US$2.50 | 不适用 | 不适用 | |
Gemini 2.5 Flash 图片 | 输入(文本、图片)*** | US$0.30 | 不适用 | 不适用 | 不适用 |
文本输出(回答和推理) | $2.50 | 不适用 | 不适用 | 不适用 | |
图片输出*** | US$30.00 | 不适用 | 不适用 | 不适用 | |
Gemini 2.5 Flash Live API | 输入文本 | US$0.50 | $0.50 | 不适用 | 不适用 |
输入(视频、图片) | US$3.00 | $3.00 | 不适用 | 不适用 | |
音频输入 | US$3.00 | $3.00 | 不适用 | 不适用 | |
文本输出 | US$2.00 | US$2.00 | 不适用 | 不适用 | |
100 万个输出音频 token | US$12.00 | 12.00 美元 | 不适用 | 不适用 | |
Gemini 2.5 Flash Lite | 输入(文本、图片、视频) | US$0.10 | $0.10 | US$0.01 | $0.01 |
音频输入 | US$0.30 | $0.30 | US$0.03 | $0.03 | |
文本输出(回答和推理) | US$0.40 | US$0.40 | 不适用 | 不适用 |
基于接地的定价
特性 | 用法 | 价格 (USD) |
|---|---|---|
使用 Google 搜索建立依据 | Gemini 2.0 Flash、2.5 Flash 和 2.5 Flash-Lite 每天提供 1,500 条接地提示,不收取额外费用。Gemini 2.5 Pro 每天免费提供 10,000 个接地提示。 超出这些限制的接地提示按 $35/1,000 个接地提示计费。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。 “接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。 | 0 count to 10,000 count US$0.00 (Free) 10,000 count and above US$35.00 |
适用于企业的 Web 接地 | 每 1,000 个接地提示$45。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。 “接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。 | US$45.00 |
基于数据进行接地 | 每 1,000 个请求 $2.5。 | US$2.50 |
依托 Google 地图进行接地 | 每 1,000 条接地提示 25 美元。 接地提示是指发送给 Gemini 的请求,该请求至少会向 Google 地图发出 1 次查询。 | 0 count to 1,500 count US$0.00 (Free) 1,500 count and above US$25.00 |
* 如果查询输入上下文长度超过 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。
* 调优后的模型端点的预测价格与基本模型相同。
** 仅当依托 Google 搜索进行接地和企业版网络接地功能的接地提示成功返回来源(即包含至少一个来自网络的接地支持网址的结果)时,才会对其计费。Gemini 模型使用费另行收取。
*** 一张 1024x1024 的图片消耗 1290 个 token(每张 1K 输出图片 0.039 美元)。每张图片的 token 数量因图片分辨率而异。如需详细了解如何计算词元,请参阅我们的文档。
****“计算机使用”结算使用 Gemini 2.5 Pro SKU,如需拆分“计算机使用”费用,请应用结算标记。如需了解详情,请点击此处。
Gemini 2.0 按词元数计费。如需在发送请求之前计算请求中的输入 token 数,可以使用 SDK 词元化器或 countTokens API。如果您的请求因 400 或 500 错误而失败,则不会向您收取所用词元的费用。
使用价格表中的切换开关,比较基于 token 的定价和基于模态的定价。
模型 | 类型 | 价格 /100 万个 token(美元) | 使用 Batch API 的价格(美元 /100 万个 token) |
|---|---|---|---|
Gemini 2.0 Flash | 输入文本 | US$0.15 | US$0.075 |
输入音频 | US$1.00 | US$0.50 | |
输出文本 | US$0.60 | US$0.30 | |
调整训练 | US$0.003 | ||
Gemini 2.0 Flash 图片生成 | 输入令牌 | US$0.15 | |
输入音频 token | US$1.00 | ||
输入视频 token 数 | US$0.15 | ||
输出文本 token | US$0.60 | ||
输出图片 token 数 | US$30.00 | ||
Gemini 2.0 Flash Live API | 输入文本 token 数 | US$0.50 | |
输入音频 token | US$3.00 | ||
输入视频/图片 token 数 | US$3.00 | ||
输出文本 token | US$2.00 | ||
输出音频 token | US$12.00 | ||
Gemini 2.0 Flash Lite | 输入令牌 | US$0.075 | US$0.0375 |
输入音频 token | US$0.075 | US$0.0375 | |
输出文本 token | US$0.30 | US$0.15 | |
针对训练词元进行调优 | US$0.001 |
* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
* 训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。
* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。
* 调优后的模型端点的预测价格与基本模型相同。
* Gemini 2.0 Flash Live API:每秒音频(输入/输出)25 个词元,每秒视频(输入)258 个词元。在 Gemini 2.0 Flash Live API 处于预览版阶段时,依托 Google 搜索进行接地仍不收取费用。
价格(含接地)
特性 | 用法 | 价格 (USD) |
|---|---|---|
依托 Google 搜索进行接地*, ** | Gemini 2.0 Flash、2.5 Flash 和 2.5 Flash-Lite 每天提供 1,500 条接地提示,不收取额外费用。Gemini 2.5 Pro 每天免费提供 10,000 个接地提示。 超出这些限制的接地提示按 $35/1,000 个接地提示计费。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。 “接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。 | 0 count to 10,000 count US$0.00 (Free) 10,000 count and above US$35.00 |
适用于企业的 Web 接地*, ** | 每 1,000 个接地提示$45。如果您每天需要超过 100 万个接地提示,请与您的客户支持团队联系。 “接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。 | US$45.00 |
使用您的数据进行接地* | 每 1,000 个请求 $2.5。 | US$2.50 |
Grounding with Google Maps* | Gemini 模型每天提供一些接地提示,无需额外费用:
接地提示超出这些限制时,按每 1,000 个接地提示 25 美元的价格计费。 接地提示是指发送给 Gemini 的请求,该请求至少会向 Google 地图发出 1 次查询。 如果您每天需要超过 100 万条接地提示,请与您的客户支持团队联系。 | 0 count to 1,500 count US$0.00 (Free) 1,500 count and above US$25.00 |
* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
* 训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。
* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。
* 调优后的模型端点的预测价格与基本模型相同。
* Gemini 2.0 Flash Live API:每秒音频(输入/输出)25 个词元,每秒视频(输入)258 个词元。在 Gemini 2.0 Flash Live API 处于预览版阶段时,依托 Google 搜索进行接地仍不收取费用。
** 仅当提示成功返回来源(即包含至少一个来自网络的接地支持网址的结果)时,才会对使用依托 Google 搜索进行接地和企业版网络接地功能计费。Gemini 模型使用费另行收取。
Gemini 2.0 或 Gemini 2.5 以外的所有 Gemini 模型均按模态计费,例如字符数、图片数、视频/音频秒数。
Gemini 1.5
模型 | 特性 | 类型 | 价格(=< 12.8 万个输入 token) | 价格(> 12.8 万个输入 token) |
|---|---|---|---|---|
Gemini 1.5 Flash | 多模态 | 图片输入 | US$0.00002 / 1 count | US$0.00004 / 1 count |
视频输入 | US$0.00002 / 1 count | US$0.00004 / 1 count | ||
文本输入 | US$0.00001875 / 1,000 count | US$0.0000375 / 1,000 count | ||
音频输入 | US$0.000002 / 1 count | US$0.000004 / 1 count | ||
文本输出 | US$0.000075 / 1,000 count | US$0.00015 / 1,000 count | ||
调优* | 训练代币 | US$0.008 / 1,000 count | ||
Gemini 1.5 Pro | 多模态 | 图片输入 | US$0.00032875 / 1 count | US$0.0006575 / 1 count |
视频输入 | US$0.00032875 / 1 count | US$0.0006575 / 1 count | ||
文本输入 | US$0.0003125 / 1,000 count | US$0.000625 / 1,000 count | ||
音频输入 | US$0.00003125 / 1 count | US$0.0000625 / 1 count | ||
文本输出 | US$0.00125 / 1,000 count | US$0.0025 / 1,000 count | ||
调优* | 训练代币 | US$0.08 / 1,000 count | ||
Gemini 1.0 Pro | 多模态 | 图片输入 | US$0.0025 / 1 count | |
视频输入 | US$0.002 / 1 count | |||
文本输入 | US$0.000125 / 1,000 count | |||
文本输出 | US$0.000375 / 1,000 count |
* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
* 如果查询上下文长度超过 128K,则所有 token 均按长上下文费率计费。
* Gemini 模型在批量模式下可享受 50% 的折扣。
* Gemini 1.0 Pro 仅支持最大 32K 的上下文窗口。
* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。
* 调优后的模型端点的预测价格与基本模型相同。
** 仅当提示成功返回来源(即包含至少一个来自网络的接地支持网址的网络结果)时,才会对使用依托 Google 搜索进行接地和企业版网络接地功能计费。Gemini 模型使用费另行收取。
接地定价
特性 | 价格 (USD) |
|---|---|
使用 Google 搜索建立依据 | 每 1,000 个接地提示 35 美元。 “接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。 |
适用于企业的 Web 接地 | 每 1,000 个接地提示 45 美元。 “接地提示”是指最终用户向 Gemini 提交的提示,Gemini 会针对该提示向 Google 网络索引发出一个或多个查询(每个查询称为“接地查询”**)。即使发送了多个接地查询,也只按一个接地提示收费。 |
基于数据进行接地 | 自 2025 年 6 月 16 日起,每 1,000 个请求 2.5 美元。 |
** 仅当提示成功返回来源(即包含至少一个来自网络的接地支持网址的网络结果)时,才会对使用依托 Google 搜索进行接地和企业版网络接地功能计费。Gemini 模型使用费另行收取。
Imagen
借助 Agent Platform 上的 Imagen,您可以生成新图片并根据您提供的文本提示修改图片,或使用您定义的遮盖区域以及许多其他功能仅修改图片的某些部分。
模型 | 特性 | 说明 | 输入 | 输出 | 价格 / 1 个计数(美元) |
|---|---|---|---|---|---|
Imagen 4 Ultra | 图片生成 | 生成图片 | 文本提示 | 映像 | US$0.06 |
Imagen 4 | 提升 | 将生成的图片的分辨率提高到 2K、3K 和 4K | 映像 | 映像 | $0.06 |
Imagen 4 | 图片生成 | 生成图片 | 文本提示 | 映像 | US$0.04 |
Imagen 4 Fast | 图片生成 | 生成图片 | 文本提示 | 映像 | US$0.02 |
Imagen 3 | 图片生成 | 生成图片 修改图片 自定义图片 | 文本提示 | 映像 | US$0.04 |
Imagen 3 Fast | 图片生成 | 生成图片 | 文本提示 | 映像 | US$0.02 |
Imagen 2、Imagen 1 | 图片生成 | 生成图片 | 文本提示 | 映像 | US$0.02 |
Imagen 2、Imagen 1 | 图片修改 | 使用无蒙版或蒙版方法修改图片 | 图片/文字提示 | 映像 | US$0.02 |
Imagen 1 | 提升 | 将生成的图片的分辨率提高到 2K 和 4K | 映像 | 映像 | US$0.003 |
Imagen 1 | 微调 | 启用用户提供的“主题”以用于 Imagen 提示(少样本训练) | 带有文本标识符的主题,每个主题 4-8 张图片 | 微调后的模型(使用用户提供的主题进行训练后) | 每节点时 $(Agent Platform 自定义训练价格) |
Imagen | 视觉标注 | 为图片生成短文本或长文本字幕 | 映像 | 文本字幕 | US$0.0015 |
Imagen | 视觉问答 | 根据引用图片的问题提供回答 | 图片/文字提示 | 文本回答 | US$0.0015 |
Imagen | Product Recontext | 在新的场景中重新构想产品 | 1-3 张同一产品的图片,以及描述所需场景的文本提示 | 映像 | $0.12 |
虚拟试穿 | 生成人物穿着不同服装的图片 | 1 张人物图片和 1 张服装图片 | 映像 | US$0.06 |
所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
Veo
模型 | 特性 | 说明 | 输入 | 输出 | 输出分辨率 | 价格 (USD) |
|---|---|---|---|---|---|---|
Veo 3.1 | 生成视频 + 音频 | 根据文本提示或参考图片生成高质量视频,并同步添加语音/音效 | 文本/图片提示 | 视频 + 音频 | 720p、1080p | US$0.40 / 1 count |
4000 | US$0.60 / 1 count | |||||
视频生成 | 根据文本提示或参考图片生成高质量视频 | 文本/图片提示 | 视频 | 720p、1080p | US$0.20 / 1 count | |
4000 | US$0.40 / 1 count | |||||
Veo 3.1 Fast | 生成视频 + 音频 | 根据文本提示或参考图片,更快地生成带有同步语音/音效的视频 | 文本/图片提示 | 视频 + 音频 | 720p | US$0.10 / 1 count |
1080p | US$0.12 / 1 count | |||||
4000 | US$0.30 / 1 count | |||||
视频生成 | 根据文本提示或参考图片更快地生成视频 | 文本/图片提示 | 视频 | 720p | US$0.08 / 1 count | |
1080p | US$0.10 / 1 count | |||||
4000 | US$0.25 / 1 count | |||||
Veo 3.1 Lite | 生成视频 + 音频 | 根据文本提示或参考图片,以最快的速度生成带有同步语音/音效的视频 | 文本/图片提示 | 视频 + 音频 | 720p | $0.05 / 1 次 |
1080p | $0.08 / 1 次 | |||||
视频生成 | 根据文本提示或参考图片快速生成视频 | 文本/图片提示 | 视频 | 720p | $0.03 / 1 次 | |
1080p | $0.05 / 1 次 | |||||
Veo 3 | 生成视频 + 音频 | 根据文本提示或参考图片生成高质量视频,并同步添加语音/音效 | 文本/图片提示 | 视频 + 音频 | 720p、1080p | US$0.40 / 1 count |
视频生成 | 根据文本提示或参考图片生成高质量视频 | 文本/图片提示 | 视频 | 720p、1080p | US$0.20 / 1 count | |
Veo 3 Fast | 生成视频 + 音频 | 根据文本提示或参考图片,更快地生成带有同步语音/音效的视频 | 文本/图片提示 | 视频 + 音频 | 720p | US$0.10 / 1 count |
1080p | US$0.12 / 1 count | |||||
视频生成 | 根据文本提示或参考图片更快地生成视频 | 文本/图片提示 | 视频 | 720p | US$0.08 / 1 count | |
1080p | US$0.10 / 1 count | |||||
Veo 2 | 视频生成 | 根据文本提示或参考图片生成视频 | 文本/图片提示 | 视频 | 720p | US$0.50 / 1 count |
高级控制功能 | 通过起始帧和结束帧插值生成视频,延长生成的视频,并应用镜头控制 | 文本/图片/视频提示 | 视频 | 720p | US$0.50 / 1 count |
Lyria
Lyria 模型系列可生成高质量的音乐创作,非常适合复杂的乐曲创作和详细的创意探索,在这些场景中,细致入微的输出至关重要。
模型 | 特性 | 说明 | 输入 | 输出 | 价格 (USD) |
|---|---|---|---|---|---|
Lyria 3 Pro | 生成完整歌曲 | Lyria 3 Pro 可根据文本或图片等多模态输入创作完整的音乐作品 | 文字、图片 | 完整歌曲 | US$0.08 / 1 count |
Lyria 3 | 生成 30 秒的音乐片段 | Lyria 3 可根据文本或图片提示生成高保真 30 秒音频片段 | 文字、图片 | 30 秒音乐片段 | US$0.04 / 1 count |
Lyria 2 | 音乐生成 | 根据文本提示生成音乐 | 文本提示 | 音乐 | US$0.06 / 1 count |
嵌入费用
Gemini API 提供嵌入模型,可为文本、图片、视频和其他内容生成嵌入。
模型 | 类型 | 区域 | 请求类型 | 价格 / 1,000 个计数(美元) |
|---|---|---|---|---|
Gemini Embedding | 输入 | 全局 | 在线请求 | US$0.00015 |
批量请求 | US$0.00012 | |||
输出 | 全局 | 在线请求 | 免费 | |
批量请求 | 免费 | |||
Embeddings for Text(不包括 Gemini Embedding) | 输入 | 全局 | 在线请求 | US$0.000025 |
批量请求 | US$0.00002 | |||
输出 | 全局 | 在线请求 | 免费 | |
批量请求 | 免费 |
Gemini Omni
模型 | 类型 | Token 价格 /100 万(美元) |
|---|---|---|
Gemini Omni Flash | 输入(文本、图片、视频、音频) | US$1.50 |
文本输出(回答和推理) | US$9.00 | |
视频输出* | US$17.50 |
* Gemini Omni Flash 的输入费用为每张图片 2,040 个词元、每秒音频 32 个词元、每秒视频 5,792 个词元。对于视频输出,Gemini Omni Flash 按每秒 720p 视频输出(含音频)5, 792 个代币收费。
代理
模型 | 类型 | 价格(/100 万个词元) | 价格(/百万个缓存输入 token) |
|---|---|---|---|
Gemini Deep Research 智能体 | 输入(文本) | $2 | $0.2 |
文本输出(回答和推理) | $12 | 不适用 |
基于接地的定价
特性 | 用法 | 价格 (USD) |
|---|---|---|
依托 Google 网页搜索和图片搜索进行接地,以及适用于企业的 Web 接地* | 包括每月 5,000 次免费搜索查询,在所有 Gemini 3 模型中汇总计算。 超出这些限制的搜索查询按每 1,000 次搜索查询 14 美元的价格计费。客户向 Gemini 提交的请求可能会触发一次或多次 Google 搜索查询(或 Enterprise 版的 Web 接地)。每一次搜索查询都将单独计费。结算将于 2026 年 1 月 5 日开始。 依托 Google 搜索进行接地或依托企业版 Web 进行接地提供的输入词元不收费。 如果您每天需要超过 100 万条接地提示,请与您的客户支持团队联系。 客户可能会决定不在其客户应用界面中以标准价格显示基于接地结果的搜索建议。 | 0 count to 5,000 count US$0.00 (Free) 5,000 count and above US$14.00 |
基于数据进行接地 | US$2.50 |
CodeMender
CodeMender 的价格基于 token,由所使用的模型决定
模型 | 类型 | 模型价格 /100 万个词元(美元) | CodeMender 价格 /100 万个 token(美元) |
|---|---|---|---|
Gemini 3.5 Flash | 输入令牌 | US$1.50 | US$1.50 |
缓存的 token 数 | US$0.15 | US$0.15 | |
输出令牌 | US$9.00 | US$9.00 | |
Gemini 3.1 Pro | 输入令牌 | US$2.00 | US$2.00 |
缓存的 token 数 | US$0.20 | US$0.20 | |
输出令牌 | US$12.00 | US$12.00 | |
Gemini 3 Flash | 输入令牌 | US$0.50 | US$0.50 |
缓存的 token 数 | US$0.05 | US$0.05 | |
输出令牌 | US$3.00 | US$3.00 |
Gemma
模型 | 类型 | 价格(/100 万个词元,美元) |
|---|---|---|
Gemma 4 26B | 输入 | US$0.15 |
输出 | US$0.60 | |
缓存命中 | US$0.015 |
Agent Platform Model Optimizer 为 Gemini 模型请求提供了一个元端点,简化了企业客户对 Gemini 的使用。使用此服务的客户无需指定使用 Flash、Pro 还是特定版本。他们只需提供可配置的设置(费用、质量或平衡),指明自己的偏好,Model Optimizer 就会通过将每个查询发送到最合适的模型,应用适合任务的适当智能水平。
Agent Platform Model Optimizer 采用动态定价。也就是说,每个词元的平均价格取决于用于完成任务的模型智能水平。因此,下面提供了价格示例,以根据您的配置设置说明可能出现的场景(请参阅下表)。Model Optimizer SKU 是 1 美元的 SKU,用作购买单位来申请结算,您在使用模型后仍按用量计费。
示例 1 聊天机器人:5:1 的 I/O 比率
注意: 这些范围并非保证,各个客户的实际成效可能会有所不同
客户偏好 | 发送到 MO 的客户输入 token 数 | 发送给 MO 的客户输出 token 数 | 每百万个词元的平均输入价格(高范围) | 每百万个词元的平均输出价格(高范围) | 每百万词元的平均输入价格(低范围) | 每百万个词元的平均输出价格(低范围) |
|---|---|---|---|---|---|---|
费用 | 1000 万 | 200 万 | $0.63 | $2.50 | $0.16 | $0.63 |
平衡 | 1000 万 | 200 万 | $1.26 | $5.00 | $0.63 | $2.50 |
品质 | 1000 万 | 200 万 | $1.89 | $7.50 | $1.26 | $5.00 |
示例 2 内容生成:1:20 的 I/O 比率
客户偏好 | 发送到 MO 的客户输入 token 数 | 发送给 MO 的客户输出 token 数 | 每百万个词元的平均输入价格(高范围) | 每百万个词元的平均输出价格(高范围) | 每百万词元的平均输入价格(低范围) | 每百万个词元的平均输出价格(低范围) |
|---|---|---|---|---|---|---|
费用 | 100 万 | 2000 万 | $0.63 | $2.50 | $0.16 | $0.63 |
平衡 | 100 万 | 2000 万 | $1.26 | $5.00 | $0.63 | $2.50 |
品质 | 100 万 | 2000 万 | $1.89 | $7.50 | $1.26 | $5.00 |
* Model Optimizer 是一项付费实验性产品,可能会将请求路由到 Agent Platform 上的 Gemini 实验性版本。
多模态嵌入
模型 | 类型 | 说明 | 请求类型 | 价格 /100 万个 token(美元) |
|---|---|---|---|---|
Gemini Embedding 2(统一多模态,预览版) | 输入文本 | 使用文本作为输入来生成嵌入 | 在线请求 | US$0.20 |
批量请求 | US$0.10 | |||
输入图片 | 使用图片作为输入来生成嵌入 | 在线请求 | US$0.45 | |
批量请求 | US$0.225 | |||
输入视频 | 使用视频作为输入来生成嵌入 | 在线请求 | US$12.00 | |
批量请求 | US$6.00 | |||
输入音频 | 使用音频作为输入来生成嵌入 | 在线请求 | US$6.50 | |
批量请求 | US$3.25 |
*输出 token 不收费。
模型 | 特性 | 说明 | 输入 | 输出 | 价格 (USD) |
|---|---|---|---|---|---|
multimodalembedding | Embeddings for Multimodal:文本 | 使用文本作为输入来生成嵌入 | 文字 | Embeddings | US$0.0002 / 1,000 count |
Embeddings for Multimodal:图片 | 使用图片作为输入来生成嵌入 | 映像 | Embeddings | US$0.0001 / 1 count | |
Embeddings for Multimodal:视频 Plus | Video Plus | 视频 | 嵌入(每分钟视频最多 15 项嵌入) | US$0.002 / 1 count | |
Embeddings for Multimodal:视频标准 | Video Standard | 视频 | 嵌入(每分钟视频最多 8 项嵌入) | US$0.001 / 1 count | |
Embeddings for Multimodal:视频基础知识 | Video Essential | 视频 | 嵌入(每分钟视频最多 4 项嵌入) | US$0.0005 / 1 count |
开源模型 | 类型 | 请求类型 | 价格 /100 万个 token(美元) |
|---|---|---|---|
multilingual-e5-small | 输入 | 在线请求 | US$0.015 |
输出 | 在线请求 | 免费 | |
批量输入 | 批量请求 | US$0.0075 | |
批量输出 | 批量请求 | 免费 | |
multilingual-e5-large | 输入 | 在线请求 | US$0.025 |
输出 | 在线请求 | 免费 | |
批量输入 | 批量请求 | US$0.0125 | |
批量输出 | 批量请求 | 免费 |
所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
Agent Platform 上的生成式 AI 按每 1,000 个字符的输入(提示)和每 1,000 个字符的输出(回答)计费。字符按 UTF-8 码位计数,计数中不包括空格。在预览版阶段,费用享受 100% 的折扣。生成过滤后响应的预测请求仅针对输入计费。在每个结算周期结束时,1 美分的小数部分 ($0.01) 会四舍五入到 1 美分。
注意:调优后的模型端点的预测价格与基本基础模型相同。
模型 | 类型 | 区域 | 请求类型 | 价格 /1,000 个词元(美元) |
|---|---|---|---|---|
Codey for Code Completion | 输入 | 全局 | 在线请求 | US$0.00025 |
输出 | 全局 | 在线请求 | US$0.0005 |
所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
翻译(文本)
使用 Agent Platform API 和翻译 LLM 来翻译文本。与经典翻译模型相比,LLM 翻译往往更流畅、更像人说的话,但支持的语言更少 (了解详情)。
所列价格以美元 (USD) 为单位。 如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
*价格按模型处理的字符数计算。如需详细了解会对哪些字符计费,请参阅计费字符
显式缓存的上下文缓存存储价格
此表包含基于输入(文本、图片、视频、音频)的上下文缓存存储价格
模型 | 价格 Tok/小时<= 20 万个输入 token | 价格(每小时 Token 数 > 20 万个输入 token) |
|---|---|---|
Gemini 3.1 Pro | US$0.0000045 | US$0.0000045 |
Gemini 3.6 Flash、Gemini 3.5 Flash、Gemini 3 Flash | US$0.000001 | US$0.000001 |
Gemini 3.5 Flash Lite、Gemini 3.1 Flash Lite | US$0.000001 | US$0.000001 |
Gemini 3 Pro | US$0.0000045 | US$0.0000045 |
Gemini 2.5 Pro | US$0.0000045 | US$0.0000045 |
Gemini 2.5 Flash | US$0.000001 | US$0.000001 |
Gemini 2.5 Flash Lite | 1 小时 $0.000001 | $0.000001 |
Gemini 2.0 模型
模型 | 类型 | 存储空间(百万词元-小时) | 价格 /1(美元) |
|---|---|---|---|
Gemini 2.0 Flash | 输入令牌 | US$0.000001 | US$0.0375 |
输入音频 token | US$0.000001 | US$0.25 | |
输出文本 token | 不适用 | 不适用 | |
Gemini 2.0 Flash Lite | 输入令牌 | US$0.000001 | US$0.01875 |
输入音频 token | US$0.000001 | US$0.01875 | |
输出文本 token | 不适用 | 不适用 |
* 所列价格以美元 (USD) 为单位。如果您使用非美元货币付费,请参阅 Cloud Platform SKU 上以您的币种列出的价格。
* PDF 按图片输入计费,一个 PDF 页面相当于一张图片。
* 调优后的模型端点的预测价格与基本模型相同。
基于接地的定价
特性 | 价格 (USD) |
|---|---|
依托 Google 搜索进行接地* | Gemini 2.0 Flash 每天最多可处理 1,500 个接地请求,无需额外付费。每天超过 1,500 次的接地请求按每 1,000 次请求 35 美元计费(每天最多 100 万次请求)。 如果您每天需要超过 100 万次请求,请与您的客户支持团队联系。 客户可能会决定不在其客户应用界面中显示基于接地结果的搜索建议;不过,这需要采用另一种定价模式。请与您的 Google Cloud 客户支持团队联系,申请免除此费用。 |
适用于企业的 Web 接地* | 自 2025 年 5 月 5 日起,每 1,000 个请求 45 美元(每天最多 100 万个请求)。 如果您每天需要超过 100 万次请求,请与您的客户支持团队联系。 客户可能会决定不在其客户应用界面中显示基于接地结果的搜索建议;不过,这需要采用另一种定价模式。请与您的 Google Cloud 客户支持团队联系,申请免除此费用。 |
* 这适用于基于模态的定价。
注意:仅当请求返回的结果中包含至少一个来自网络的接地支持网址时,才会针对依托 Google 搜索进行接地的请求收费。此外,还需支付标准 Gemini 模型使用费。
预配吞吐量可确保满足您的生成式 AI 需求,并通过生成式 AI 扩缩单元 (GSU) 进行交易。如需详细了解每个 GSU 提供的吞吐量,请点击此处,并使用我们的在线估算器(点击此处)。
时长 | 全球每 GSU 小时价格 (USD) | 非全球*每 GSU 小时价格 (USD) |
|---|---|---|
1 周承诺 | US$7.14 | US$7.854 |
1 个月承诺期 | US$3.698630137 | US$4.068493151 |
3 个月承诺期 | US$3.287671233 | US$3.616438356 |
1 年期承诺 | US$2.739726027 | US$3.01369863 |
* 对于非全球端点,正式版 Gemini 3 及更高版本模型系列的价格将于 2026 年 7 月 1 日生效。2026 年 7 月 1 日之前,非全球端点将采用全球端点价格。
费用计算示例
用户需要确保可以使用 gemini-2.0-flash 支持每秒 10 次查询 (QPS),每次查询的输入为 1,000 个文本 token 和 500 个音频 token,并接收 300 个文本 token 的输出。
使用吞吐量和消耗率表,对于 gemini-2.0-flash,我们知道输入文本 token 的消耗率为 1 个 token,输入音频 token 的消耗率为 7 个 token,输出文本 token 的消耗率为 4 个 token。
用户的输入 token 总数为 1,000*(每个输入文本 token 1 个 token)+ 500*(每个输入音频 token 7 个 token)= 4,500 个按消耗调整后的输入 token。用户的总输出 token 数为 300 *(每个输出文本 token 4 个 token)= 1,200 个按消耗调整后的输出 token。将它们相加,得到 4,500 个按消耗调整后的输入 token + 1,200 个按消耗调整后的输出 token = 每次查询 5,700 个总 token。
将每次查询的 token 总数乘以 QPS,即可得出每秒的总 token 数:5,700 个 token/查询 * 10 QPS = 57,000 个 token/秒。
将此值除以每 GSU 每秒的总吞吐量,得到每秒 57,000 个总 token ÷ 每 GSU 每秒 3,360 吞吐量 = 16.96 GSU。此模型的最小 GSU 购买增量为 1,因此用户需要 17 个 GSU。
如果用户想要以这种吞吐量持续运行 1 周,则费用为 $1,200 * 17 GSU = 每周 $20,400。如果他们想以这种吞吐量持续运行 1 个月,则费用为 $2,700 * 17 GSU = 每月 $45,900。如果他们想将此吞吐量维持 3 个月,则每月需要支付 $2,400 * 17 GSUs = $40,800。最后,如果他们想将此吞吐量维持 1 年,则每月需要支付 $2,000 * 17 GSU = $34,000。
模型调优
模型调优是针对任务自定义大型模型的有效方法。这是提高模型质量和效率的关键步骤。模型调优具有以下优势:
调优按每百万个训练 token 收费。训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。从 Gemini 3 开始,调优后的模型端点预测价格将是基本模型的 1.5 倍。旧 Gemini 模型(Gemini 2.5 及更早版本)的预测价格与基础模型相同。
模型 | 类型 | 价格 (USD) |
|---|---|---|
Gemini 3.5 Flash | 监督式微调 强化学习微调 | US$0.01 |
Gemini 3.1 Flash Lite | 监督式微调 | US$0.003 |
Gemini 2.5 Pro | 监督式微调 | US$0.025 |
Gemini 2.5 Flash | 监督式微调 偏好调优 | US$0.005 |
Gemini 2.5 Flash Lite | 监督式微调 偏好调优 | US$0.0015 |
Gemma 3 1B IT | 监督式微调 | US$0.47 |
Gemma 3 4B IT | 监督式微调 | US$1.14 |
Gemma 3 12B IT | 监督式微调 | US$1.82 |
Gemma 3 27B IT | 监督式微调 | US$6.83 |
Medgemma 1.5 4B IT | 监督式微调 | US$1.14 |
Llama 3.1 8B | 监督式微调 | US$0.67 |
Llama 3.2 1B | 监督式微调 | US$0.28 |
Llama 3.2 3B | 监督式微调 | US$0.61 |
Llama 3.3 70B | 监督式微调 | US$6.72 |
Llama 4 Scout 17B 16E | 监督式微调 | US$5.77 |
Qwen 3 4B | 监督式微调 | US$1.35 |
Qwen 3 8B | 监督式微调 | US$4.18 |
Qwen 3 14B | 监督式微调 | US$8.46 |
Qwen 3 32B | 监督式微调 | US$6.57 |
* 训练 token 数的计算方法是将训练数据集中的 token 总数乘以周期数。
* 对于从 Gemini 3 开始的模型推理,调优后的模型端点预测价格将是基本模型的 1.5 倍。旧 Gemini 模型的预测价格与基础模型相同。
按字符数收费的特殊情况
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
翻译 LLM 002 | 监督式微调 | US$6.25 |
AlphaEvolve
AlphaEvolve 的费用由所用 Gemini 模型的费用加上 AlphaEvolve 智能体的费用决定。
Gemini 模型 | 类型 | Gemini 模型价格 /100 万(美元) | AlphaEvolve 智能体价格 /100 万(美元) | 总价格 /100 万(美元) |
|---|---|---|---|---|
Gemini 3 Pro 预览版 | 每 100 万个输入 token 的价格 | US$2.00 | US$4.00 | $6.00 |
每 100 万个输出和思考 token 的价格 | US$12.00 | US$24.00 | $36.00 | |
Gemini 3.5 Flash | 每 100 万个输入 token 的价格 | US$1.50 | US$3.00 | $4.50 |
每 100 万个输出和思考 token 的价格 | US$9.00 | US$18.00 | $27.00 |
合作伙伴模型是由 Google 合作伙伴开发的一系列精选生成式 AI 模型。合作伙伴模型以托管式 API 的形式提供。如需了解详情,请参阅合作伙伴模型概览。以下部分列出了 Google 合作伙伴模型的价格详情。
采用区域定价的模型
模型 | 类型 | 模型价格(/100 万个词元)=< 20 万个输入词元 | 价格(/100 万个 token)> 20 万个输入 token |
|---|---|---|---|
Opus 5 | 输入 | $5.00 | $5.00 |
输出 | $25.00 | $25.00 | |
批量输入 | $2.50 | ||
批量输出 | $12.50 | ||
5 分钟缓存写入 | $6.25 | $6.25 | |
1 小时缓存写入 | $10.00 | $10.00 | |
缓存命中 | $0.50 | $0.50 | |
5 分钟批量缓存写入 | $3.125 | ||
1 小时批处理缓存写入 | $5.00 | ||
批量缓存命中 | $0.25 | ||
Claude Sonnet 5(推广价截至 2026 年 8 月 31 日) | 输入 | $2.00 | $2.00 |
输出 | $10.00 | $10.00 | |
批量输入 | $1.00 | $1.00 | |
批量输出 | $5.00 | $5.00 | |
5 分钟缓存写入 | $2.50 | $2.50 | |
1 小时缓存写入 | $4.00 | $4.00 | |
缓存命中 | $0.20 | $0.20 | |
Claude Sonnet 5(标准价格自 2026 年 9 月 1 日起生效) | 输入 | $3.00 | $3.00 |
输出 | $15.00 | $15.00 | |
批量输入 | $1.50 | $1.50 | |
批量输出 | $7.50 | $7.50 | |
5 分钟缓存写入 | $3.75 | $3.75 | |
1 小时缓存写入 | $6.00 | $6.00 | |
缓存命中 | $0.30 | $0.30 | |
Claude Fable 5 | 输入 | $10.00 | $10.00 |
输出 | $50.00 | $50.00 | |
批量输入 | $5.00 | ||
批量输出 | $25.00 | ||
5 分钟缓存写入 | $12.50 | $12.50 | |
1 小时缓存写入 | 20.00 美元 | 20.00 美元 | |
缓存命中 | $1.00 | $1.00 | |
5 分钟批量缓存写入 | $6.25 | ||
1 小时批处理缓存写入 | $10.00 | ||
批量缓存命中 | $0.50 | ||
Claude Opus 4.8 | 输入 | $5.00 | $5.00 |
输出 | $25.00 | $25.00 | |
批量输入 | $2.50 | ||
批量输出 | $12.50 | ||
5 分钟缓存写入 | $6.25 | $6.25 | |
1 小时缓存写入 | $10.00 | $10.00 | |
缓存命中 | $0.50 | $0.50 | |
5 分钟批量缓存写入 | $3.125 | ||
1 小时批处理缓存写入 | $5.00 | ||
批量缓存命中 | $0.25 | ||
Claude Opus 4.7 | 输入 | $5.00 | $5.00 |
输出 | $25.00 | $25.00 | |
批量输入 | $2.50 | ||
批量输出 | $12.50 | ||
5 分钟缓存写入 | $6.25 | $6.25 | |
1 小时缓存写入 | $10.00 | $10.00 | |
缓存命中 | $0.50 | $0.50 | |
5 分钟批量缓存写入 | $3.125 | ||
1 小时批处理缓存写入 | $5.00 | $5.00 | |
批量缓存命中 | $0.25 | ||
Claude Opus 4.6 | 输入 | $5.00 | $5.00 |
输出 | $25.00 | $25.00 | |
批量输入 | $2.50 | ||
批量输出 | $12.50 | ||
5 分钟缓存写入 | $6.25 | $6.25 | |
1 小时缓存写入 | $10.00 | $10.00 | |
缓存命中 | $0.50 | $0.50 | |
5 分钟批量缓存写入 | $3.125 | ||
1 小时批处理缓存写入 | $5.00 | ||
批量缓存命中 | $0.25 | ||
Claude Opus 4.5 | 输入 | $5.00 | |
输出 | $25.00 | ||
批量输入 | $2.50 | ||
批量输出 | $12.50 | ||
5 分钟缓存写入 | $6.25 | ||
1 小时缓存写入 | $10.00 | ||
缓存命中 | $0.50 | ||
5 分钟批量缓存写入 | $3.125 | ||
1 小时批处理缓存写入 | $5.00 | ||
批量缓存命中 | $0.25 | ||
Claude Sonnet 4.6 | 输入 | $3.00 | $3.00 |
输出 | $15.00 | $15.00 | |
批量输入 | $1.50 | ||
批量输出 | $7.50 | ||
5 分钟缓存写入 | $3.75 | $3.75 | |
1 小时缓存写入 | $6.00 | $6.00 | |
缓存命中 | $0.30 | $0.30 | |
5 分钟批量缓存写入 | $1.88 | ||
1 小时批处理缓存写入 | $3.00 | ||
批量缓存命中 | $0.15 | ||
Claude Sonnet 4.5 | 输入 | $3.00 | $6.00 |
输出 | $15.00 | $22.50 | |
批量输入 | $1.50 | ||
批量输出 | $7.50 | ||
5 分钟缓存写入 | $3.75 | $7.50 | |
1 小时缓存写入 | $6.00 | 12.00 美元 | |
缓存命中 | $0.30 | $0.60 | |
5 分钟批量缓存写入 | $1.88 | ||
1 小时批处理缓存写入 | $3.00 | ||
批量缓存命中 | $0.15 | ||
5 分钟批量缓存写入 | $1.00 | ||
Claude Haiku 4.5 | 输入 | $1.00 | |
输出 | $5.00 | ||
批量输入 | $0.50 | ||
批量输出 | $2.50 | ||
5 分钟缓存写入 | $1.25 | ||
批量缓存命中 | $0.05 | ||
1 小时缓存写入 | $2.00 | ||
缓存命中 | $0.10 | ||
5 分钟批量缓存写入 | $0.625 |
* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。
所有区域的价格都相同的模型
模型 | 类型 | 价格(/100 万个 token)=< 20 万个输入 token | 价格(/100 万个 token)> 20 万个输入 token |
|---|---|---|---|
Claude Opus 4.1 | 输入 | $15 | 不适用 |
输出 | $75 | 不适用 | |
批量输入 | $7.50 | 不适用 | |
批量输出 | $37.50 | 不适用 | |
5 分钟缓存写入 | $18.75 | 不适用 | |
1 小时缓存写入 | $30 | 不适用 | |
缓存命中 | $1.50 | 不适用 | |
5 分钟批量缓存写入 | $9.375 | 不适用 | |
1 小时批处理缓存写入 | $15.00 | 不适用 | |
批量缓存命中 | $0.75 | 不适用 |
* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。
工具价格
工具 | 价格 (USD) |
|---|---|
Web 搜索请求 | 每 1,000 次搜索 10 美元 支持的模型:Claude Haiku 4.5、Claude Sonnet 4.5、Claude Sonnet 4.6、Claude Sonnet 4、Claude Opus 4.1、Claude Opus 4、Claude Opus 4.5 和 Claude Opus 4.6。 |
* 如果查询输入上下文长度超过或等于 20 万个词元,则所有词元(输入和输出)均按长上下文费率计费。
模型 | 类型 | 价格(/100 万个 token)=< 20 万个输入 token | 价格(/100 万个 token)> 20 万个输入 token |
|---|---|---|---|
Grok 4.20 推理 | 输入 | $1.25 | $2.50 |
输出 | $2.50 | $5.00 | |
缓存命中 | $0.20 | $0.40 | |
Grok 4.20 非推理 | 输入 | $1.25 | $2.50 |
输出 | $2.50 | $5.00 | |
缓存命中 | $0.20 | $0.40 | |
Grok 4.3 | 输入 | $1.25 | $2.50 |
输出 | $2.50 | $5.00 | |
缓存命中 | $0.20 | $0.40 |
* 如果查询输入上下文长度超过 20 万个词元,则所有词元均按长上下文费率计费。
模型 | 类型 | 价格 / 100 万个 token(美元) |
|---|---|---|
Grok 4.1 Fast Reasoning | 输入 | $0.20 |
输出 | $0.50 | |
缓存命中 | $0.05 | |
Grok 4.1 Fast Non-Reasoning | 输入 | $0.20 |
输出 | $0.50 | |
缓存命中 | $0.05 |
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
DeepSeek-V3.1 | 输入 | US$0.60 |
输出 | US$1.70 | |
缓存命中 | US$0.06 | |
批量输入 | US$0.30 | |
批量输出 | US$0.85 | |
DeepSeek-V3.2 | 输入 | US$0.56 |
输出 | US$1.68 | |
缓存命中 | US$0.056 | |
批量输入 | $0.28 | |
批量输出 | $0.84 | |
DeepSeek-R1 (0528) | 输入 | US$1.35 |
输出 | US$5.40 | |
批量输入 | US$0.675 | |
批量输出 | US$2.70 | |
DeepSeek-OCR | 输入 | US$0.30 |
输出 | US$1.20 |
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
MiniMax-M2 | 输入 | US$0.30 |
输出 | US$1.20 | |
缓存命中 | US$0.03 |
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
Kimi-K2-Thinking | 输入 | US$0.60 |
输出 | US$2.50 | |
缓存命中 | US$0.06 |
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
Qwen3-Next-80B-Thinking | 输入 | US$0.15 |
输出 | US$1.20 | |
Qwen3-Next-80B-Instruct | 输入 | US$0.15 |
输出 | US$1.20 | |
Qwen3-Coder-480B-A35B-Instruct | 输入 | US$0.22 |
输出 | US$1.80 | |
缓存命中 | US$0.022 | |
批量输入 | US$0.11 | |
批量输出 | US$0.90 | |
Qwen3-235B-A22B-Instruct-2507 | 输入 | US$0.22 |
输出 | US$0.88 | |
批量输入 | US$0.11 | |
批量输出 | US$0.44 |
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
GLM-4.7 | 输入 | US$0.60 |
输出 | US$2.20 | |
缓存命中 | US$0.06 | |
GLM-5 * | 输入 | US$1.00 |
输出 | US$3.20 | |
缓存命中 | US$0.10 |
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
gpt-oss-120b | 输入 | US$0.09 |
输出 | US$0.36 | |
批量输入 | US$0.045 | |
批量输出 | US$0.18 | |
gpt-oss-20b | 输入 | US$0.07 |
输出 | US$0.25 | |
缓存命中 | US$0.007 | |
批量输入 | US$0.035 | |
批量输出 | US$0.125 |
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
Llama 3.3 70B | 输入 | US$0.72 |
输出 | US$0.72 | |
批量输入 | US$0.36 | |
批量输出 | US$0.36 | |
Llama 4 Scout | 输入 | US$0.25 |
输出 | US$0.70 | |
批量输入 | US$0.125 | |
批量输出 | US$0.35 | |
Llama 4 Maverick | 输入 | US$0.35 |
输出 | US$1.15 | |
批量输入 | US$0.175 | |
批量输出 | US$0.575 |
模型 | 类型 | 价格 /100 万(美元) |
|---|---|---|
Mistral OCR (25.05) | 输入 | $0.0005(或 $0.0005/页) |
输出 | $0.0005(或 $0.0005/页) | |
Mistral Medium 3 | 输入 | $0.40 |
输出 | $2.00 | |
Mistral Small 3.1 (25.03) | 输入 | $0.10 |
输出 | $0.30 | |
Codestral 2 | 输入 | $0.30 |
输出 | $0.90 |