Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Ihnen werden nur Anfragen in Rechnung gestellt, die den Antwortcode 200 zurückgeben. Für Anfragen, die andere Antwortcodes zurückgeben, z. B. 4xx- und 5xx-Codes, werden die Eingabe und Ausgabe nicht berechnet.
Auf dieser Seite sind die Preise für generative KI auf der Agent Platform beschrieben. Informationen zu allen anderen Preisen für die Agent Platform, einschließlich der ML Platform- und MLOps-Dienste, finden Sie in der Preisübersicht zur Agent Platform.
Flexible Savings Plans (FSPs) sind ausgabenbasierte Rabatte für zugesicherte Nutzung, mit denen Sie bei der Nutzung berechtigter Produkte in Google Cloud Geld sparen können. Weitere Informationen zu flexiblen Rabattplänen und den dafür infrage kommenden Produkten finden Sie unter Flexible Rabattpläne.
Modell | Typ | Region | Preis (/1 Mio. Tokens) <= 200.000 Eingabetokens | Preis (/1M Tokens) > 200K Eingabetokens | Preis (/1M Tokens) <= 200K im Cache gespeicherte Eingabetokens | Preis (/1M Tokens) > 200.000 im Cache gespeicherte Eingabetokens |
|---|---|---|---|---|---|---|
Gemini 3.1 Pro (Vorabversion) | Eingabe (Text, Bild, Video, Audio) | Global | 2,00 $ | 4,00 $ | 0,20 $ | 0,40 $ |
Textausgabe (Antwort und Begründung) | Global | 12,00 $ | 18,00 $ | – | – | |
Gemini 3.5 Flash | Eingabe (Text, Bild, Video, Audio) | Global | 1,50 $ | 1,50 $ | 0,15 $ | 0,15 $ |
Nicht global* | 1,65 $ | 1,65 $ | 0,165 $ | 0,165 $ | ||
Textausgabe (Antwort und Begründung) | Global | 9,00 $ | 9,00 $ | – | – | |
Nicht global* | 9,90 $ | 9,90 $ | – | – | ||
Gemini 3.6 Flash | Eingabe (Text, Bild, Video, Audio) | Global | 1,50 $ | 1,50 $ | 0,15 $ | 0,15 $ |
Textausgabe (Antwort und Begründung) | Global | 7,50 $ | 7,50 $ | – | – | |
Gemini 3.5 Flash-Lite | Eingabe (Text, Bild, Video, Audio) | Global | 0,30 $ | 0,30 $ | 0,03 $ | 0,03 $ |
Nicht global* | 0,33 $ | 0,33 $ | 0,033 $ | 0,033 $ | ||
Textausgabe (Antwort und Begründung) | Global | 2,50 $ | 2,50 $ | – | – | |
Nicht global* | 2,75 $ | 2,75 $ | – | – | ||
Gemini 3 Flash (Vorabversion) | Eingabe (Text, Bild, Video) | Global | 0,50 $ | 0,50 $ | 0,05 $ | 0,05 $ |
Eingabe (Audio) | Global | 1,00 $ | 1,00 $ | 0,10 $ | 0,10 $ | |
Textausgabe (Antwort und Begründung) | Global | 3,00 $ | 3,00 $ | – | – | |
Gemini 3.1 Flash Lite | Eingabe (Text, Bild, Video) | Global | 0,25 $ | 0,25 $ | 0,025 $ | 0,025 $ |
Nicht global* | 0,275 $ | 0,275 $ | 0,0275 $ | 0,0275 $ | ||
Eingabe (Audio) | Global | 0,50 $ | 0,50 $ | 0,05 $ | 0,05 $ | |
Nicht global* | 0,55 $ | 0,55 $ | 0,055 $ | 0,055 $ | ||
Textausgabe (Antwort und Begründung) | Global | 1,50 $ | 1,50 $ | – | – | |
Nicht global* | 1,65 $ | 1,65 $ | – | – | ||
Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite) | Eingabe (Text, Bild, Video) | Global | 0,25 $ | – | 0,025 $ | – |
Textausgabe (Antwort und Begründung) | Global | 1,50 $ | – | – | – | |
Bildausgabe**** | Global | 30,00 $ | – | – | – | |
Gemini 3.1 Flash Image (Nano Banana 2) | Eingabe (Text, Bild, Video) | Global | 0,50 $ | – | 0,05 $ | – |
Textausgabe (Antwort und Begründung) | Global | 3,00 $ | – | – | – | |
Bildausgabe*** | Global | 60,00 $ | – | – | – | |
Gemini 3 Pro Image (Nano Banana Pro) | Eingabe (Text, Bild) | Global | 2,00 $ | – | 0,20 $ | – |
Textausgabe (Antwort und Begründung) | Global | $ 12,00 | – | – | – | |
Bildausgabe** | Global | 120,00 $ | – | – | – |
Preise mit Begründung
Funktion | Nutzung | Preis (in $) |
|---|---|---|
Fundierung mit der Google Suche und Webfundierung für Unternehmen | Enthält 5.000 Fundierungsabfragen pro Monat ohne Aufpreis, aggregiert über alle Gemini 3-Modelle. Für Grounding-Abfragen, die diese Limits überschreiten, werden 14 $ pro 1.000 Grounding-Abfragen berechnet. Wenn Sie mehr als 1 Million Grounding-Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jede eine Grounding-Abfrage) . Jede einzelne Grounding-Abfrage wird in Rechnung gestellt. Die Abrechnung beginnt am 5. Januar 2026. Für Eingabetokens, die durch die Fundierung mit der Google Suche oder die Web-Fundierung für Unternehmen bereitgestellt werden, fallen keine Kosten an. Kundenunternehmen können sich entscheiden, Suchvorschläge mit fundierten Ergebnissen in ihren Kundenanwendungen nicht anzuzeigen. Dies ist bei einem Standardpreis für weniger als 1 Million Grounding-Prompts pro Tag möglich. | 0 count to 5,000 count 0,00 $ (Free) 5,000 count and above 14,00 $ |
Fundierung mit Google Maps | Enthält 5.000 Suchanfragen pro Monat ohne Aufpreis, zusammengefasst über alle Gemini 3-Modelle. Maps-Abfragen, die diese Limits überschreiten, werden mit 14 $ pro 1.000 Abfragen berechnet. Eine von einem Kundenunternehmen an Gemini gesendete Anfrage kann zu einer oder mehreren Anfragen an Google Maps führen. Ihnen wird jede einzelne ausgeführte Abfrage in Rechnung gestellt. Die Abrechnung beginnt am 5. Januar 2026 Für Eingabetokens, die von Google Maps bereitgestellt werden, fallen keine Gebühren an. | 0 count to 5,000 count 0,00 $ (Free) 5,000 count and above 14,00 $ |
Fundierung mit Ihren Daten | 2,50 $ pro 1.000 Prompts. | 2,50 $ |
Tool zur Computernutzung | Die Preise basieren auf der Gesamtzahl der an das Modell gesendeten Eingabetokens und der daraus resultierenden generierten Ausgabetokens. Die Tokenpreise basieren auf dem jeweils verwendeten Modell. Ab Gemini 3.5 werden Funktionsdeklarationen in die Anzahl der Eingabetokens einbezogen. Weitere Informationen finden Sie in der Dokumentation. |
* Für andere Endpunkte als den globalen Endpunkt treten die Preise für die allgemein verfügbaren Gemini 3-Modellfamilien und neuere Familien am 1. Juli 2026 in Kraft. Vor dem 1. Juli 2026 gelten die Preise für den globalen Endpunkt auch für andere Endpunkte.
* Wenn der Kontext einer Abfrageeingabe länger als 200.000 Tokens ist, werden alle Tokens (Eingabe und Ausgabe) zu den Preisen für lange Kontexte berechnet.
* Der Endpunkt des abgestimmten Modells ist 1,5-mal so groß wie der des Basismodells.
** Gemini 3 Pro Image berechnet 560 Tokens pro Eingabebild. Die Kosten für Ausgabebilder skalieren mit der Auflösung: 1.120 Tokens (0, 134 $) für 1K und 2K (etwa 1 MP und 4 MP) und 2.000 Tokens (0,24 $) für 4K (etwa 16 MP).
*** Gemini 3.1 Flash Image berechnet 1.120 Tokens pro Eingabebild. Die Kosten für Ausgabebilder skalieren mit der Auflösung: 747 Tokens (0,045 $) für 512 (ca. 0,25 MP), 1.120 Tokens (0,067 $) für 1.000 (ca. 1 MP), 1.680 Tokens (0,101 $) für 2.000 (ca. 4 MP) und 2.520 Tokens (0,15 $) für 4.000 (ca. 16 MP).
**** Gemini 3.1 Flash-Lite Image berechnet 1.120 Tokens pro Eingabebild und 1.120 Tokens (0, 034 $) für 1.000 Ausgabebilder (ca. 1 MP).
Modell | Typ | Tokenpreis <= 200.000 Tokens | Preis > 200.000 Tokens | Preis <= 200.000 Eingabetokens im Cache | Preis > 200.000 Eingabetokens im Cache |
|---|---|---|---|---|---|
Gemini 2.5 Pro | Eingabe (Text, Bild, Video, Audio) | 1,25 $ | 2,50 $ | 0,125 $ | 0,25 $ |
Textausgabe (Antwort und Begründung) | 10,00 $ | 15,00 $ | – | – | |
Gemini 2.5 Pro Computernutzung – Vorschau | Eingabe (Text, Bild, Video, Audio) | 1,25 $ | 2,50 $ | – | – |
Textausgabe (Antwort und Begründung) | 10,00 $ | 15,00 $ | – | – | |
Gemini 2.5 Flash | Eingabe (Text, Bild, Video) | 0,30 $ | 0,30 $ | 0,03 $ | 0,03 $ |
Audioeingabe | 1,00 $ | 0,30 $ | 0,10 $ | 0,10 $ | |
Textausgabe (Antwort und Begründung) | 2,50 $ | 2,50 $ | – | – | |
Bild von Gemini 2.5 Flash | Eingabe (Text, Bild)*** | 0,30 $ | – | – | – |
Textausgabe (Antwort und Begründung) | 2,50 $ | – | – | – | |
Bildausgabe*** | 30,00 $ | – | – | – | |
Gemini 2.5 Flash Live API | Eingabetext | 0,50 $ | 0,50 $ | – | – |
Eingabe (Video, Bild) | 3,00 $ | 3,00 $ | – | – | |
Audioeingabe | 3,00 $ | 3,00 $ | – | – | |
Textausgabe | 2,00 $ | 2,00 $ | – | – | |
1 Mio. Ausgabetokens für Audio | 12,00 $ | $ 12,00 | – | – | |
Gemini 2.5 Flash Lite | Eingabe (Text, Bild, Video) | 0,10 $ | 0,10 $ | 0,01 $ | 0,01 $ |
Audioeingabe | 0,30 $ | 0,30 $ | 0,03 $ | 0,03 $ | |
Textausgabe (Antwort und Begründung) | 0,40 $ | 0,40 $ | – | – |
Preise mit Begründung
Funktion | Nutzung | Preis (in $) |
|---|---|---|
Fundierung mit der Google Suche | Gemini 2.0 Flash, 2.5 Flash und 2.5 Flash-Lite bieten insgesamt 1.500 Grounding-Prompts pro Tag ohne Aufpreis. Gemini 2.5 Pro umfasst 10.000 Grounding-Prompts pro Tag ohne Aufpreis. Grounding-Prompts, die diese Limits überschreiten, werden mit 35 $ pro 1.000 Grounding-Prompts berechnet. Wenn Sie mehr als 1 Million Grounding-Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein „Grounding-Prompt“ ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jede eine „Grounding-Abfrage“)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. | 0 count to 10,000 count 0,00 $ (Free) 10,000 count and above 35,00 $ |
Webfundierung für Unternehmen | 45 $ pro 1.000 Grounding-Prompts. Wenn Sie mehr als 1 Million Grounding-Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein „Grounding-Prompt“ ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jeweils eine „Grounding-Abfrage“)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. | 45,00 $ |
Fundierung mit Ihren Daten | 2,5 $ pro 1.000 Anfragen. | 2,50 $ |
Fundierung mit Google Maps | 25 $ pro 1.000 gegroundeten Prompts Ein verankerter Prompt ist eine an Gemini gesendete Anfrage, die mindestens eine Abfrage an Google Maps enthält. | 0 count to 1,500 count 0,00 $ (Free) 1,500 count and above 25,00 $ |
* Wenn der Kontext einer Abfrageeingabe länger als 200.000 Tokens ist, werden alle Tokens (Eingabe und Ausgabe) zu den Preisen für lange Kontexte berechnet.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
** Fundierung mit der Google Suche und Web Grounding for Enterprise werden nur dann abgerechnet, wenn ein Grounding-Prompt erfolgreich Quellen zurückgibt (d.h. Ergebnisse, die mindestens eine Support-URL aus dem Web enthalten). Die Gebühren für die Nutzung von Gemini-Modellen werden separat berechnet.
*** Ein Bild mit 1.024 x 1.024 Pixeln verbraucht 1.290 Tokens (0,039 $ pro 1.000 Tokens für Ausgabebilder). Die Anzahl der Tokens pro Bild variiert je nach Bildauflösung. Weitere Informationen zur Berechnung von Tokens finden Sie in unserer Dokumentation.
**** Die Abrechnung der Computernutzung verwendet die Gemini 2.5 Pro-SKU, um die Kosten für die Computernutzung aufzuschlüsseln und Abrechnungstags anzuwenden. Weitere Informationen
Gemini 2.0 wird auf der Grundlage von Tokens abgerechnet. Um die Anzahl der Eingabetokens in Ihrer Anfrage zu berechnen, bevor Sie die Anfrage senden, können Sie den SDK-Tokenizer oder die countTokens API verwenden. Wenn Ihre Anfrage mit einem 400- oder 500-Fehler fehlschlägt, werden Ihnen die verwendeten Tokens nicht in Rechnung gestellt.
Mit dem Schalter in der Preistabelle können Sie die tokenbasierten Preise mit den modalitätsbasierten Preisen vergleichen.
Modell | Typ | Preis /1 Mio. Tokens (USD) | Preis /1 Mio. Tokens (USD) mit Batch API |
|---|---|---|---|
Gemini 2.0 Flash | Eingabetext | 0,15 $ | 0,075 $ |
Eingabeaudio | 1,00 $ | 0,50 $ | |
Ausgabetext | 0,60 $ | 0,30 $ | |
Training zur Feinabstimmung | 0,003 $ | ||
Bildgenerierung mit Gemini 2.0 Flash | Eingabetokens | 0,15 $ | |
Eingabeaudiotokens | 1,00 $ | ||
Eingabevideotokens | 0,15 $ | ||
Ausgabetext-Tokens | 0,60 $ | ||
Ausgabebild-Tokens | 30,00 $ | ||
Gemini 2.0 Flash Live API | Eingabetext-Tokens | 0,50 $ | |
Eingabeaudiotokens | 3,00 $ | ||
Eingabe von Video-/Bild-Tokens | 3,00 $ | ||
Ausgabetext-Tokens | 2,00 $ | ||
Ausgabeaudiotokens | 12,00 $ | ||
Gemini 2.0 Flash Lite | Eingabetokens | 0,075 $ | 0,0375 $ |
Eingabeaudiotokens | 0,075 $ | 0,0375 $ | |
Ausgabetext-Tokens | 0,30 $ | 0,15 $ | |
Abstimmung für Trainingstoken | 0,001 $ |
* Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* Die Anzahl der Trainingstokens wird berechnet, indem die Gesamtzahl der Tokens in Ihrem Trainings-Dataset mit der Anzahl der Epochen multipliziert wird.
* PDFs werden als Bildeingabe abgerechnet, wobei eine PDF-Seite einem Bild entspricht.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
* Gemini 2.0 Flash Live API: 25 Tokens pro Sekunde Audio (Ein-/Ausgabe), 258 Tokens pro Sekunde Video (Eingabe). Die Fundierung mit der Google Suche bleibt kostenlos, solange sich die Gemini 2.0 Flash Live API in der Vorschauphase befindet.
Preis mit Erdung
Funktion | Nutzung | Preis (in $) |
|---|---|---|
Fundierung mit der Google Suche*, ** | Gemini 2.0 Flash, 2.5 Flash und 2.5 Flash-Lite bieten insgesamt 1.500 Grounding-Prompts pro Tag ohne Aufpreis. Gemini 2.5 Pro umfasst 10.000 Grounding-Prompts pro Tag ohne Aufpreis. Grounding-Prompts, die diese Limits überschreiten, werden mit 35 $ pro 1.000 Grounding-Prompts berechnet. Wenn Sie mehr als 1 Million Grounding-Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein „Grounding-Prompt“ ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jede eine „Grounding-Abfrage“)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. | 0 count to 10,000 count 0,00 $ (Free) 10,000 count and above 35,00 $ |
Webfundierung für Unternehmen*, ** | 45 $ pro 1.000 Grounding-Prompts. Wenn Sie mehr als 1 Million Grounding-Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein „Grounding-Prompt“ ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jeweils eine „Grounding-Abfrage“)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. | 45,00 $ |
Fundierung mit Ihren Daten* | 2,5 $ pro 1.000 Anfragen. | 2,50 $ |
Fundierung mit Google Maps* | Gemini-Modelle enthalten eine Reihe von täglich geerdeten Prompts ohne Aufpreis:
Prompts mit Verankerung, die diese Limits überschreiten, werden mit 25 $ pro 1.000 Prompts mit Verankerung berechnet. Ein verankerter Prompt ist eine an Gemini gesendete Anfrage, die mindestens eine Abfrage an Google Maps enthält. Wenden Sie sich an Ihr Account-Management-Team, wenn Sie mehr als 1 Million verankerter Prompts pro Tag benötigen. | 0 count to 1,500 count 0,00 $ (Free) 1,500 count and above 25,00 $ |
* Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* Die Anzahl der Trainingstokens wird berechnet, indem die Gesamtzahl der Tokens in Ihrem Trainings-Dataset mit der Anzahl der Epochen multipliziert wird.
* PDFs werden als Bildeingabe abgerechnet, wobei eine PDF-Seite einem Bild entspricht.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
* Gemini 2.0 Flash Live API: 25 Tokens pro Sekunde Audio (Ein-/Ausgabe), 258 Tokens pro Sekunde Video (Eingabe). Die Fundierung mit der Google Suche bleibt kostenlos, solange sich die Gemini 2.0 Flash Live API in der Vorschauphase befindet.
** Die Fundierung mit der Google Suche und die Web-Fundierung für Unternehmen werden nur dann in Rechnung gestellt, wenn ein Prompt erfolgreich Quellen zurückgibt (d.h. Ergebnisse, die mindestens eine Support-URL aus dem Web enthalten). Die Gebühren für die Nutzung von Gemini-Modellen werden separat berechnet.
Alle Gemini-Modelle außer Gemini 2.0 oder Gemini 2.5 werden nach Modalitäten wie Zeichen, Bilder, Video-/Audiosekunden abgerechnet.
Gemini 1.5
Modell | Funktion | Typ | Preis ( =< 128.000 Eingabetokens) | Preis ( > 128.000 Eingabetokens) |
|---|---|---|---|---|
Gemini 1.5 Flash | Multimodal | Bildeingabe | 0,00002 $ / 1 count | 0,00004 $ / 1 count |
Videoeingabe | 0,00002 $ / 1 count | 0,00004 $ / 1 count | ||
Texteingabe | 0,00001875 $ / 1,000 count | 0,0000375 $ / 1,000 count | ||
Audioeingabe | 0,000002 $ / 1 count | 0,000004 $ / 1 count | ||
Textausgabe | 0,000075 $ / 1,000 count | 0,00015 $ / 1,000 count | ||
Abstimmung* | Trainingstoken | 0,008 $ / 1,000 count | ||
Gemini 1.5 Pro, | Multimodal | Bildeingabe | 0,00032875 $ / 1 count | 0,0006575 $ / 1 count |
Videoeingabe | 0,00032875 $ / 1 count | 0,0006575 $ / 1 count | ||
Texteingabe | 0,0003125 $ / 1,000 count | 0,000625 $ / 1,000 count | ||
Audioeingabe | 0,00003125 $ / 1 count | 0,0000625 $ / 1 count | ||
Textausgabe | 0,00125 $ / 1,000 count | 0,0025 $ / 1,000 count | ||
Abstimmung* | Trainingstoken | 0,08 $ / 1,000 count | ||
Gemini 1.0 Pro | Multimodal | Bildeingabe | 0,0025 $ / 1 count | |
Videoeingabe | 0,002 $ / 1 count | |||
Texteingabe | 0,000125 $ / 1,000 count | |||
Textausgabe | 0,000375 $ / 1,000 count |
* Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* Wenn ein Abfragekontext länger als 128.000 Tokens ist, werden alle Tokens zu den Preisen für lange Kontexte abgerechnet.
* Gemini-Modelle sind im Batchmodus mit einem Rabatt von 50% verfügbar.
* Gemini 1.0 Pro unterstützt nur ein Kontextfenster von bis zu 32.000 Tokens.
* PDFs werden als Bildeingabe abgerechnet, wobei eine PDF-Seite einem Bild entspricht.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
** Die Fundierung mit der Google Suche und die Web-Fundierung für Unternehmen werden nur abgerechnet, wenn ein Prompt erfolgreich Quellen zurückgibt (d.h. Webergebnisse, die mindestens eine Support-URL aus dem Web enthalten). Die Gebühren für die Nutzung von Gemini-Modellen werden separat berechnet.
Preise mit Grounding
Funktion | Preis (in $) |
|---|---|
Fundierung mit der Google Suche | 35 $ pro 1.000 Grounding-Prompts. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an den Google-Webindex sendet (jede eine Grounding-Abfrage)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. |
Webfundierung für Unternehmen | 45 $ pro 1.000 Grounding-Prompts. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an den Google-Webindex sendet (jede eine Grounding-Abfrage)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. |
Fundierung mit Ihren Daten | 2,5 $ pro 1.000 Anfragen ab dem 16. Juni 2025. |
** Die Fundierung mit der Google Suche und die Web-Fundierung für Unternehmen werden nur abgerechnet, wenn ein Prompt erfolgreich Quellen zurückgibt (d.h. Webergebnisse, die mindestens eine Support-URL aus dem Web enthalten). Die Gebühren für die Nutzung von Gemini-Modellen werden separat berechnet.
Imagen
Mit Imagen auf der Agent Platform können Sie neue Bilder generieren und Bilder basierend auf den von Ihnen bereitgestellten Text-Prompts bearbeiten oder nur Teile von Bildern mit einem Maskenbereich, den Sie zusammen mit einer Reihe anderer Funktionen definieren, bearbeiten.
Modell | Funktion | Beschreibung | Eingabe | Ausgabe | Preis / 1 Einheit (USD) |
|---|---|---|---|---|---|
Imagen 4 Ultra | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,06 $ |
Imagen 4 | Auflösung wird erhöht | Auflösung eines generierten Bildes auf 2.000, 3.000 und 4.000 erhöhen | Bild | Bild | 0,06 $ |
Imagen 4 | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,04 $ |
Imagen 4 Fast | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,02 $ |
Imagen 3 | Bildgenerierung | Image generieren Bild bearbeiten Bild anpassen | Text-Prompt | Bild | 0,04 $ |
Imagen 3 Fast | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,02 $ |
Imagen 2, Imagen 1 | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,02 $ |
Imagen 2, Imagen 1 | Bildbearbeitung | Bild mit maskenfreiem Ansatz oder Maskenansatz bearbeiten | Bild-/Text-Prompt | Bild | 0,02 $ |
Imagen 1 | Auflösung wird erhöht | Auflösung eines generierten Bildes auf 2.000 und 4.000 erhöhen | Bild | Bild | 0,003 $ |
Imagen 1 | Abstimmung | Aktivieren Sie einen "Betreff", der vom Nutzer für die Verwendung von Imagen-Prompts bereitgestellt wurde (weniger Aufnahmetraining). | Betreff mit Textkennung und 4–8 Bildern pro Betreff | Feinabstimmung des Modells (nach dem Training mit vom Nutzer bereitgestellten Betreff) | $ pro Knotenstunde Preise für benutzerdefiniertes Training auf der Agent Platform |
Imagen | Visuelle Untertitel | Kurze oder lange Textuntertitel für ein Bild generieren | Bild | Textunterschrift | 0,0015 $ |
Imagen | Visual Question Answering | Eine Antwort basierend auf einer Frage bereitstellen, die auf ein Bild verweist | Bild-/Text-Prompt | Textantwort | 0,0015 $ |
Imagen | Produkt-Recontext | Produkte in einer neuen Szene neu in Szene setzen | 1–3 Bilder desselben Produkts und ein Text-Prompt, der die gewünschte Szene beschreibt | Bild | 0,12 $ |
Virtueller Test | Bilder von Personen in unterschiedlicher Kleidung erstellen | 1 Bild einer Person und 1 Bild von Kleidung | Bild | 0,06 $ |
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Veo
Modell | Funktion | Beschreibung | Eingabe | Ausgabe | Maximale Auflösung | Preis (in $) |
|---|---|---|---|---|---|---|
Veo 3.1 | Video- und Audiogenerierung | Hochwertige Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video und Audio | 720p, 1080p | 0,40 $ / 1 count |
4K | 0,60 $ / 1 count | |||||
Videogenerierung | Hochwertige Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p, 1080p | 0,20 $ / 1 count | |
4K | 0,40 $ / 1 count | |||||
Veo 3.1 Fast | Video- und Audiogenerierung | Schneller Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video und Audio | 720p | 0,10 $ / 1 count |
1080p | 0,12 $ / 1 count | |||||
4K | 0,30 $ / 1 count | |||||
Videogenerierung | Schneller Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p | 0,08 $ / 1 count | |
1080p | 0,10 $ / 1 count | |||||
4K | 0,25 $ / 1 count | |||||
Veo 3.1 Lite | Video- und Audiogenerierung | Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild am schnellsten generieren | Text-/Bild-Prompt | Video und Audio | 720p | 0,05 $ / 1 Zählung |
1080p | 0,08 $ / 1 Zählung | |||||
Videogenerierung | Videos aus einem Text-Prompt oder Referenzbild am schnellsten generieren | Text-/Bild-Prompt | Video | 720p | 0,03 $ / 1 Zählung | |
1080p | 0,05 $ / 1 Zählung | |||||
Veo 3 | Video- und Audiogenerierung | Hochwertige Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video und Audio | 720p, 1080p | 0,40 $ / 1 count |
Videogenerierung | Hochwertige Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p, 1080p | 0,20 $ / 1 count | |
Veo 3 Fast | Video- und Audiogenerierung | Schneller Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video und Audio | 720p | 0,10 $ / 1 count |
1080p | 0,12 $ / 1 count | |||||
Videogenerierung | Schneller Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p | 0,08 $ / 1 count | |
1080p | 0,10 $ / 1 count | |||||
Veo 2 | Videogenerierung | Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p | 0,50 $ / 1 count |
Erweiterte Funktionen | Videos durch Interpolation von Anfangs- und End-Frames generieren, generierte Videos verlängern und Kamerasteuerung anwenden | Text-/Bild-/Video-Prompt | Video | 720p | 0,50 $ / 1 count |
Lyria
Die Lyria-Modellfamilie bietet eine hochwertige Musikgenerierung, die sich ideal für anspruchsvolle Kompositionen und detaillierte kreative Erkundungen eignet, bei denen es auf nuancierte Ausgaben ankommt.
Modell | Funktion | Beschreibung | Eingabe | Ausgabe | Preis (in $) |
|---|---|---|---|---|---|
Lyria 3 Pro | Generierung von Songs in voller Länge | Lyria 3 Pro erstellt vollständige musikalische Kompositionen aus multimodalen Eingaben wie Text oder Bildern. | Text, Bild | Vollständiger Song | 0,08 $ / 1 count |
Lyria 3 | Generierung von 30 Sekunden langen Musik-Clips | Lyria 3 generiert aus Text- oder Bild-Prompts 30‑sekündige Audioclips in hoher Qualität. | Text, Bild | 30 Sekunden langer Musik-Clip | 0,04 $ / 1 count |
Lyria 2 | Musikgenerierung | Musik aus einem Text-Prompt generieren | Text-Prompt | Musik | 0,06 $ / 1 count |
Kosten für Einbettung
Die Gemini API bietet Einbettungsmodelle zum Generieren von Einbettungen für Text, Bilder, Videos und andere Inhalte.
Modell | Typ | Region | Anfragetyp | Preis pro 1.000 Einheiten (in $) |
|---|---|---|---|---|
Gemini Embedding | Eingabe | Global | Onlineanfragen | 0,00015 $ |
Batchanfragen | 0,00012 $ | |||
Ausgabe | Global | Onlineanfragen | Kostenlos | |
Batchanfragen | Kostenlos | |||
Einbettungen für Text (ohne Gemini-Einbettung) | Eingabe | Global | Onlineanfragen | 0,000025 $ |
Batchanfragen | 0,00002 $ | |||
Ausgabe | Global | Onlineanfragen | Kostenlos | |
Batchanfragen | Kostenlos |
Gemini Omni
Modell | Typ | Tokenpreis /1M (USD) |
|---|---|---|
Gemini Omni Flash | Eingabe (Text, Bild, Video, Audio) | 1,50 $ |
Textausgabe (Antwort und Begründung) | 9,00 $ | |
Videoausgabe* | 17,50 $ |
* Gemini Omni Flash berechnet 2.040 Tokens pro Bild, 32 Tokens pro Sekunde Audio und 5.792 Tokens pro Sekunde Video für die Eingabe. Für die Videoausgabe berechnet Gemini Omni Flash 5.792 Tokens pro Sekunde Videoausgabe in 720p (mit Audio).
Agents
Modell | Typ | Preis (/1 Mio. Tokens) | Preis (/Mio. Eingabetokens im Cache) |
|---|---|---|---|
Gemini Deep Research-Agent | Eingabe (Text) | 2 $ | 0,2 $ |
Textausgabe (Antwort und Begründung) | 12 $ | – |
Preise mit Begründung
Funktion | Nutzung | Preis (in $) |
|---|---|---|
Fundierung mit der Google Websuche und Bildersuche sowie Webfundierung für Unternehmen* | Enthält 5.000 Suchanfragen pro Monat ohne Aufpreis, zusammengefasst über alle Gemini 3-Modelle. Suchanfragen, die diese Limits überschreiten, werden mit 14 $ pro 1.000 Suchanfragen berechnet. Eine von einem Kundenunternehmen an Gemini gesendete Anfrage kann zu einer oder mehreren Abfragen an die Google Suche (oder Web Grounding for Enterprise) führen. Ihnen wird jede einzelne Suchanfrage in Rechnung gestellt. Die Abrechnung beginnt am 5. Januar 2026. Für Eingabetokens, die durch die Fundierung mit der Google Suche oder die Web-Fundierung für Unternehmen bereitgestellt werden, fallen keine Kosten an. Wenden Sie sich an Ihr Account-Management-Team, wenn Sie mehr als 1 Million verankerter Prompts pro Tag benötigen. Kundenunternehmen können sich entscheiden, Suchvorschläge mit fundierten Ergebnissen in der Schnittstelle ihrer Kundenanwendung zum Standardpreis nicht anzuzeigen. | 0 count to 5,000 count 0,00 $ (Free) 5,000 count and above 14,00 $ |
Fundierung mit Ihren Daten | 2,50 $ |
CodeMender
Die Preise für CodeMender basieren auf Tokens und hängen vom verwendeten Modell ab.
Modell | Typ | Modellpreis /1 Mio. Tokens (USD) | CodeMender-Preis /1 Mio. Tokens (USD) |
|---|---|---|---|
Gemini 3.5 Flash | Eingabetokens | 1,50 $ | 1,50 $ |
Im Cache gespeicherte Tokens | 0,15 $ | 0,15 $ | |
Ausgabetokens | 9,00 $ | 9,00 $ | |
Gemini 3.1. Pro | Eingabetokens | 2,00 $ | 2,00 $ |
Im Cache gespeicherte Tokens | 0,20 $ | 0,20 $ | |
Ausgabetokens | 12,00 $ | 12,00 $ | |
Gemini 3 Flash | Eingabetokens | 0,50 $ | 0,50 $ |
Im Cache gespeicherte Tokens | 0,05 $ | 0,05 $ | |
Ausgabetokens | 3,00 $ | 3,00 $ |
Gemma
Modell | Typ | Preis pro 1 Mio. Tokens (USD) |
|---|---|---|
Gemma 4 26B | Eingabe | 0,15 $ |
Ausgabe | 0,60 $ | |
Cache-Treffer | 0,015 $ |
Der Model Optimizer der Agent Platform vereinfacht die Nutzung von Gemini für Unternehmenskunden, indem er einen einzelnen Meta-Endpunkt für Gemini-Modellanfragen bereitstellt. Kunden, die diesen Dienst nutzen, müssen nicht angeben, ob sie Flash, Pro oder eine bestimmte Version verwenden möchten. Stattdessen geben sie einfach eine konfigurierbare Einstellung (Kosten, Qualität oder Gleichgewicht) an, um ihre Präferenzen anzugeben. Der Modelloptimierer wendet dann die richtige Intelligenzstufe an, die für die Aufgabe geeignet ist, indem er jede Abfrage an das am besten geeignete Modell sendet.
Der Modelloptimierer der Agent Platform wendet dynamische Preisgestaltung an. Das bedeutet, dass der durchschnittliche Preis pro Token vom Intelligenzgrad des Modells abhängt, das zur Erledigung der Aufgabe verwendet wird. Daher werden unten Preisbeispiele aufgeführt, um wahrscheinliche Szenarien basierend auf Ihrer Konfigurationseinstellung zu veranschaulichen (siehe Tabellen unten). Model Optimizer-SKUs sind 1-Dollar-SKUs, die als Einkaufseinheit für die Abrechnung dienen. Die Abrechnung erfolgt jedoch weiterhin nutzungsbasiert, nachdem Sie die Modelle verwendet haben.
Beispiel 1: Chatbot, I/O-Verhältnis 5:1
HINWEIS: Diese Werte sind nicht garantiert, die Ergebnisse können je nach Kunde variieren.
Kundenpräferenz | An Marketingziel gesendete Eingabetokens | An MO gesendete Ausgabetokens von Kundenunternehmen | Durchschnittlicher Eingabepreis pro Million Tokens (hoher Bereich) | Durchschnittlicher Ausgabepreis pro Million Tokens (hoher Bereich) | Durchschnittlicher Eingabepreis pro Million Tokens (niedriger Bereich) | Durchschnittlicher Ausgabepreis pro Million Tokens (niedriger Bereich) |
|---|---|---|---|---|---|---|
Kosten | 10.000.000 | 2.000.000 | 0,63 $ | 2,50 $ | 0,16 $ | 0,63 $ |
Ausgeglichen | 10.000.000 | 2.000.000 | 1,26 $ | 5,00 $ | 0,63 $ | 2,50 $ |
Qualität | 10.000.000 | 2.000.000 | 1,89 $ | 7,50 $ | 1,26 $ | 5,00 $ |
Beispiel 2: Inhaltserstellung, I/O-Verhältnis 1:20
Kundenpräferenz | An Marketingziel gesendete Eingabetokens | An MO gesendete Ausgabetokens von Kundenunternehmen | Durchschnittlicher Eingabepreis pro Million Tokens (hoher Bereich) | Durchschnittlicher Ausgabepreis pro Million Tokens (hoher Bereich) | Durchschnittlicher Eingabepreis pro Million Tokens (niedriger Bereich) | Durchschnittlicher Ausgabepreis pro Million Tokens (niedriger Bereich) |
|---|---|---|---|---|---|---|
Kosten | 1.000.000 | 20.000.000 | 0,63 $ | 2,50 $ | 0,16 $ | 0,63 $ |
Ausgeglichen | 1.000.000 | 20.000.000 | 1,26 $ | 5,00 $ | 0,63 $ | 2,50 $ |
Qualität | 1.000.000 | 20.000.000 | 1,89 $ | 7,50 $ | 1,26 $ | 5,00 $ |
* Model Optimizer ist ein kostenpflichtiges experimentelles Angebot und kann Anfragen an experimentelle Versionen von Gemini auf der Agent Platform weiterleiten.
Multimodale Einbettungen
Modell | Typ | Beschreibung | Anfragetyp | Preis /1 Mio. Tokens (USD) |
|---|---|---|---|---|
Gemini Embedding 2 (Unified Multimodal, Vorabversion) | Eingabetext | Einbettungen mit Text als Eingabe generieren | Onlineanfragen | 0,20 $ |
Batchanfragen | 0,10 $ | |||
Eingabebild | Einbettungen mit Bild als Eingabe generieren | Onlineanfragen | 0,45 $ | |
Batchanfragen | 0,225 $ | |||
Eingabevideo | Einbettungen mit Video als Eingabe generieren | Onlineanfragen | 12,00 $ | |
Batchanfragen | 6,00 $ | |||
Eingabeaudio | Einbettungen mit Audio als Eingabe generieren | Onlineanfragen | 6,50 $ | |
Batchanfragen | 3,25 $ |
*Für Ausgabetokens werden keine Gebühren erhoben.
Modell | Funktion | Beschreibung | Eingabe | Ausgabe | Preis (in $) |
|---|---|---|---|---|---|
multimodalembedding | Einbettungen für multimodale Attribute: Text | Einbettungen mit Text als Eingabe generieren | Text | Einbettungen | 0,0002 $ / 1,000 count |
Einbettungen für multimodale Ausdrücke: Bild | Einbettungen mit Bild als Eingabe generieren | Bild | Einbettungen | 0,0001 $ / 1 count | |
Einbettungen für multimodal: Video Plus | Video Plus | Video | Einbettungen (bis zu 15 Einbettungen pro Minute Video) | 0,002 $ / 1 count | |
Einbettungen für multimodal: Video Standard | Video – Standard | Video | Einbettungen (bis zu 8 Einbettungen pro Minute Video) | 0,001 $ / 1 count | |
Einbettungen für multimodale Ausdrücke: Video – Grundlagen | Video Essentials | Video | Einbettungen (bis zu 4 Einbettungen pro Minute Video) | 0,0005 $ / 1 count |
Open-Source-Modell | Typ | Anfragetyp | Preis /1 Mio. Tokens (USD) |
|---|---|---|---|
multilingual-e5-small | Eingabe | Onlineanfragen | 0,015 $ |
Ausgabe | Onlineanfragen | Kostenlos | |
Batcheingabe | Batchanfragen | 0,0075 $ | |
Batchausgabe | Batchanfragen | Kostenlos | |
multilingual-e5-large | Eingabe | Onlineanfragen | 0,025 $ |
Ausgabe | Onlineanfragen | Kostenlos | |
Batcheingabe | Batchanfragen | 0,0125 $ | |
Batchausgabe | Batchanfragen | Kostenlos |
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Die generative KI in der Agent Platform wird nach 1.000 Zeichen Eingabe (Prompt) und 1.000 Zeichen Ausgabe (Antwort) abgerechnet. Alle Zeichen werden durch UTF-8-Codepunkte gezählt. Leerzeichen werden nicht berücksichtigt. Während der Vorschauphase werden Gebühren zu 100% reduziert. Vorhersageanfragen, die zu gefilterten Antworten führen, werden nur für die Eingabe abgerechnet. Am Ende jedes Abrechnungszeitraums werden Brüche von einem Cent (0,01 $) auf einen Cent aufgerundet.
Hinweis: Die Preise für Vorhersagen für fein abgestimmte Modellendpunkte sind dieselben wie für das Basis-Foundation Model.
Modell | Typ | Region | Anfragetyp | Preis /1.000 Tokens (USD) |
|---|---|---|---|---|
Codey für Codevervollständigung | Eingabe | Global | Onlineanfragen | 0,00025 $ |
Ausgabe | Global | Onlineanfragen | 0,0005 $ |
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Übersetzen (Text)
Verwenden Sie die Agent Platform API und das Translation LLM, um Text zu übersetzen. LLM-Übersetzungen klingen flüssiger und natürlicher als Übersetzungen mit klassischen Modellen, unterstützen aber weniger Sprachen (Weitere Informationen).
Modell | Methode | Nutzung | Preis Preis /1 Mio. Token (USD) |
|---|---|---|---|
LLM | Anzahl der Eingabezeichen pro Monat | 10,00 $ | |
Anzahl der Ausgabetokens pro Monat | 10,00 $ | ||
Translation LLM 002 | Anzahl der Eingabezeichen pro Monat | 20,00 $ | |
Anzahl der Ausgabetokens pro Monat | 20,00 $ |
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* Preis pro Zeichen, das vom Modell verarbeitet wird. Weitere Informationen zu gezählten Zeichen finden Sie unter Gebührenpflichtige Zeichen.
Preis für Context Cache Storage für explizites Caching
Diese Tabelle enthält die Preise für den Kontext-Cache-Speicher basierend auf der Eingabe (Text, Bild, Video, Audio).
Modell | Preis Tok/Std. <= 200.000 Eingabetokens | Preis pro Token/Stunde > 200.000 Eingabetokens |
|---|---|---|
Gemini 3.1. Pro | 0,0000045 $ | 0,0000045 $ |
Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3 Flash | 0,000001 $ | 0,000001 $ |
Gemini 3.5 Flash Lite, Gemini 3.1 Flash Lite | 0,000001 $ | 0,000001 $ |
Gemini 3 Pro | 0,0000045 $ | 0,0000045 $ |
Gemini 2.5 Pro | 0,0000045 $ | 0,0000045 $ |
Gemini 2.5 Flash | 0,000001 $ | 0,000001 $ |
Gemini 2.5 Flash Lite | 0,000001 $ / 1 Stunde | 0,000001 $ |
Gemini 2.0-Modelle
Modell | Typ | Speicher (M Token-Stunden) | Preis /1 (in $) |
|---|---|---|---|
Gemini 2.0 Flash | Eingabetokens | 0,000001 $ | 0,0375 $ |
Eingabeaudiotokens | 0,000001 $ | 0,25 $ | |
Ausgabetext-Tokens | – | – | |
Gemini 2.0 Flash Lite | Eingabetokens | 0,000001 $ | 0,01875 $ |
Eingabeaudiotokens | 0,000001 $ | 0,01875 $ | |
Ausgabetext-Tokens | – | – |
* Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* PDFs werden als Bildeingabe abgerechnet, wobei eine PDF-Seite einem Bild entspricht.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
Preise mit Begründung
Funktion | Preis (in $) |
|---|---|
Fundierung mit der Google Suche* | Gemini 2.0 Flash umfasst bis zu 1.500 Anfragen pro Tag ohne zusätzliche Kosten. Für Anfragen mit Grounding,die über 1.500 pro Tag hinausgehen,werden 35 $ pro 1.000 Anfragen berechnet (bis zu 1 Million Anfragen pro Tag). Wenden Sie sich an Ihr Account-Management-Team, wenn Sie mehr als 1 Million Anfragen pro Tag benötigen. Kundenunternehmen können sich entscheiden, Suchvorschläge mit fundierten Ergebnissen in der Schnittstelle ihrer Kundenanwendung nicht anzuzeigen. Dies unterliegt jedoch einer alternativen Preisgestaltung. Wenden Sie sich an Ihr Google Cloud-Account-Management-Team, um diese Ausnahme zu beantragen. |
Webfundierung für Unternehmen* | 45 $ pro 1.000 Anfragen (bis zu 1 Million Anfragen pro Tag) ab dem 5. Mai 2025. Wenden Sie sich an Ihr Account-Management-Team, wenn Sie mehr als 1 Million Anfragen pro Tag benötigen. Kundenunternehmen können sich entscheiden, Suchvorschläge mit fundierten Ergebnissen in der Schnittstelle ihrer Kundenanwendung nicht anzuzeigen. Dies unterliegt jedoch einer alternativen Preisgestaltung. Wenden Sie sich an Ihr Google Cloud-Account-Management-Team, um diese Ausnahme zu beantragen. |
* Dies gilt für modalitätsbasierte Preise.
Hinweis: Die Verankerung mit der Google Suche wird nur für Anfragen abgerechnet, die Ergebnisse mit mindestens einer URL zur Verankerungsunterstützung aus dem Web zurückgeben. Es fallen außerdem die Standardgebühren für die Nutzung von Gemini-Modellen an.
Bereitgestellter Durchsatz sichert den Durchsatz für Ihre Anforderungen an generative KI und wird über Skalierungseinheiten der generativen KI (GSUs) abgerechnet. Hier erfahren Sie mehr über den Durchsatz der einzelnen GSUs. Mit unserem Online-Schätzer hier können Sie den Durchsatz für Ihre Anforderungen berechnen.
Dauer | Globaler Preis pro GSU-Stunde (in USD) | Preis pro GSU-Stunde (in USD) für Nicht-Global-Regionen* |
|---|---|---|
1 Woche | 7,14 $ | 7,854 $ |
Mindestlaufzeit 1 Monat | 3,698630137 $ | 4,068493151 $ |
3 Monate | 3,287671233 $ | 3,616438356 $ |
Zusicherung für 1 Jahr | 2,739726027 $ | 3,01369863 $ |
* Für andere Endpunkte als den globalen Endpunkt treten die Preise für die allgemein verfügbaren Gemini 3-Modellfamilien und neuere Familien am 1. Juli 2026 in Kraft. Vor dem 1. Juli 2026 gelten die Preise für den globalen Endpunkt auch für andere Endpunkte.
Beispiel für die Kostenberechnung
Ein Nutzer muss sicherstellen,dass er 10 Abfragen pro Sekunde (QPS) einer Abfrage mit einer Eingabe von 1.000 Text-Tokens und 500 Audio-Tokens unterstützen und eine Ausgabe von 300 Text-Tokens mit gemini-2.0-flash erhalten kann.
Anhand der Tabelle für Durchsatz und Verbrauchsrate wissen wir, dass die Verbrauchsrate für ein Eingabetext-Token bei gemini-2.0-flash 1 Token, für ein Eingabe-Audio-Token 7 Tokens und für ein Ausgabetext-Token 4 Tokens beträgt.
Die Gesamtzahl der Eingabetokens des Nutzers beträgt 1.000* (1 Token pro Eingabetexttoken) + 500* (7 Tokens pro Eingabeaudiotoken) = 4.500 bereinigte Eingabetokens. Die Gesamtzahl der Ausgabetokens des Nutzers beträgt 300* (4 Tokens pro Ausgabetext-Token) = 1.200 bereinigte Ausgabetokens. Das ergibt 4.500 Eingabetokens + 1.200 Ausgabetokens = 5.700 Tokens pro Abfrage.
Wenn wir die Gesamtzahl der Tokens pro Abfrage mit der QPS multiplizieren, erhalten wir 5.700 Tokens pro Abfrage × 10 QPS = 57.000 Tokens pro Sekunde.
Wenn wir dies durch den Gesamtdurchsatz pro Sekunde und GSU teilen,erhalten wir 57.000 Gesamt-Tokens pro Sekunde ÷ 3.360 Durchsatz pro Sekunde und GSU = 16,96 GSUs. Die Mindestkaufsteigerung für dieses Modell beträgt 1, sodass der Nutzer 17 GSUs benötigt.
Wenn der Nutzer diesen Durchsatz eine Woche lang aufrechterhalten möchte, kostet ihn das 1.200 $ * 17 GSUs = 20.400 $ pro Woche. Wenn sie diesen Durchsatz einen Monat lang aufrechterhalten wollten, würde das 2.700 $ * 17 GSUs = 45.900 $ pro Monat kosten. Wenn sie diesen Durchsatz drei Monate lang aufrechterhalten wollten, würde das 2.400 $ × 17 GSUs = 40.800 $ pro Monat kosten. Und wenn sie diesen Durchsatz ein Jahr lang aufrechterhalten wollten, würde das 2.000 $ × 17 GSUs = 34.000 $ pro Monat kosten.
Modellabstimmung
Die Modellabstimmung ist eine effektive Methode, um große Modelle an Ihre Aufgaben anzupassen. Dies ist ein wichtiger Schritt, um die Qualität und Effizienz des Modells zu verbessern. Die Modellabstimmung bietet folgende Vorteile:
Die Abstimmung wird pro Million Trainingstokens berechnet. Die Anzahl der Trainingstokens wird berechnet, indem die Gesamtzahl der Tokens in Ihrem Trainings-Dataset mit der Anzahl der Epochen multipliziert wird. Ab Gemini 3 kostet die Vorhersage über einen Endpunkt für ein abgestimmtes Modell das 1, 5-Fache des Basismodells. Bei älteren Gemini-Modellen (Gemini 2.5 und älter) bleibt der Preis für Vorhersagen derselbe wie beim Basismodell.
Modell | Typ | Preis (in $) |
|---|---|---|
Gemini 3.5 Flash | Überwachte Feinabstimmung Abstimmung für Reinforcement Learning | 0,01 $ |
Gemini 3.1 Flash Lite | Überwachte Feinabstimmung | 0,003 $ |
Gemini 2.5 Pro | Überwachte Feinabstimmung | 0,025 $ |
Gemini 2.5 Flash | Überwachte Feinabstimmung Präferenzabstimmung | 0,005 $ |
Gemini 2.5 Flash Lite | Überwachte Feinabstimmung Präferenzabstimmung | 0,0015 $ |
Gemma 3 1B IT | Überwachte Feinabstimmung | 0,47 $ |
Gemma 3 4B IT | Überwachte Feinabstimmung | 1,14 $ |
Gemma 3 12B IT | Überwachte Feinabstimmung | 1,82 $ |
Gemma 3 27B IT | Überwachte Feinabstimmung | 6,83 $ |
Medgemma 1.5 4B IT | Überwachte Feinabstimmung | 1,14 $ |
Llama 3.1 8B | Überwachte Feinabstimmung | 0,67 $ |
Llama 3.2 1B | Überwachte Feinabstimmung | 0,28 $ |
Llama 3.2 3B | Überwachte Feinabstimmung | 0,61 $ |
Llama 3.3 70B | Überwachte Feinabstimmung | 6,72 $ |
Llama 4 Scout 17B 16E | Überwachte Feinabstimmung | 5,77 $ |
Qwen 3 4B | Überwachte Feinabstimmung | 1,35 $ |
Qwen 3 8B | Überwachte Feinabstimmung | 4,18 $ |
Qwen 3 14B | Überwachte Feinabstimmung | 8,46 $ |
Qwen 3 32B | Überwachte Feinabstimmung | 6,57 $ |
* Die Anzahl der Trainingstokens wird berechnet, indem die Gesamtzahl der Tokens in Ihrem Trainings-Dataset mit der Anzahl der Epochen multipliziert wird.
* Für Modellinferenzen ab Gemini 3 ist der Preis für Vorhersagen über Endpunkte für abgestimmte Modelle 1, 5-mal so hoch wie für das Basismodell. Der Preis für Vorhersagen mit alten Gemini-Modellen bleibt derselbe wie für das Basismodell.
Sonderfall: Abrechnung nach Zeichen
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Translation LLM 002 | Überwachte Feinabstimmung | 6,25 $ |
AlphaEvolve
Die Kosten für AlphaEvolve setzen sich aus den Kosten für das verwendete Gemini-Modell und den Kosten für den AlphaEvolve-Agenten zusammen.
Gemini-Modell | Typ | Preis für Gemini-Modell /1M (USD) | Preis für AlphaEvolve-Agent /1M (USD) | Gesamtpreis /1 Mio. (USD) |
|---|---|---|---|---|
Gemini 3.1 Pro (Vorabversion) | Preis pro 1 Mio. Eingabetokens | 2,00 $ | 4,00 $ | 6,00 $ |
Preis pro 1 Mio. Ausgabetokens und Denktokens | 12,00 $ | 24,00 $ | 36,00 $ | |
Gemini 3.5 Flash | Preis pro 1 Mio. Eingabetokens | 1,50 $ | 3,00 $ | 4,50 $ |
Preis pro 1 Mio. Ausgabetokens und Denktokens | 9,00 $ | 18,00 $ | 27,00 $ |
Partnermodelle sind eine ausgewählte Liste generativer KI-Modelle, die von Google-Partnern entwickelt wurden. Partnermodelle werden als verwaltete APIs angeboten. Weitere Informationen finden Sie unter Übersicht über Partnermodelle. In den folgenden Abschnitten finden Sie Preisinformationen zu Google-Partnermodellen.
Modelle mit regionalen Preisen
Modell | Typ | ModellPreis (/1M Tokens) =< 200K Eingabetokens | Preis (/1M Tokens) > 200K Eingabetokens |
|---|---|---|---|
Opus 5 | Eingabe | 5,00 $ | 5,00 $ |
Ausgabe | 25,00 $ | 25,00 $ | |
Batcheingabe | 2,50 $ | ||
Batchausgabe | 12,50 € | ||
5 Min. Cache schreiben | 6,25 $ | 6,25 $ | |
1 Std. Cache schreiben | 10,00 $ | 10,00 $ | |
Cache-Treffer | 0,50 $ | 0,50 $ | |
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||
1 Stunde Batch-Cache-Schreibvorgang | 5,00 $ | ||
Batch Cache Hit | 0,25 $ | ||
Claude Sonnet 5 (Aktionspreis bis zum 31. August 2026) | Eingabe | 2,00 $ | 2,00 $ |
Ausgabe | 10,00 $ | 10,00 $ | |
Batcheingabe | 1,00 $ | 1,00 $ | |
Batchausgabe | 5,00 $ | 5,00 $ | |
5 Min. Cache schreiben | 2,50 $ | 2,50 $ | |
1 Std. Cache schreiben | 4,00 $ | 4,00 $ | |
Cache-Treffer | 0,20 $ | 0,20 $ | |
Claude Sonnet 5 (Standardpreis ab 1. September 2026) | Eingabe | 3,00 $ | 3,00 $ |
Ausgabe | 15,00 $ | 15,00 $ | |
Batcheingabe | 1,50 $ | 1,50 $ | |
Batchausgabe | 7,50 $ | 7,50 $ | |
5 Min. Cache schreiben | 3,75 $ | 3,75 $ | |
1 Std. Cache schreiben | 6,00 $ | 6,00 $ | |
Cache-Treffer | 0,30 $ | 0,30 $ | |
Claude Fable 5 | Eingabe | 10,00 $ | 10,00 $ |
Ausgabe | 50,00 $ | 50,00 $ | |
Batcheingabe | 5,00 $ | ||
Batchausgabe | 25,00 $ | ||
5 Min. Cache schreiben | 12,50 € | 12,50 € | |
1 Std. Cache schreiben | 20,00 $ | 20,00 $ | |
Cache-Treffer | 1,00 $ | 1,00 $ | |
5 Min. Batch-Cache-Schreibvorgang | 6,25 $ | ||
1 Stunde Batch-Cache-Schreibvorgang | 10,00 $ | ||
Batch Cache Hit | 0,50 $ | ||
Claude Opus 4.8 | Eingabe | 5,00 $ | 5,00 $ |
Ausgabe | 25,00 $ | 25,00 $ | |
Batcheingabe | 2,50 $ | ||
Batchausgabe | 12,50 € | ||
5 Min. Cache schreiben | 6,25 $ | 6,25 $ | |
1 Std. Cache schreiben | 10,00 $ | 10,00 $ | |
Cache-Treffer | 0,50 $ | 0,50 $ | |
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||
1 Stunde Batch-Cache-Schreibvorgang | 5,00 $ | ||
Batch Cache Hit | 0,25 $ | ||
Claude Opus 4.7 | Eingabe | 5,00 $ | 5,00 $ |
Ausgabe | 25,00 $ | 25,00 $ | |
Batcheingabe | 2,50 $ | ||
Batchausgabe | 12,50 € | ||
5 Min. Cache schreiben | 6,25 $ | 6,25 $ | |
1 Std. Cache schreiben | 10,00 $ | 10,00 $ | |
Cache-Treffer | 0,50 $ | 0,50 $ | |
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||
1 Stunde Batch-Cache-Schreibvorgang | 5,00 $ | 5,00 $ | |
Batch Cache Hit | 0,25 $ | ||
Claude Opus 4.6 | Eingabe | 5,00 $ | 5,00 $ |
Ausgabe | 25,00 $ | 25,00 $ | |
Batcheingabe | 2,50 $ | ||
Batchausgabe | 12,50 € | ||
5 Min. Cache schreiben | 6,25 $ | 6,25 $ | |
1 Std. Cache schreiben | 10,00 $ | 10,00 $ | |
Cache-Treffer | 0,50 $ | 0,50 $ | |
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||
1 Stunde Batch-Cache-Schreibvorgang | 5,00 $ | ||
Batch Cache Hit | 0,25 $ | ||
Claude Opus 4.5 | Eingabe | 5,00 $ | |
Ausgabe | 25,00 $ | ||
Batcheingabe | 2,50 $ | ||
Batchausgabe | 12,50 € | ||
5 Min. Cache schreiben | 6,25 $ | ||
1 Std. Cache schreiben | 10,00 $ | ||
Cache-Treffer | 0,50 $ | ||
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||
1 Stunde Batch-Cache-Schreibvorgang | 5,00 $ | ||
Batch Cache Hit | 0,25 $ | ||
Claude 4.6 Sonnet | Eingabe | 3,00 $ | 3,00 $ |
Ausgabe | 15,00 $ | 15,00 $ | |
Batcheingabe | 1,50 $ | ||
Batchausgabe | 7,50 $ | ||
5 Min. Cache schreiben | 3,75 $ | 3,75 $ | |
1 Std. Cache schreiben | 6,00 $ | 6,00 $ | |
Cache-Treffer | 0,30 $ | 0,30 $ | |
5 Min. Batch-Cache-Schreibvorgang | 1,88 $ | ||
1 Stunde Batch-Cache-Schreibvorgang | 3,00 $ | ||
Batch Cache Hit | 0,15 $ | ||
Claude Sonnet 4.5 | Eingabe | 3,00 $ | 6,00 $ |
Ausgabe | 15,00 $ | 22,50 $ | |
Batcheingabe | 1,50 $ | ||
Batchausgabe | 7,50 $ | ||
5 Min. Cache schreiben | 3,75 $ | 7,50 $ | |
1 Std. Cache schreiben | 6,00 $ | $ 12,00 | |
Cache-Treffer | 0,30 $ | 0,60 $ | |
5 Min. Batch-Cache-Schreibvorgang | 1,88 $ | ||
1 Stunde Batch-Cache-Schreibvorgang | 3,00 $ | ||
Batch Cache Hit | 0,15 $ | ||
5 Min. Batch-Cache-Schreibvorgang | 1,00 $ | ||
Claude Haiku 4.5 | Eingabe | 1,00 $ | |
Ausgabe | 5,00 $ | ||
Batcheingabe | 0,50 $ | ||
Batchausgabe | 2,50 $ | ||
5 Min. Cache schreiben | 1,25 $ | ||
Batch Cache Hit | 0,05 $ | ||
1 Std. Cache schreiben | 2,00 $ | ||
Cache-Treffer | 0,10 $ | ||
5 Min. Batch-Cache-Schreibvorgang | 0,625 $ |
* Wenn der Kontext einer Abfrageeingabe länger als oder gleich 200.000 Tokens ist, werden alle Tokens (Eingabe und Ausgabe) zu den Preisen für langen Kontext berechnet.
Modelle mit einheitlichen Preisen in allen Regionen
Modell | Typ | Preis (/1M Tokens) =< 200K Eingabetokens | Preis (/1M Tokens) > 200K Eingabetokens |
|---|---|---|---|
Claude Opus 4.1 | Eingabe | 15 $ | – |
Ausgabe | 75 € | – | |
Batcheingabe | 7,50 $ | – | |
Batchausgabe | 37,50 $ | – | |
5 Min. Cache schreiben | 18,75 $ | – | |
1 Std. Cache schreiben | 30 $ | – | |
Cache-Treffer | 1,50 $ | – | |
5 Min. Batch-Cache-Schreibvorgang | 9,375 $ | – | |
1 Stunde Batch-Cache-Schreibvorgang | 15,00 $ | – | |
Batch Cache Hit | 0,75 $ | – |
* Wenn der Kontext einer Abfrageeingabe länger als oder gleich 200.000 Tokens ist, werden alle Tokens (Eingabe und Ausgabe) zu den Preisen für langen Kontext berechnet.
Preise für Tools
Tool | Preis (in $) |
|---|---|
Websuche-Anfrage | 10 $ pro 1.000 Suchanfragen Unterstützte Modelle: Claude Haiku 4.5, Claude Sonnet 4.5, Claude Sonnet 4.6, Claude Sonnet 4, Claude Opus 4.1, Claude Opus 4, Claude Opus 4.5 und Claude Opus 4.6. |
* Wenn der Kontext einer Abfrageeingabe länger als oder gleich 200.000 Tokens ist, werden alle Tokens (Eingabe und Ausgabe) zu den Preisen für langen Kontext berechnet.
Modell | Typ | Preis (/1M Tokens) =< 200K Eingabetokens | Preis (/1M Tokens) > 200K Eingabetokens |
|---|---|---|---|
Grok 4.20 Reasoning | Eingabe | 1,25 $ | 2,50 $ |
Ausgabe | 2,50 $ | 5,00 $ | |
Cache-Treffer | 0,20 $ | 0,40 $ | |
Grok 4.20 ohne Schlussfolgerungen | Eingabe | 1,25 $ | 2,50 $ |
Ausgabe | 2,50 $ | 5,00 $ | |
Cache-Treffer | 0,20 $ | 0,40 $ | |
Grok 4.3 | Eingabe | 1,25 $ | 2,50 $ |
Ausgabe | 2,50 $ | 5,00 $ | |
Cache-Treffer | 0,20 $ | 0,40 $ |
* Wenn der Kontext einer Abfrageeingabe länger als 200.000 Tokens ist, werden alle Tokens zu den Preisen für lange Kontexte berechnet.
Modell | Typ | Preis / 1 Mio. Tokens (USD) |
|---|---|---|
Grok 4.1 Fast Reasoning | Eingabe | 0,20 $ |
Ausgabe | 0,50 $ | |
Cache-Treffer | 0,05 $ | |
Grok 4.1 Fast Non-Reasoning | Eingabe | 0,20 $ |
Ausgabe | 0,50 $ | |
Cache-Treffer | 0,05 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
DeepSeek-V3.1 | Eingabe | 0,60 $ |
Ausgabe | 1,70 $ | |
Cache-Treffer | 0,06 $ | |
Batcheingabe | 0,30 $ | |
Batchausgabe | 0,85 $ | |
DeepSeek-V3.2 | Eingabe | 0,56 $ |
Ausgabe | 1,68 $ | |
Cache-Treffer | 0,056 $ | |
Batcheingabe | 0,28 $ | |
Batchausgabe | 0,84 $ | |
DeepSeek-R1 (0528) | Eingabe | 1,35 $ |
Ausgabe | 5,40 $ | |
Batcheingabe | 0,675 $ | |
Batchausgabe | 2,70 $ | |
DeepSeek-OCR | Eingabe | 0,30 $ |
Ausgabe | 1,20 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
MiniMax-M2 | Eingabe | 0,30 $ |
Ausgabe | 1,20 $ | |
Cache-Treffer | 0,03 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Kimi-K2-Thinking | Eingabe | 0,60 $ |
Ausgabe | 2,50 $ | |
Cache-Treffer | 0,06 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Qwen3-Next-80B-Thinking | Eingabe | 0,15 $ |
Ausgabe | 1,20 $ | |
Qwen3-Next-80B-Instruct | Eingabe | 0,15 $ |
Ausgabe | 1,20 $ | |
Qwen3-Coder-480B-A35B-Instruct | Eingabe | 0,22 $ |
Ausgabe | 1,80 $ | |
Cache-Treffer | 0,022 $ | |
Batcheingabe | 0,11 $ | |
Batchausgabe | 0,90 $ | |
Qwen3-235B-A22B-Instruct-2507 | Eingabe | 0,22 $ |
Ausgabe | 0,88 $ | |
Batcheingabe | 0,11 $ | |
Batchausgabe | 0,44 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
GLM-4.7 | Eingabe | 0,60 $ |
Ausgabe | 2,20 $ | |
Cache-Treffer | 0,06 $ | |
GLM-5 * | Eingabe | 1,00 $ |
Ausgabe | 3,20 $ | |
Cache-Treffer | 0,10 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
gpt-oss-120b | Eingabe | 0,09 $ |
Ausgabe | 0,36 $ | |
Batcheingabe | 0,045 $ | |
Batchausgabe | 0,18 $ | |
gpt-oss-20b | Eingabe | 0,07 $ |
Ausgabe | 0,25 $ | |
Cache-Treffer | 0,007 $ | |
Batcheingabe | 0,035 $ | |
Batchausgabe | 0,125 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Llama 3.3 70B | Eingabe | 0,72 $ |
Ausgabe | 0,72 $ | |
Batcheingabe | 0,36 $ | |
Batchausgabe | 0,36 $ | |
Llama 4 Scout | Eingabe | 0,25 $ |
Ausgabe | 0,70 $ | |
Batcheingabe | 0,125 $ | |
Batchausgabe | 0,35 $ | |
Llama 4 Maverick | Eingabe | 0,35 $ |
Ausgabe | 1,15 $ | |
Batcheingabe | 0,175 $ | |
Batchausgabe | 0,575 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Mistral OCR (25.05) | Eingabe | 0,0005 $ (oder 0,0005 $/Seite) |
Ausgabe | 0,0005 $ (oder 0,0005 $/Seite) | |
Mistral Medium 3 | Eingabe | 0,40 $ |
Ausgabe | 2,00 $ | |
Mistral Small 3.1 (25.03) | Eingabe | 0,10 $ |
Ausgabe | 0,30 $ | |
Codestral 2 | Eingabe | 0,30 $ |
Ausgabe | 0,90 $ |