Für Gemini 3.8 Flash, Gemini 3.7 Flash, Gemini 3.6 Flash und CodeMender mit diesen Modellen gilt bis zum 31. Dezember 2026 ein Einführungspreis von 0, 75 $ / 3, 75 $ pro 1 Million Eingabe-/Ausgabetokens. Ab dem 1. Januar 2027 gilt der Standardpreis von 1, 5 $ / 7, 5 $ pro 1 Million Eingabe- / Ausgabetokens.
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Ihnen werden nur Anfragen in Rechnung gestellt, die einen Antwortcode 200 zurückgeben. Für Anfragen, die andere Antwortcodes zurückgeben, z. B. 4xx- und 5xx-Codes, werden die Eingabe und Ausgabe nicht berechnet.
Auf dieser Seite sind die Preise für generative KI auf der Agent Platform beschrieben. Informationen zu allen anderen Preisen für die Agent Platform, einschließlich der ML Platform- und MLOps-Dienste, finden Sie in der Preisübersicht zur Agent Platform.
Flexible Sparpläne sind ausgabenbasierte Rabatte für zugesicherte Nutzung, mit denen Sie bei der Nutzung berechtigter Produkte in Google Cloud Geld sparen können. Weitere Informationen zu flexiblen Sparplänen und den dafür infrage kommenden Produkten finden Sie unter Flexible Savings Plans.
Modell | Typ | Region | Preis (/1 Mio. Tokens) <= 200.000 Eingabetokens | Preis (/1 Mio. Tokens) > 200.000 Eingabetokens | Preis (/1 Mio. Tokens) <= 200.000 Eingabetokens im Cache | Preis (/1 Mio. Tokens) > 200.000 Eingabetokens im Cache |
|---|---|---|---|---|---|---|
Gemini 3.8 Live API | Eingabe: Text | Nicht global | 0,75 $ | 0,75 $ | – | – |
Eingabe: Video, Bild | Nicht global | 1,00 $ | 1,00 $ | – | – | |
Eingabe: Audio | Nicht global | 3,00 $ | 3,00 $ | – | – | |
Ausgabe: Text (Antwort und Begründung) | Nicht global | 4,50 $ | 4,50 $ | – | – | |
Ausgabe: Audio | Nicht global | 12,00 $ | 12,00 $ | – | – | |
Ausgabe: Video (Avatar) | Nicht global | 1,00 $ | 1,00 $ | – | – | |
Gemini 3.1 Pro (Vorabversion) | Eingabe (Text, Bild, Video, Audio) | Global | 2,00 $ | 4,00 $ | 0,20 $ | 0,40 $ |
Textausgabe (Antwort und Begründung) | Global | 12,00 $ | 18,00 $ | – | – | |
Gemini 3.8 Flash Cyber | Eingabe (Text, Bild, Video, Audio) | Global | 1,50 $ | 1,50 $ | 0,15 $ | 0,15 $ |
Nicht global | 1,65 $ | 1,65 $ | 0,165 $ | 0,165 $ | ||
Textausgabe (Antwort und Begründung) | Global | 7,50 $ | 7,50 $ | – | – | |
Nicht global | 8,25 $ | 8,25 $ | – | – | ||
Gemini 3.8 Flash* bis zum 31. Dezember 2026 | Eingabe (Text, Bild, Video, Audio) | Global | 0,75 $ | 0,75 $ | 0,075 $ | 0,075 $ |
Nicht global | 0,825 $ | 0,825 $ | 0,0825 $ | 0,0825 $ | ||
Textausgabe (Antwort und Begründung) | Global | 3,75 $ | 3,75 $ | – | – | |
Nicht global | 4,125 $ | 4,125 $ | – | – | ||
Gemini 3.8 Flash Ab dem 1. Januar 2027 | Eingabe (Text, Bild, Video, Audio) | Global | 1,50 $ | 1,50 $ | 0,15 $ | 0,15 $ |
Nicht global | 1,65 $ | 1,65 $ | 0,165 $ | 0,165 $ | ||
Textausgabe (Antwort und Begründung) | Global | 7,50 $ | 7,50 $ | – | – | |
Nicht global | 8,25 $ | 8,25 $ | – | – | ||
Gemini 3.7 Flash * bis zum 31. Dezember 2026 | Eingabe (Text, Bild, Video, Audio) | Global | 0,75 $ | 0,75 $ | 0,075 $ | 0,075 $ |
Nicht global | 0,825 $ | 0,825 $ | 0,0825 $ | 0,0825 $ | ||
Textausgabe (Antwort und Begründung) | Global | 3,75 $ | 3,75 $ | – | – | |
Nicht global | 4,125 $ | 4,125 $ | – | – | ||
Gemini 3.7 Flash ab dem 1. Januar 2027 | Eingabe (Text, Bild, Video, Audio) | Global | 1,50 $ | 1,50 $ | 0,15 $ | 0,15 $ |
Nicht global | 1,65 $ | 1,65 $ | 0,165 $ | 0,165 $ | ||
Textausgabe (Antwort und Begründung) | Global | 7,50 $ | 7,50 $ | – | – | |
Nicht global | 8,25 $ | 8,25 $ | – | – | ||
Gemini 3.6 Flash * bis zum 31. Dezember 2026 | Eingabe (Text, Bild, Video, Audio) | Global | 0,75 $ | 0,75 $ | 0,075 $ | 0,075 $ |
Nicht global | 0,825 $ | 0,825 $ | 0,0825 $ | 0,0825 $ | ||
Textausgabe (Antwort und Begründung) | Global | 3,75 $ | 3,75 $ | – | – | |
Nicht global | 4,125 $ | 4,125 $ | – | – | ||
Gemini 3.6 Flash ab dem 1. Januar 2027 | Eingabe (Text, Bild, Video, Audio) | Global | 1,50 $ | 1,50 $ | 0,15 $ | 0,15 $ |
Nicht global | 1,65 $ | 1,65 $ | 0,165 $ | 0,165 $ | ||
Textausgabe (Antwort und Begründung) | Global | 7,50 $ | 7,50 $ | – | – | |
Nicht global | 8,25 $ | 8,25 $ | – | – | ||
Gemini 3 Flash (Vorabversion) | Eingabe (Text, Bild, Video) | Global | 0,50 $ | 0,50 $ | 0,05 $ | 0,05 $ |
Eingabe (Audio) | Global | 1,00 $ | 1,00 $ | 0,10 $ | 0,10 $ | |
Gemini 3.5 Flash | Eingabe (Text, Bild, Video, Audio) | Global | 1,50 $ | 1,50 $ | 0,15 $ | 0,15 $ |
Nicht global* | 1,65 $ | 1,65 $ | 0,165 $ | 0,165 $ | ||
Textausgabe (Antwort und Begründung) | Global | 9,00 $ | 9,00 $ | – | – | |
Nicht global* | 9,90 $ | 9,90 $ | – | – | ||
Gemini 3.5 Flash-Lite | Eingabe (Text, Bild, Video, Audio) | Global | 0,30 $ | 0,30 $ | 0,03 $ | 0,03 $ |
Nicht global* | 0,33 $ | 0,33 $ | 0,033 $ | 0,033 $ | ||
Textausgabe (Antwort und Begründung) | Global | 2,50 $ | 2,50 $ | – | – | |
Nicht global* | 2,75 $ | 2,75 $ | – | – | ||
Gemini 3.1 Flash Lite | Eingabe (Text, Bild, Video) | Global | 0,25 $ | 0,25 $ | 0,025 $ | 0,025 $ |
Nicht global* | 0,275 $ | 0,275 $ | 0,0275 $ | 0,0275 $ | ||
Eingabe (Audio) | Global | 0,50 $ | 0,50 $ | 0,05 $ | 0,05 $ | |
Nicht global* | 0,55 $ | 0,55 $ | 0,055 $ | 0,055 $ | ||
Textausgabe (Antwort und Begründung) | Global | 1,50 $ | 1,50 $ | – | – | |
Nicht global* | 1,65 $ | 1,65 $ | – | – |
* Aktionspreis durch 50% Gutschrift auf die Nettoausgaben für ausgewählte Modelle innerhalb eines bestimmten Zeitraums.
** Live-API-Abrechnungsdetails:
Sitzungskontextfenster: Der Tokenverbrauch wird pro Runde berechnet (eine Runde besteht aus einer Nutzereingabe und der entsprechenden Antwort des Modells). Nutzerinnen und Nutzern werden alle Tokens in Rechnung gestellt, die während dieser Runde im Sitzungskontextfenster vorhanden sind.
Tokens akkumulieren: Das Kontextfenster enthält neue Tokens für die aktuelle Runde sowie alle akkumulierten Tokens aus vorherigen Runden. Tokens aus vorherigen Runden werden in jeder neuen Runde neu verarbeitet und abgerechnet, bis die konfigurierte maximale Größe des Kontextfensters erreicht ist.
Token-Conversion-Raten: Zur Kostenschätzung gelten die folgenden Conversion-Messwerte:
Thinking-Tokens: Wenn Sie prüfen möchten, wie viele Thinking-Tokens eine bestimmte Anfrage verwendet hat, sehen Sie sich das Feld thoughts in den Metadaten der API-Antwort an.
Preise mit Fundierung
Funktion | Nutzung | Preis (in $) |
|---|---|---|
Fundierung mit der Google Suche und Webfundierung für Unternehmen | Enthält 5.000 Fundierungsabfragen pro Monat ohne Aufpreis, aggregiert über alle Gemini 3-Modelle. Für Grounding-Abfragen, die diese Limits überschreiten, werden 14 $ pro 1.000 Grounding-Abfragen berechnet. Wenn Sie mehr als 1 Million Grounding Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jede eine Grounding-Abfrage) . Ihnen werden die Kosten für jede einzelne Grounding-Abfrage in Rechnung gestellt. Die Abrechnung beginnt am 5. Januar 2026. Für Eingabetokens, die durch die Fundierung mit der Google Suche oder die Web-Fundierung für Unternehmen bereitgestellt werden, fallen keine Kosten an. Kundenunternehmen können sich entscheiden, in ihren Kundenanwendungen keine Suchvorschläge mit fundierten Ergebnissen anzuzeigen, wenn sie weniger als 1 Million Grounding-Prompts pro Tag verwenden. In diesem Fall gilt der Standardpreis. | 0 count to 5,000 count 0,00 $ (Free) 5,000 count and above 14,00 $ |
Fundierung mit Google Maps | Enthält 5.000 Suchanfragen pro Monat ohne Aufpreis, aggregiert über alle Gemini 3-Modelle. Maps-Abfragen, die diese Limits überschreiten, werden mit 14 $ pro 1.000 Abfragen berechnet. Eine von einem Kunden an Gemini gesendete Anfrage kann zu einer oder mehreren Anfragen an Google Maps führen. Ihnen wird jede einzelne ausgeführte Abfrage in Rechnung gestellt. Die Abrechnung beginnt am 5. Januar 2026 Für von Google Maps bereitgestellte Eingabetokens werden keine Gebühren erhoben. | 0 count to 5,000 count 0,00 $ (Free) 5,000 count and above 14,00 $ |
Fundierung mit Ihren Daten | 2,50 $ pro 1.000 Prompts. | 2,50 $ |
Tool zur Computernutzung | Die Preise basieren auf der Gesamtzahl der an das Modell gesendeten Eingabetokens und der daraus resultierenden generierten Ausgabetokens. Die Tokenpreise richten sich nach dem jeweils verwendeten Modell. Ab Gemini 3.5 werden Funktionsdeklarationen in die Anzahl der Eingabetokens einbezogen. Weitere Informationen finden Sie in der Dokumentation. |
* Für andere Endpunkte als den globalen Endpunkt treten die Preise für die allgemein verfügbaren Gemini 3-Modellfamilien und neuere Familien aller Google-Modelle am 1. Juli 2026 in Kraft. Vor dem 1. Juli 2026 gilt der Preis für den globalen Endpunkt auch für andere Endpunkte.
* Wenn der Kontext einer Abfrageeingabe länger als 200.000 Tokens ist, werden alle Tokens (Eingabe und Ausgabe) zu den Tarifen für lange Kontexte abgerechnet.
* Der Endpunkt des abgestimmten Modells ist 1,5-mal so groß wie der des Basismodells.
** Gemini 3 Pro Image berechnet 560 Tokens pro Eingabebild. Die Kosten für Ausgabebilder skalieren mit der Auflösung: 1.120 Tokens (0, 134 $) für 1K und 2K (etwa 1 MP und 4 MP) und 2.000 Tokens (0,24 $) für 4K (etwa 16 MP).
*** Gemini 3.1 Flash Image berechnet 1.120 Tokens pro Eingabebild. Die Kosten für Ausgabebilder skalieren mit der Auflösung: 747 Tokens (0,045 $) für 512 (ca. 0,25 MP), 1.120 Tokens (0,067 $) für 1K (ca. 1 MP), 1.680 Tokens (0,101 $) für 2K (ca. 4 MP) und 2.520 Tokens (0,15 $) für 4K (ca. 16 MP).
**** Gemini 3.1 Flash-Lite Image berechnet 1.120 Tokens pro Eingabebild und 1.120 Tokens (0, 034 $) für 1.000 Ausgabebilder (ca. 1 MP).
Modell | Typ | Tokenpreis <= 200.000 Tokens | Preis > 200.000 Tokens | Preis <= 200.000 Eingabetokens im Cache | Preis > 200.000 Eingabetokens im Cache |
|---|---|---|---|---|---|
Gemini 2.5 Pro | Eingabe (Text, Bild, Video, Audio) | 1,25 $ | 2,50 $ | 0,125 $ | 0,25 $ |
Textausgabe (Antwort und Begründung) | 10,00 $ | 15,00 $ | – | – | |
Gemini 2.5 Pro Computernutzung – Vorschau | Eingabe (Text, Bild, Video, Audio) | 1,25 $ | 2,50 $ | – | – |
Textausgabe (Antwort und Begründung) | 10,00 $ | 15,00 $ | – | – | |
Gemini 2.5 Flash | Eingabe (Text, Bild, Video) | 0,30 $ | 0,30 $ | 0,03 $ | 0,03 $ |
Audioeingabe | 1,00 $ | 0,30 $ | 0,10 $ | 0,10 $ | |
Textausgabe (Antwort und Begründung) | 2,50 $ | 2,50 $ | – | – | |
Gemini 2.5 Flash Image | Eingabe (Text, Bild)*** | 0,30 $ | – | – | – |
Textausgabe (Antwort und Begründung) | 2,50 $ | – | – | – | |
Bildausgabe*** | 30,00 $ | – | – | – | |
Gemini 2.5 Flash Live API | Eingabetext | 0,50 $ | 0,50 $ | – | – |
Eingabe (Video, Bild) | 3,00 $ | 3,00 $ | – | – | |
Audioeingabe | 3,00 $ | 3,00 $ | – | – | |
Textausgabe | 2,00 $ | 2,00 $ | – | – | |
1 Mio. Ausgabetokens für Audio | 12,00 $ | $ 12,00 | – | – | |
Gemini 2.5 Flash Lite | Eingabe (Text, Bild, Video) | 0,10 $ | 0,10 $ | 0,01 $ | 0,01 $ |
Audioeingabe | 0,30 $ | 0,30 $ | 0,03 $ | 0,03 $ | |
Textausgabe (Antwort und Begründung) | 0,40 $ | 0,40 $ | – | – |
Preise mit Fundierung
Funktion | Nutzung | Preis (in $) |
|---|---|---|
Fundierung mit der Google Suche | Gemini 2.0 Flash, 2.5 Flash und 2.5 Flash-Lite umfassen insgesamt 1.500 Grounding-Prompts pro Tag ohne Aufpreis. Gemini 2.5 Pro umfasst 10.000 Grounding-Prompts pro Tag ohne Aufpreis. Grounding-Prompts, die diese Limits überschreiten, werden mit 35 $ pro 1.000 Grounding-Prompts berechnet. Wenn Sie mehr als 1 Million Grounding Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jede eine Grounding-Abfrage)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. | 0 count to 10,000 count 0,00 $ (Free) 10,000 count and above 35,00 $ |
Webfundierung für Unternehmen | 45 $ pro 1.000 Grounding-Prompts Wenn Sie mehr als 1 Million Grounding Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex (jeweils eine Grounding-Abfrage) sendet**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. | 45,00 $ |
Fundierung mit Ihren Daten | 2,5 $ pro 1.000 Anfragen. | 2,50 $ |
Fundierung mit Google Maps | 25 $ pro 1.000 gegroundeten Prompts Ein verankerter Prompt ist eine an Gemini gesendete Anfrage, die mindestens eine Abfrage an Google Maps enthält. | 0 count to 1,500 count 0,00 $ (Free) 1,500 count and above 25,00 $ |
* Wenn der Kontext einer Abfrageeingabe länger als 200.000 Tokens ist, werden alle Tokens (Eingabe und Ausgabe) zu den Tarifen für lange Kontexte abgerechnet.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
** Die Fundierung mit der Google Suche und die Web-Fundierung für Unternehmen werden nur dann abgerechnet, wenn ein Fundierungs-Prompt erfolgreich Quellen zurückgibt (d.h. Ergebnisse, die mindestens eine Support-URL aus dem Web enthalten). Die Gebühren für die Nutzung von Gemini-Modellen werden separat berechnet.
*** Ein Bild mit 1.024 × 1.024 Pixeln verbraucht 1.290 Tokens (0,039 $ pro 1.000 Tokens für Ausgabebilder). Die Anzahl der Tokens pro Bild variiert je nach Bildauflösung. Weitere Informationen zur Berechnung von Tokens finden Sie in unserer Dokumentation.
**** Die Abrechnung der Computernutzung verwendet die Gemini 2.5 Pro-SKU, um die Kosten für die Computernutzung aufzuschlüsseln und Abrechnungstags anzuwenden. Weitere Informationen
Gemini 2.0 wird auf der Grundlage von Tokens abgerechnet. Um die Anzahl der Eingabetokens in Ihrer Anfrage vor dem Senden zu berechnen, können Sie den SDK-Tokenizer oder die countTokens API verwenden. Wenn Ihre Anfrage mit einem 400- oder 500-Fehler fehlschlägt, werden Ihnen die verwendeten Tokens nicht in Rechnung gestellt.
Mit dem Schalter in der Preistabelle können Sie die tokenbasierten Preise mit den modalitätsbasierten Preisen vergleichen.
Modell | Typ | Preis pro Mio. Tokens (USD) | Preis pro Mio. Tokens (USD) mit Batch API |
|---|---|---|---|
Gemini 2.0 Flash | Eingabetext | 0,15 $ | 0,075 $ |
Eingabeaudio | 1,00 $ | 0,50 $ | |
Ausgabetext | 0,60 $ | 0,30 $ | |
Training zur Abstimmung | 0,003 $ | ||
Bildgenerierung mit Gemini 2.0 Flash | Eingabetokens | 0,15 $ | |
Eingabeaudiotokens | 1,00 $ | ||
Eingabevideotokens | 0,15 $ | ||
Ausgabetext-Tokens | 0,60 $ | ||
Ausgabebild-Tokens | 30,00 $ | ||
Gemini 2.0 Flash Live API | Eingabetext-Tokens | 0,50 $ | |
Eingabeaudiotokens | 3,00 $ | ||
Eingabevideo-/Eingabebildtokens | 3,00 $ | ||
Ausgabetext-Tokens | 2,00 $ | ||
Ausgabeaudiotokens | 12,00 $ | ||
Gemini 2.0 Flash Lite | Eingabetokens | 0,075 $ | 0,0375 $ |
Eingabeaudiotokens | 0,075 $ | 0,0375 $ | |
Ausgabetext-Tokens | 0,30 $ | 0,15 $ | |
Abstimmung für Trainings-Tokens | 0,001 $ |
* Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* Die Anzahl der Trainings-Tokens wird anhand der Gesamtzahl der Tokens in Ihrem Trainings-Dataset multipliziert mit der Anzahl der Epochen berechnet.
* PDFs werden als Bildeingabe abgerechnet, wobei eine PDF-Seite einem Bild entspricht.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
* Gemini 2.0 Flash Live API: 25 Tokens pro Sekunde Audio (Ein-/Ausgabe), 258 Tokens pro Sekunde Video (Eingabe). Die Fundierung mit der Google Suche bleibt kostenlos, solange sich die Gemini 2.0 Flash Live API in der Vorschau befindet.
Preis mit Grounding
Funktion | Nutzung | Preis (in $) |
|---|---|---|
Fundierung mit der Google Suche*, ** | Gemini 2.0 Flash, 2.5 Flash und 2.5 Flash-Lite umfassen insgesamt 1.500 Grounding-Prompts pro Tag ohne Aufpreis. Gemini 2.5 Pro umfasst 10.000 Grounding-Prompts pro Tag ohne Aufpreis. Grounding-Prompts, die diese Limits überschreiten, werden mit 35 $ pro 1.000 Grounding-Prompts berechnet. Wenn Sie mehr als 1 Million Grounding Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jede eine Grounding-Abfrage)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. | 0 count to 10,000 count 0,00 $ (Free) 10,000 count and above 35,00 $ |
Webfundierung für Unternehmen*, ** | 45 $ pro 1.000 Grounding-Prompts Wenn Sie mehr als 1 Million Grounding Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex (jeweils eine Grounding-Abfrage) sendet**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. | 45,00 $ |
Fundierung mit Ihren Daten* | 2,5 $ pro 1.000 Anfragen. | 2,50 $ |
Fundierung mit Google Maps* | Gemini-Modelle enthalten eine Reihe von täglich aktualisierten, verankerten Prompts ohne Aufpreis:
Für Grounded Prompts, die diese Limits überschreiten, werden 25 $ pro 1.000 Grounded Prompts berechnet. Ein verankerter Prompt ist eine an Gemini gesendete Anfrage, die mindestens eine Abfrage an Google Maps enthält. Wenn Sie mehr als 1 Million verankerter Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. | 0 count to 1,500 count 0,00 $ (Free) 1,500 count and above 25,00 $ |
* Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* Die Anzahl der Trainings-Tokens wird anhand der Gesamtzahl der Tokens in Ihrem Trainings-Dataset multipliziert mit der Anzahl der Epochen berechnet.
* PDFs werden als Bildeingabe abgerechnet, wobei eine PDF-Seite einem Bild entspricht.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
* Gemini 2.0 Flash Live API: 25 Tokens pro Sekunde Audio (Ein-/Ausgabe), 258 Tokens pro Sekunde Video (Eingabe). Die Fundierung mit der Google Suche bleibt kostenlos, solange sich die Gemini 2.0 Flash Live API in der Vorschau befindet.
** Die Fundierung mit der Google Suche und die Web-Fundierung für Unternehmen werden nur dann in Rechnung gestellt, wenn ein Prompt erfolgreich Quellen zurückgibt (d.h. Ergebnisse, die mindestens eine Support-URL aus dem Web enthalten). Die Gebühren für die Nutzung von Gemini-Modellen werden separat berechnet.
Modell | Typ | Region | Preis (/1 Mio. Tokens) | Preis (/1 Mio. Tokens) für im Cache gespeicherte Eingabetokens |
|---|---|---|---|---|
Gemini Nano Banana 2.1 | Eingabe (Text, Bild, Video) [4] | Global | 1,50 $ | 0,15 $ |
Textausgabe (Antwort und Begründung) | Global | 7,50 $ | – | |
Bildausgabe [4] | Global | 30,00 $ | – | |
Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite) | Eingabe (Text, Bild, Video) [3] | Global | 0,25 $ | 0,025 $ |
Textausgabe (Antwort und Begründung) | Global | 1,50 $ | – | |
Bildausgabe [3] | Global | 30,00 $ | – | |
Gemini 3.1 Flash Image (Nano Banana 2) | Eingabe (Text, Bild, Video) [2] | Global | 0,50 $ | 0,05 $ |
Nicht global | 0,55 $ | 0,055 $ | ||
Textausgabe (Antwort und Begründung) | Global | 3,00 $ | – | |
Nicht global | 3,30 $ | – | ||
Bildausgabe [2] | Global | 60,00 $ | – | |
Nicht global | 66,00 $ | – | ||
Gemini 3 Pro Image (Nano Banana Pro) | Eingabe (Text, Bild) | Global | 2,00 $ | 0,20 $ |
Textausgabe (Antwort und Begründung) | Global | 12,00 $ | – | |
Bildausgabe [1] | Global | 120,00 $ | – |
[1] Gemini 3 Pro Image berechnet 560 Tokens pro Eingabebild. Die Kosten für das Ausgabebild skalieren ungefähr mit der Auflösung: 1.120 Tokens (0, 134 $) für 1K und 2K (ungefähr 1 MP und 4 MP) und 2.000 Tokens (0,24 $) für 4K (ungefähr 16 MP).
[2] Gemini 3.1 Flash Image berechnet 1.120 Tokens pro Eingabebild.Die Kosten für das Ausgabebild skalieren ungefähr mit der Auflösung: 747 Tokens (0,045 $) für 512 (etwa 0,25 MP), 1.120 Tokens (0,067 $) für 1K (etwa 1 MP), 1.680 Tokens (0,101 $) für 2K (etwa 4 MP) und 2.520 Tokens (0,15 $) für 4K (etwa 16 MP).
[3] Gemini 3.1 Flash-Lite Image berechnet 1.120 Tokens pro Eingabebild und 1.120 Tokens (0, 034 $) für 1.000 Ausgabebilder (ca. 1 MP).
[4] Gemini Nano Banana 2.1 berechnet 1.120 Tokens pro Eingabebild. Die Kosten für das Ausgabebild skalieren ungefähr mit der Auflösung: 1.120 Tokens (0,034 $) für 1K (ca. 1 MP), 1.680 Tokens (0,05 $) für 2K (ca. 4 MP) und 3.780 Tokens (0,113 $) für 4K (ca. 16 MP). Gemini Nano Banana 2.1 unterstützt Flex nicht
Preise mit Fundierung
Funktion | Nutzung | Preis (in $) |
|---|---|---|
Fundierung mit der Google Suche | Enthält 5.000 Fundierungsabfragen pro Monat ohne Aufpreis, aggregiert über alle Gemini 3-Modelle. Für Grounding-Abfragen, die diese Limits überschreiten, werden 14 $ pro 1.000 Grounding-Abfragen berechnet. Wenn Sie mehr als 1 Million Grounding Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Ein „Grounding-Prompt“ ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an einen Google-Webindex sendet (jede eine „Grounding-Abfrage“) . Ihnen werden die Kosten für jede einzelne Grounding-Abfrage in Rechnung gestellt. Die Abrechnung beginnt am 5. Januar 2026. Für Eingabetokens, die durch die Fundierung mit der Google Suche oder die Web-Fundierung für Unternehmen bereitgestellt werden, fallen keine Kosten an. Kundenunternehmen können sich entscheiden, in ihren Kundenanwendungen keine Suchvorschläge mit fundierten Ergebnissen zum Standardpreis für weniger als 1 Million Grounding-Prompts pro Tag anzuzeigen. | 0 count to 5,000 count 0,00 $ (Free) / 1,000 count, per 1 month / account 5,000 count and above 14,00 $ / 1,000 count, per 1 month / account |
Alle Gemini-Modelle außer Gemini 2.0 oder Gemini 2.5 werden nach Modalitäten wie Zeichen, Bilder, Video-/Audiosekunden abgerechnet.
Gemini 3.8 Flash TTS und Gemini 3.8 Flash-Lite TTS
Modell | Funktion | Beschreibung | Typ | Preis (in $) |
|---|---|---|---|---|
Gemini 3.8 Flash TTS (Vorabversion)* Bis zum 31. Dezember 2026 | Expressive Sprachausgabe | Sprachausgabe in Studioqualität für einzelne und mehrere Sprecher mit detaillierter Steuerung für Medien- und Kreativ-Workflows. Unäre und Streaming-Synthese Funktionen für das Stimmen-Design und die Stimmen-Replikation. | Texteingabe | 0,50 $ / 1 Mio.Tokens |
Audioausgabe | 9,00 $ / 1 Mio.Tokens | |||
Gemini 3.8 Flash TTS (Vorabversion) Ab dem 1. Januar 2027 | Texteingabe | 1,00 $ / 1 Mio.Tokens | ||
Audioausgabe | 18,00 $ / 1 Mio.Tokens | |||
Gemini 3.8 Flash-Lite TTS (Vorabversion)* Bis zum 31. Dezember 2026 | Sprachgenerierung mit niedriger Latenz | Steuerbare Sprachausgabe mit einem oder mehreren Sprechern für Echtzeit- und Hochvolumen-Arbeitslasten Unäre und Streaming-Synthese sowie die Möglichkeit zur Sprachreplikation. | Texteingabe | 0,50 $ / 1 Mio.Tokens |
Audioausgabe | 6,00 $ / 1 Mio.Tokens | |||
Gemini 3.8 Flash-Lite TTS (Vorabversion) Ab dem 1. Januar 2027 | Texteingabe | 1,00 $ / 1 Mio.Tokens | ||
Audioausgabe | 12,00 $ / 1 Mio.Tokens |
* Aktionspreisangebot: 50% des Nettoumsatzes für dasselbe Modell werden innerhalb eines bestimmten Zeitraums als Guthaben zurückerstattet.
Gemini 3.5 Live-Übersetzung
Modell | Funktion | Beschreibung | Typ | Preis (in $) |
|---|---|---|---|---|
Gemini 3.5 Live-Übersetzung | Echtzeitübersetzung von Sprache zu Sprache | Modell für die Echtzeit-Sprachübersetzung mit niedriger Latenz, das über 70 Sprachen unterstützt. | Audioeingabe | 3,50 $ / 1,000,000 count |
Audioausgabe | 21,00 $ / 1,000,000 count |
* Die Abrechnung basiert auf dem gesamten Verbrauch an Eingabe- und Ausgabe-Audiotokens, berechnet mit einem Satz von 25 Tokens pro Sekunde Audio.
Gemini 3.5 Transcribe
Modell | Funktion | Beschreibung | Typ | Preis (in $) |
|---|---|---|---|---|
Gemini 3.5 Transcribe Live | Transkription von Streaminginhalten in Echtzeit | Streaming mit Latenz im Subsekundenbereich über die Live API mit automatischem Code-Mixing. Es werden nur die endgültig zugesagten Tokens in Rechnung gestellt. | Audioeingabe | 3,50 $ / 1,000,000 count |
Textausgabe | 21,00 $ / 1,000,000 count | |||
Effektiver Mischpreis (Audio-Minute*) | 0,008925 $ / 1 count | |||
Gemini 3.5 Transcribe | Synchrone Verarbeitung von Audiodateien | Batch- und synchrone Verarbeitung von Dateien bis zu 60 Minuten über die GenerateContent API. | Audioeingabe | 2,00 $ / 1,000,000 count |
Textausgabe | 12,00 $ / 1,000,000 count | |||
Effektiver Mischpreis (Audio-Minute*) | 0,0051 $ / 1 count |
*Die geschätzten Preise basieren auf 25 Audio-Tokens pro Sekunde für die Audioeingabe und 175 Text-Tokens pro Minute für die Textausgabe.
Gemini 1.5
Modell | Funktion | Typ | Preis ( =< 128.000 Eingabetokens) | Preis ( > 128.000 Eingabetokens) |
|---|---|---|---|---|
Gemini 1.5 Flash | Multimodal | Bildeingabe | 0,00002 $ / 1 count | 0,00004 $ / 1 count |
Videoeingabe | 0,00002 $ / 1 count | 0,00004 $ / 1 count | ||
Texteingabe | 0,00001875 $ / 1,000 count | 0,0000375 $ / 1,000 count | ||
Audioeingabe | 0,000002 $ / 1 count | 0,000004 $ / 1 count | ||
Textausgabe | 0,000075 $ / 1,000 count | 0,00015 $ / 1,000 count | ||
Abstimmung* | Trainingstoken | 0,008 $ / 1,000 count | ||
Gemini 1.5 Pro, | Multimodal | Bildeingabe | 0,00032875 $ / 1 count | 0,0006575 $ / 1 count |
Videoeingabe | 0,00032875 $ / 1 count | 0,0006575 $ / 1 count | ||
Texteingabe | 0,0003125 $ / 1,000 count | 0,000625 $ / 1,000 count | ||
Audioeingabe | 0,00003125 $ / 1 count | 0,0000625 $ / 1 count | ||
Textausgabe | 0,00125 $ / 1,000 count | 0,0025 $ / 1,000 count | ||
Abstimmung* | Trainingstoken | 0,08 $ / 1,000 count | ||
Gemini 1.0 Pro | Multimodal | Bildeingabe | 0,0025 $ / 1 count | |
Videoeingabe | 0,002 $ / 1 count | |||
Texteingabe | 0,000125 $ / 1,000 count | |||
Textausgabe | 0,000375 $ / 1,000 count |
* Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* Wenn ein Abfragekontext länger als 128.000 Tokens ist, werden alle Tokens zu den Preisen für lange Kontexte berechnet.
* Gemini-Modelle sind im Batchmodus mit einem Rabatt von 50% verfügbar.
* Gemini 1.0 Pro unterstützt nur ein Kontextfenster von bis zu 32.000 Tokens.
* PDFs werden als Bildeingabe abgerechnet, wobei eine PDF-Seite einem Bild entspricht.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
** Die Fundierung mit der Google Suche und die Web-Fundierung für Unternehmen werden nur abgerechnet, wenn ein Prompt erfolgreich Quellen zurückgibt (d.h. Webergebnisse, die mindestens eine Support-URL aus dem Web enthalten). Die Gebühren für die Nutzung von Gemini-Modellen werden separat berechnet.
Preise mit Grounding
Funktion | Preis (in $) |
|---|---|
Fundierung mit der Google Suche | 35 $ pro 1.000 Grounding-Prompts. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an den Google-Webindex sendet (jede eine Grounding-Abfrage)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. |
Webfundierung für Unternehmen | 45 $ pro 1.000 Grounding-Prompts. Ein Grounding-Prompt ist ein Prompt, den ein Endnutzer an Gemini sendet und für den Gemini eine oder mehrere Abfragen an den Google-Webindex sendet (jede eine Grounding-Abfrage)**. Auch wenn mehrere Grounding-Abfragen gesendet werden, wird nur ein Grounding-Prompt berechnet. |
Fundierung mit Ihren Daten | 2,5 $ pro 1.000 Anfragen ab dem 16. Juni 2025. |
** Die Fundierung mit der Google Suche und die Web-Fundierung für Unternehmen werden nur abgerechnet, wenn ein Prompt erfolgreich Quellen zurückgibt (d.h. Webergebnisse, die mindestens eine Support-URL aus dem Web enthalten). Die Gebühren für die Nutzung von Gemini-Modellen werden separat berechnet.
Imagen
Mit Imagen auf der Agent Platform können Sie neue Bilder generieren und Bilder basierend auf den von Ihnen bereitgestellten Text-Prompts bearbeiten oder nur Teile von Bildern mit einem Maskenbereich, den Sie zusammen mit einer Reihe anderer Funktionen definieren, bearbeiten.
Modell | Funktion | Beschreibung | Eingabe | Ausgabe | Preis / 1 Stück (in USD) |
|---|---|---|---|---|---|
Imagen 4 Ultra | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,06 $ |
Imagen 4 | Auflösung wird erhöht | Auflösung eines generierten Bildes auf 2.000, 3.000 und 4.000 erhöhen | Bild | Bild | 0,06 $ |
Imagen 4 | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,04 $ |
Imagen 4 Fast | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,02 $ |
Imagen 3 | Bildgenerierung | Image generieren Bild bearbeiten Bild anpassen | Text-Prompt | Bild | 0,04 $ |
Imagen 3 Fast | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,02 $ |
Imagen 2, Imagen 1 | Bildgenerierung | Bild generieren | Text-Prompt | Bild | 0,02 $ |
Imagen 2, Imagen 1 | Bildbearbeitung | Bild mit maskenfreiem Ansatz oder Maskenansatz bearbeiten | Bild-/Text-Prompt | Bild | 0,02 $ |
Imagen 1 | Auflösung wird erhöht | Auflösung eines generierten Bildes auf 2.000 und 4.000 erhöhen | Bild | Bild | 0,003 $ |
Imagen 1 | Abstimmung | Aktivieren Sie einen "Betreff", der vom Nutzer für die Verwendung von Imagen-Prompts bereitgestellt wurde (weniger Aufnahmetraining). | Betreff mit Textkennung und 4–8 Bildern pro Betreff | Feinabstimmung des Modells (nach dem Training mit vom Nutzer bereitgestellten Betreff) | $ pro Knotenstunde (Preise für benutzerdefiniertes Training auf der Agent Platform) |
Imagen | Visuelle Untertitel | Kurze oder lange Textuntertitel für ein Bild generieren | Bild | Textunterschrift | 0,0015 $ |
Imagen | Visual Question Answering | Eine Antwort basierend auf einer Frage bereitstellen, die auf ein Bild verweist | Bild-/Text-Prompt | Textantwort | 0,0015 $ |
Imagen | Produkt-Recontext | Produkte in einer neuen Szene neu in Szene setzen | 1–3 Bilder desselben Produkts und ein Text-Prompt, der die gewünschte Szene beschreibt | Bild | 0,12 $ |
Virtueller Test | Bilder von Personen in unterschiedlicher Kleidung erstellen | 1 Bild einer Person und 1 Bild von Kleidung | Bild | 0,06 $ |
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Veo
Modell | Funktion | Beschreibung | Eingabe | Ausgabe | Ausgabeauflösung | Preis (in $) |
|---|---|---|---|---|---|---|
Veo 3.1 | Video- und Audiogenerierung | Hochwertige Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video und Audio | 720p, 1080p | 0,40 $ / 1 count |
4.000 | 0,60 $ / 1 count | |||||
Videogenerierung | Hochwertige Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p, 1080p | 0,20 $ / 1 count | |
4.000 | 0,40 $ / 1 count | |||||
Veo 3.1 Fast | Video- und Audiogenerierung | Schneller Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video und Audio | 720p | 0,10 $ / 1 count |
1080p | 0,12 $ / 1 count | |||||
4.000 | 0,30 $ / 1 count | |||||
Videogenerierung | Schneller Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p | 0,08 $ / 1 count | |
1080p | 0,10 $ / 1 count | |||||
4.000 | 0,25 $ / 1 count | |||||
Veo 3.1 Lite | Video- und Audiogenerierung | Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild am schnellsten generieren | Text-/Bild-Prompt | Video und Audio | 720p | 0,05 $ / 1 Zählung |
1080p | 0,08 $ / 1 Zählung | |||||
Videogenerierung | Videos aus einem Text-Prompt oder Referenzbild am schnellsten generieren | Text-/Bild-Prompt | Video | 720p | 0,03 $ / 1 Zählung | |
1080p | 0,05 $ / 1 Zählung | |||||
Veo 3 | Video- und Audiogenerierung | Hochwertige Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video und Audio | 720p, 1080p | 0,40 $ / 1 count |
Videogenerierung | Hochwertige Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p, 1080p | 0,20 $ / 1 count | |
Veo 3 Fast | Video- und Audiogenerierung | Schneller Videos mit synchronisierter Sprache/Soundeffekten aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video und Audio | 720p | 0,10 $ / 1 count |
1080p | 0,12 $ / 1 count | |||||
Videogenerierung | Schneller Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p | 0,08 $ / 1 count | |
1080p | 0,10 $ / 1 count | |||||
Veo 2 | Videogenerierung | Videos aus einem Text-Prompt oder Referenzbild generieren | Text-/Bild-Prompt | Video | 720p | 0,50 $ / 1 count |
Erweiterte Funktionen | Videos durch Interpolation von Start- und End-Frames generieren, generierte Videos verlängern und Kamerasteuerung anwenden | Text-/Bild-/Video-Prompt | Video | 720p | 0,50 $ / 1 count |
Lyria
Die Lyria-Modellfamilie bietet eine hochwertige Musikgenerierung, die sich ideal für anspruchsvolle Kompositionen und detaillierte kreative Erkundungen eignet, bei denen es auf eine nuancierte Ausgabe ankommt.
Modell | Funktion | Beschreibung | Eingabe | Ausgabe | Preis (in $) |
|---|---|---|---|---|---|
Lyria 3 Pro | Generierung von Songs in voller Länge | Lyria 3 Pro erstellt vollständige musikalische Kompositionen aus multimodalen Eingaben wie Text oder Bildern. | Text, Bild | Vollständiger Song | 0,08 $ / 1 count |
Lyria 3 | Generierung von 30 Sekunden langen Musik-Clips | Lyria 3 generiert aus Text- oder Bild-Prompts 30‑sekündige Audioclips in hoher Qualität. | Text, Bild | 30 Sekunden langer Musik-Clip | 0,04 $ / 1 count |
Lyria 2 | Musikgenerierung | Musik aus einem Text-Prompt generieren | Text-Prompt | Musik | 0,06 $ / 1 count |
Kosten für Einbettung
Die Gemini API bietet Einbettungsmodelle zum Generieren von Einbettungen für Text, Bilder, Videos und andere Inhalte.
Modell | Typ | Region | Anfragetyp | Preis pro 1.000 Zählungen (USD) |
|---|---|---|---|---|
Gemini Embedding | Eingabe | Global | Onlineanfragen | 0,00015 $ |
Batchanfragen | 0,00012 $ | |||
Ausgabe | Global | Onlineanfragen | Kostenlos | |
Batchanfragen | Kostenlos | |||
Einbettungen für Text (ohne Gemini-Einbettung) | Eingabe | Global | Onlineanfragen | 0,000025 $ |
Batchanfragen | 0,00002 $ | |||
Ausgabe | Global | Onlineanfragen | Kostenlos | |
Batchanfragen | Kostenlos |
Modell | Typ | Tokenpreis /1 Mio. (USD) |
|---|---|---|
Gemini Omni Flash, Gemini Omni 1.1 Flash | Eingabe (Text, Bild, Video, Audio)* | 1,50 $ |
Textausgabe (Antwort und Begründung) | 9,00 $ | |
Videoausgabe** | 17,50 $ |
* Gemini Omni Flash berechnet 1.120 Tokens pro Bild, 32 Tokens pro Sekunde Audio und 5.792 Tokens pro Sekunde Video für Eingaben.
** Gemini Omni Flash berechnet 1.931 Tokens pro Sekunde für 360p-Videoausgaben, 5.792 Tokens pro Sekunde für 720p-Videoausgaben, 8.688 Tokens pro Sekunde für 1080p-Videoausgaben und 17.376 Tokens pro Sekunde für 4K-Videoausgaben (mit Audio).
Modell | Typ | Preis (/1 Mio. Tokens) | Preis (pro Mio. Eingabetokens im Cache) |
|---|---|---|---|
Gemini Deep Research-Agent | Eingabe (Text) | 2 $ | 0,20 $ |
Textausgabe (Antwort und Begründung) | 12 $ | – |
Preise mit Fundierung
Funktion | Nutzung | Preis (USD) |
|---|---|---|
Fundierung mit der Google Websuche und Bildersuche sowie Webfundierung für Unternehmen* | Enthält 5.000 Suchanfragen pro Monat ohne Aufpreis, aggregiert über alle Gemini 3-Modelle. Suchanfragen, die diese Limits überschreiten, werden mit 14 $ pro 1.000 Suchanfragen abgerechnet. Eine von einem Kundenunternehmen an Gemini gesendete Anfrage kann zu einer oder mehreren Anfragen an die Google Suche (oder Web Grounding für Enterprise) führen. Ihnen wird jede einzelne Suchanfrage in Rechnung gestellt. Die Abrechnung beginnt am 5. Januar 2026. Für Eingabetokens, die durch die Fundierung mit der Google Suche oder die Web-Fundierung für Unternehmen bereitgestellt werden, fallen keine Kosten an. Wenn Sie mehr als 1 Million verankerter Prompts pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Kundenunternehmen können sich entscheiden, in der Schnittstelle ihrer Kundenanwendung keine Suchvorschläge mit fundierten Ergebnissen zum Standardpreis anzuzeigen. | 0 count to 5,000 count 0,00 $ (Free) 5,000 count and above 14,00 $ |
| 2,50 $ |
Die Preise für CodeMender basieren auf Tokens und hängen vom verwendeten Modell ab.
Modell | Typ | Modellpreis /1 Mio. Tokens (USD) | CodeMender-Preis /1 Mio. Tokens (USD) |
|---|---|---|---|
Gemini 3.8 Flash Cyber | Eingabetokens | 1,50 $ | 1,50 $ |
Im Cache gespeicherte Tokens | 0,15 $ | 0,15 $ | |
Ausgabetokens | 7,50 $ | 7,50 $ | |
Gemini 3.8 Flash | Eingabetokens | 1,50 $ | 1,50 $ |
Im Cache gespeicherte Tokens | 0,15 $ | 0,15 $ | |
Ausgabetokens | 7,50 $ | 7,50 $ | |
Gemini 3.7 Flash | Eingabetokens | 1,50 $ | 1,50 $ |
Im Cache gespeicherte Tokens | 0,15 $ | 0,15 $ | |
Ausgabetokens | 7,50 $ | 7,50 $ | |
Gemini 3.6 Flash | Eingabetokens | 1,50 $ | 1,50 $ |
Im Cache gespeicherte Tokens | 0,15 $ | 0,15 $ | |
Ausgabetokens | 7,50 $ | 7,50 $ | |
Gemini 3.5 Flash | Eingabetokens | 1,50 $ | 1,50 $ |
Im Cache gespeicherte Tokens | 0,15 $ | 0,15 $ | |
Ausgabetokens | 9,00 $ | 9,00 $ | |
Gemini 3.1. Pro | Eingabetokens | 2,00 $ | 2,00 $ |
Im Cache gespeicherte Tokens | 0,20 $ | 0,20 $ | |
Ausgabetokens | 12,00 $ | 12,00 $ |
Die Kosten für AlphaEvolve setzen sich aus den Kosten für das verwendete Gemini-Modell und den Kosten für den AlphaEvolve-Agenten zusammen.
Gemini-Modell | Typ | Preis für Gemini-Modell /1M (USD) | Preis für AlphaEvolve-Agent /1M (USD) |
|---|---|---|---|
Gemini 3.1 Pro (Vorabversion) | Preis pro 1 Mio. Eingabetokens | 2,00 $ | 4,00 $ |
Preis pro 1 Mio. Ausgabetokens und Thinking-Tokens | 12,00 $ | 24,00 $ | |
Gemini 3.5 Flash | Preis pro 1 Mio. Eingabetokens | 1,50 $ | 3,00 $ |
Preis pro 1 Mio. Ausgabetokens und Thinking-Tokens | 9,00 $ | 18,00 $ | |
Gemini 3.7 Flash, Gemini 3.8 Flash | Preis pro 1 Mio. Eingabetokens | 1,50 $ | 3,00 $ |
Preis pro 1 Mio. Ausgabetokens und Thinking-Tokens | 7,50 $ | 15,00 $ |
Modell | Typ | Preis pro 1 Mio. Tokens (USD) |
|---|---|---|
Gemma 4 26B | Eingabe | 0,15 $ |
Ausgabe | 0,60 $ | |
Cache-Treffer | 0,015 $ |
Modell | Typ | Beschreibung | Anfragetyp | Preis pro Mio. Tokens (USD) |
|---|---|---|---|---|
Gemini Embedding 2 (Unified Multimodal, Vorabversion) | Eingabetext | Einbettungen mit Text als Eingabe generieren | Onlineanfragen | 0,20 $ |
Batchanfragen | 0,10 $ | |||
Eingabebild | Einbettungen mit Bild als Eingabe generieren | Onlineanfragen | 0,45 $ | |
Batchanfragen | 0,225 $ | |||
Eingabevideo | Einbettungen mit Video als Eingabe generieren | Onlineanfragen | 12,00 $ | |
Batchanfragen | 6,00 $ | |||
Eingabeaudio | Einbettungen mit Audio als Eingabe generieren | Onlineanfragen | 6,50 $ | |
Batchanfragen | 3,25 $ |
*Keine Gebühren für Ausgabetokens.
Modell | Funktion | Beschreibung | Eingabe | Ausgabe | Preis (in $) |
|---|---|---|---|---|---|
multimodalembedding | Einbettungen für multimodale Attribute: Text | Einbettungen mit Text als Eingabe generieren | Text | Einbettungen | 0,0002 $ / 1,000 count |
Einbettungen für multimodale Ausdrücke: Bild | Einbettungen mit Bild als Eingabe generieren | Bild | Einbettungen | 0,0001 $ / 1 count | |
Einbettungen für multimodal: Video Plus | Video Plus | Video | Einbettungen (bis zu 15 Einbettungen pro Minute Video) | 0,002 $ / 1 count | |
Einbettungen für multimodal: Video Standard | Video – Standard | Video | Einbettungen (bis zu 8 Einbettungen pro Minute Video) | 0,001 $ / 1 count | |
Einbettungen für multimodale Ausdrücke: Video – Grundlagen | Video Essentials | Video | Einbettungen (bis zu 4 Einbettungen pro Minute Video) | 0,0005 $ / 1 count |
Open-Source-Modell | Typ | Anfragetyp | Preis pro Mio. Tokens (USD) |
|---|---|---|---|
multilingual-e5-small | Eingabe | Onlineanfragen | 0,015 $ |
Ausgabe | Onlineanfragen | Kostenlos | |
Batch-Eingabe | Batchanfragen | 0,0075 $ | |
Batch-Ausgabe | Batchanfragen | Kostenlos | |
multilingual-e5-large | Eingabe | Onlineanfragen | 0,025 $ |
Ausgabe | Onlineanfragen | Kostenlos | |
Batch-Eingabe | Batchanfragen | 0,0125 $ | |
Batch-Ausgabe | Batchanfragen | Kostenlos |
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Die generative KI in der Agent Platform wird nach 1.000 Zeichen Eingabe (Prompt) und 1.000 Zeichen Ausgabe (Antwort) abgerechnet. Alle Zeichen werden durch UTF-8-Codepunkte gezählt. Leerzeichen werden nicht berücksichtigt. Während der Vorschauphase werden Gebühren zu 100% reduziert. Vorhersageanfragen, die zu gefilterten Antworten führen, werden nur für die Eingabe abgerechnet. Am Ende jedes Abrechnungszeitraums werden Brüche von einem Cent (0,01 $) auf einen Cent aufgerundet.
Hinweis: Die Preise für Vorhersagen für fein abgestimmte Modellendpunkte sind dieselben wie für das Basis-Foundation Model.
Modell | Typ | Region | Anfragetyp | Preis pro 1.000 Tokens (USD) |
|---|---|---|---|---|
Codey für Codevervollständigung | Eingabe | Global | Onlineanfragen | 0,00025 $ |
Ausgabe | Global | Onlineanfragen | 0,0005 $ |
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Verwenden Sie die Agent Platform API und das Translation LLM, um Text zu übersetzen. LLM-Übersetzungen klingen flüssiger und natürlicher als Übersetzungen mit klassischen Modellen, unterstützen aber weniger Sprachen (Weitere Informationen).
Modell | Methode | Nutzung | Preis pro 1 Mio. Tokens (USD) |
|---|---|---|---|
LLM | Anzahl der Eingabezeichen pro Monat | 10,00 $ | |
Anzahl der Ausgabetextzeichen pro Monat | 10,00 $ | ||
Translation LLM 002 | Anzahl der Eingabezeichen pro Monat | 20,00 $ | |
Anzahl der Ausgabetextzeichen pro Monat | 20,00 $ |
Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* Der Preis gilt pro Zeichen, das vom Modell verarbeitet wird. Weitere Informationen zu den gezählten Zeichen finden Sie unter Berechnete Zeichen.
Diese Tabelle enthält die Preise für den Kontext-Cache-Speicher basierend auf der Eingabe (Text, Bild, Video, Audio).
Modell | Preis Tok/Std. <= 200.000 Eingabetokens | Preis Tok/Std. > 200.000 Eingabetokens |
|---|---|---|
Gemini 3.1. Pro | 0,0000045 $ | 0,0000045 $ |
Gemini 3.8 Flash Cyber, Gemini 3.8 Flash, Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3 Flash | 0,000001 $ | 0,000001 $ |
Gemini 3.5 Flash Lite, Gemini 3.1 Flash Lite | 0,000001 $ | 0,000001 $ |
Gemini 3 Pro | 0,0000045 $ | 0,0000045 $ |
Gemini 2.5 Pro | 0,0000045 $ | 0,0000045 $ |
Gemini 2.5 Flash | 0,000001 $ | 0,000001 $ |
Gemini 2.5 Flash Lite | 0,000001 $ | 0,000001 $ |
Gemini 2.0-Modelle
Modell | Typ | Speicher (M Token-Stunden) | Preis /1 (in $) |
|---|---|---|---|
Gemini 2.0 Flash | Eingabetokens | 0,000001 $ | 0,0375 $ |
Eingabeaudiotokens | 0,000001 $ | 0,25 $ | |
Ausgabetext-Tokens | – | – | |
Gemini 2.0 Flash Lite | Eingabetokens | 0,000001 $ | 0,01875 $ |
Eingabeaudiotokens | 0,000001 $ | 0,01875 $ | |
Ausgabetext-Tokens | – | – |
* Preise sind in US-Dollar ($) angegeben. Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
* PDFs werden als Bildeingabe abgerechnet, wobei eine PDF-Seite einem Bild entspricht.
* Der Endpunkt des abgestimmten Modells hat denselben Vorhersagepreis wie das Basismodell.
Preise mit Fundierung
Funktion | Preis (in $) |
|---|---|
Fundierung mit der Google Suche* | Gemini 2.0 Flash umfasst bis zu 1.500 Anfragen pro Tag ohne Aufpreis. Abgelehnte Anfragen,die das Tageslimit von 1.500 Anfragen überschreiten,werden mit 35 $ pro 1.000 Anfragen berechnet (bis zu 1 Million Anfragen pro Tag). Wenn Sie mehr als 1 Million Anfragen pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Kundenunternehmen können entscheiden, dass in der Schnittstelle ihrer Kundenanwendung keine Suchvorschläge mit fundierten Ergebnissen angezeigt werden. Dies unterliegt jedoch einer alternativen Preisgestaltung. Wenden Sie sich an Ihr Google Cloud-Account-Management-Team, um diese Ausnahme zu beantragen. |
Webfundierung für Unternehmen* | 45 $ pro 1.000 Anfragen (bis zu 1 Million Anfragen pro Tag) ab dem 5. Mai 2025. Wenn Sie mehr als 1 Million Anfragen pro Tag benötigen, wenden Sie sich bitte an Ihr Account-Management-Team. Kundenunternehmen können entscheiden, dass in der Schnittstelle ihrer Kundenanwendung keine Suchvorschläge mit fundierten Ergebnissen angezeigt werden. Dies unterliegt jedoch einer alternativen Preisgestaltung. Wenden Sie sich an Ihr Google Cloud-Account-Management-Team, um diese Ausnahme zu beantragen. |
* Dies gilt für modalitätsbasierte Preise.
Hinweis: Die Verankerung mit der Google Suche wird nur für Anfragen abgerechnet, die Ergebnisse mit mindestens einer URL zur Verankerungsunterstützung aus dem Web zurückgeben. Es fallen auch die üblichen Gebühren für die Nutzung von Gemini-Modellen an.
Bereitgestellter Durchsatz sichert den Durchsatz für Ihre Anforderungen an generative KI und wird über Maßeinheiten für generative KI (GSUs) abgerechnet. Hier erfahren Sie mehr darüber, wie viel Durchsatz jede GSU bietet, und hier finden Sie unseren Online-Schätzer.
Dauer | Globaler Preis pro GSU (in USD) | Nicht globaler*Preis pro GSU (USD) |
|---|---|---|
1 Woche | 7,14 $ | 7,854 $ |
1 Monat | 3,698630137 $ | 4,068493151 $ |
3 Monate | 3,287671233 $ | 3,616438356 $ |
Zusicherung für 1 Jahr | 2,739726027 $ | 3,01369863 $ |
* Für andere Endpunkte als den globalen Endpunkt treten die Preise für die allgemein verfügbaren Gemini 3-Modellfamilien und neuere Familien aller Google-Modelle am 1. Juli 2026 in Kraft. Vor dem 1. Juli 2026 gilt der Preis für den globalen Endpunkt auch für andere Endpunkte.
Beispiel für die Kostenberechnung
Ein Nutzer muss sicherstellen,dass er 10 Abfragen pro Sekunde (QPS) einer Abfrage mit einer Eingabe von 1.000 Text-Tokens und 500 Audio-Tokens unterstützen und eine Ausgabe von 300 Text-Tokens mit gemini-2.0-flash erhalten kann.
Anhand der Tabelle für Durchsatz und Verbrauchsrate wissen wir, dass die Verbrauchsrate für ein Eingabetext-Token bei gemini-2.0-flash 1 Token, für ein Eingabeaudio-Token 7 Tokens und für ein Ausgabetext-Token 4 Tokens beträgt.
Die Gesamtzahl der Eingabetokens des Nutzers beträgt 1.000* (1 Token pro Eingabetexttoken) + 500* (7 Tokens pro Eingabeaudiotoken) = 4.500 bereinigte Eingabetokens. Die Gesamtzahl der Ausgabetokens des Nutzers beträgt 300* (4 Tokens pro Ausgabetext-Token) = 1.200 bereinigte Ausgabetokens. Das ergibt 4.500 Tokens für die Eingabe nach dem Burndown und 1.200 Tokens für die Ausgabe nach dem Burndown, also insgesamt 5.700 Tokens pro Abfrage.
Wenn wir die Gesamtzahl der Tokens pro Abfrage mit der QPS multiplizieren, erhalten wir 5.700 Tokens pro Abfrage * 10 QPS = 57.000 Tokens pro Sekunde.
Wenn wir dies durch den Gesamtdurchsatz pro Sekunde und GSU teilen,erhalten wir 57.000 Gesamt-Tokens pro Sekunde ÷ 3.360 Durchsatz pro Sekunde und GSU = 16,96 GSUs. Die Mindestkaufsteigerung für dieses Modell beträgt 1, sodass der Nutzer 17 GSUs benötigt.
Wenn der Nutzer diesen Durchsatz eine Woche lang aufrechterhalten möchte, würde das 1.200 $ * 17 GSUs = 20.400 $ pro Woche kosten. Wenn sie diesen Durchsatz einen Monat lang aufrechterhalten wollten, würde das 2.700 $ × 17 GSUs = 45.900 $ pro Monat kosten. Wenn sie diesen Durchsatz drei Monate lang aufrechterhalten wollten, würde das 2.400 $ × 17 GSUs = 40.800 $ pro Monat kosten. Und wenn sie diesen Durchsatz ein Jahr lang aufrechterhalten wollten, würde das 2.000 $ × 17 GSUs = 34.000 $ pro Monat kosten.
50% Guthaben auf die Nutzung von bereitgestelltem Durchsatz für Gemini 3.8 Flash, Gemini 3.7 Flash und Gemini 3.6 Flash
Vom 13. August 2026 bis zum 31. Dezember 2026 gewährt Google Cloud monatlich ein Abrechnungsguthaben in Höhe von 50% der Nettoausgaben für bereitgestellten Durchsatz für die Modelle Gemini 3.8 Flash, Gemini 3.7 Flash und Gemini 3.6 Flash.
Dieser Betrag wird automatisch in monatlichen Rechnungen ausgewiesen und hat keine Auswirkungen auf die Konfigurationen des bereitgestellten Durchsatzes oder die Abbaugeschwindigkeit des Zusicherungsrabatts.
Die Gutschriften gelten für die On-Demand-SKUs von Gemini 3.8 Flash, Gemini 3.7 Flash und Gemini 3.6 Flash sowie für die SKUs mit bereitgestelltem Durchsatz für alle Modelle. Guthaben wird am 7. Tag jedes Monats nach dem Abrechnungszeitraum ausgestellt und verfällt 30 Tage nach der Ausstellung gemäß den Google Cloud-Guthaben-Nutzungsbedingungen. Die Ausgaben für den ersten Monat werden ausschließlich für die aktive Nutzung zwischen dem 13. und dem 31. August 2026 anteilig berechnet.
Die Modellabstimmung ist eine effektive Methode, um große Modelle an Ihre Aufgaben anzupassen. Dies ist ein wichtiger Schritt, um die Qualität und Effizienz des Modells zu verbessern. Die Modellabstimmung bietet folgende Vorteile:
Die Anzahl der Trainings-Tokens wird berechnet, indem die Gesamtzahl der Tokens in Ihrem Trainings-Dataset mit der Anzahl der Epochen multipliziert wird.
Modell | Typ | Preis (in $) |
|---|---|---|
Gemini 3.5 Flash Lite | Überwachte Feinabstimmung | 0,003 $ / 1,000 count |
Gemini 3.5 Flash | Überwachte Feinabstimmung Abstimmung für Reinforcement Learning | 0,01 $ / 1,000 count |
Gemini 3.1 Flash Lite | Überwachte Feinabstimmung | 0,003 $ / 1,000 count |
Gemini 2.5 Pro | Überwachte Feinabstimmung | 0,025 $ / 1,000 count |
Gemini 2.5 Flash | Überwachte Feinabstimmung Präferenzabstimmung | 0,005 $ / 1,000 count |
Gemini 2.5 Flash Lite | Überwachte Feinabstimmung Präferenzabstimmung | 0,0015 $ / 1,000 count |
Gemma 3 1B IT | Überwachte Feinabstimmung | 0,47 $ / 1,000,000 count |
Gemma 3 4B IT | Überwachte Feinabstimmung | 1,14 $ / 1,000,000 count |
Gemma 3 12B IT | Überwachte Feinabstimmung | 1,82 $ / 1,000,000 count |
Gemma 3 27B IT | Überwachte Feinabstimmung | 6,83 $ / 1,000,000 count |
Medgemma 1.5 4B IT | Überwachte Feinabstimmung | 1,14 $ / 1,000,000 count |
Llama 3.1 8B | Überwachte Feinabstimmung | 0,67 $ / 1,000,000 count |
Llama 3.2 1B | Überwachte Feinabstimmung | 0,28 $ / 1,000,000 count |
Llama 3.2 3B | Überwachte Feinabstimmung | 0,61 $ / 1,000,000 count |
Llama 3.3 70B | Überwachte Feinabstimmung | 6,72 $ / 1,000,000 count |
Llama 4 Scout 17B 16E | Überwachte Feinabstimmung | 5,77 $ / 1,000,000 count |
Qwen 3 4B | Überwachte Feinabstimmung | 1,35 $ / 1,000,000 count |
Qwen 3 8B | Überwachte Feinabstimmung | 4,18 $ / 1,000,000 count |
Qwen 3 14B | Überwachte Feinabstimmung | 8,46 $ / 1,000,000 count |
Qwen 3 32B | Überwachte Feinabstimmung | 6,57 $ / 1,000,000 count |
* Für die Modellinferenz ab Gemini 3 kostet die Vorhersage über einen Endpunkt für ein abgestimmtes Modell das 1, 5‑Fache des Basismodells. Der Preis für Vorhersagen mit alten Gemini-Modellen bleibt derselbe wie für das Basismodell.
Sonderfall: Abrechnung nach Zeichen
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Translation LLM 002 | Überwachte Feinabstimmung | 6,25 $ |
Partnermodelle sind eine ausgewählte Liste generativer KI-Modelle, die von Google-Partnern entwickelt wurden. Partnermodelle werden als verwaltete APIs angeboten. Weitere Informationen finden Sie unter Übersicht über Partnermodelle. In den folgenden Abschnitten finden Sie Preisinformationen zu Google-Partnermodellen.
Modelle mit regionalen Preisen
Modell | Typ | Preis (/1M Tokens) =< 200.000 Eingabetokens * | Preis (/1 Mio. Tokens) > 200.000 Eingabetokens * | Preis (/1 Mio. Tokens) =< 100.000 Eingabetokens ** | Preis (/1 Mio. Tokens) > 100.000 Eingabetokens ** |
|---|---|---|---|---|---|
Claude Haiku 5.5 | Eingabe | 0,10 $ | 0,50 $ | ||
Ausgabe | 0,50 $ | 2,50 $ | |||
Batch-Eingabe | 0,05 $ | ||||
Batch-Ausgabe | 0,25 $ | ||||
5 Min. In Cache schreiben | 0,125 $ | 0,625 $ | |||
1 Std. Cache-Schreibvorgang | 0,20 $ | 1,00 $ | |||
Cache-Treffer | 0,01 $ | 0,05 $ | |||
5 Min. Batch-Cache-Schreibvorgang | $0.0625 | ||||
1 Std. Batch-Cache-Schreibvorgang | 0,10 $ | ||||
Batch Cache Hit | 0,005 USD | ||||
Sonnet 5.5 | Eingabe | 2,00 $ | 2,00 $ | ||
Ausgabe | 10,00 $ | 10,00 $ | |||
Batch-Eingabe | 1,00 $ | ||||
Batch-Ausgabe | 5,00 $ | ||||
5 Min. In Cache schreiben | 2,50 $ | 2,50 $ | |||
1 Std. Cache-Schreibvorgang | 4,00 $ | 4,00 $ | |||
Cache-Treffer | 0,10 $ | 0,10 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 1,25 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 2,00 $ | ||||
Batch Cache Hit | 0,05 $ | ||||
Opus 5.5 | Eingabe | 4,00 $ | |||
Ausgabe | 20,00 $ | 20,00 $ | |||
Batch-Eingabe | 2,50 $ | ||||
Batch-Ausgabe | 12,50 € | ||||
5 Min. In Cache schreiben | 5,00 $ | 5,00 $ | |||
1 Std. Cache-Schreibvorgang | 8,00 $ | 8,00 $ | |||
Cache-Treffer | 0,20 $ | 0,20 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 2,50 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 4,00 $ | ||||
Batch Cache Hit | 0,10 $ | ||||
Opus 5 | Eingabe | 5,00 $ | 5,00 $ | ||
Ausgabe | 25,00 $ | 25,00 $ | |||
Batch-Eingabe | 2,50 $ | ||||
Batch-Ausgabe | 12,50 € | ||||
5 Min. In Cache schreiben | 6,25 $ | 6,25 $ | |||
1 Std. Cache-Schreibvorgang | 10,00 $ | 10,00 $ | |||
1 Std. Cache-Schreibvorgang | 10,00 $ | 10,00 $ | |||
Cache-Treffer | 0,50 $ | 0,50 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 5,00 $ | ||||
Batch Cache Hit | 0,25 $ | ||||
Claude Sonnet 5 | Eingabe | 2,00 $ | 2,00 $ | ||
Ausgabe | 10,00 $ | 10,00 $ | |||
Batch-Eingabe | 1,00 $ | 1,00 $ | |||
Batch-Ausgabe | 5,00 $ | 5,00 $ | |||
5 Min. In Cache schreiben | 2,50 $ | 2,50 $ | |||
1 Std. Cache-Schreibvorgang | 4,00 $ | 4,00 $ | |||
Cache-Treffer | 0,20 $ | 0,20 $ | |||
Claude Fable 5.1 | Eingabe | 10,00 $ | 10,00 $ | ||
Ausgabe | 50,00 $ | 50,00 $ | |||
Batch-Eingabe | 5,00 $ | ||||
Batch-Ausgabe | 25,00 $ | ||||
5 Min. In Cache schreiben | 12,50 € | 12,50 € | |||
1 Std. Cache-Schreibvorgang | 20,00 $ | 20,00 $ | |||
Cache-Treffer | 0,25 $ | 0,25 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 6,25 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 10,00 $ | ||||
Batch Cache Hit | 0,125 $ | ||||
Claude Fable 5 | Eingabe | 10,00 $ | 10,00 $ | ||
Ausgabe | 50,00 $ | 50,00 $ | |||
Batch-Eingabe | 5,00 $ | ||||
Batch-Ausgabe | 25,00 $ | ||||
5 Min. In Cache schreiben | 12,50 € | 12,50 € | |||
1 Std. Cache-Schreibvorgang | 20,00 $ | 20,00 $ | |||
Cache-Treffer | 1,00 $ | 1,00 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 6,25 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 10,00 $ | ||||
Batch Cache Hit | 0,50 $ | ||||
Claude Opus 4.8 | Eingabe | 5,00 $ | 5,00 $ | ||
Ausgabe | 25,00 $ | 25,00 $ | |||
Batch-Eingabe | 2,50 $ | ||||
1 Std. Cache-Schreibvorgang | 10,00 $ | ||||
Batch-Ausgabe | 12,50 € | ||||
5 Min. In Cache schreiben | 6,25 $ | 6,25 $ | |||
1 Std. Cache-Schreibvorgang | 10,00 $ | 10,00 $ | |||
Cache-Treffer | 0,50 $ | 0,50 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 5,00 $ | ||||
Batch Cache Hit | 0,25 $ | ||||
Claude Opus 4.7 | Eingabe | 5,00 $ | 5,00 $ | ||
Ausgabe | 25,00 $ | 25,00 $ | |||
Batch-Eingabe | 2,50 $ | ||||
Batch-Ausgabe | 12,50 € | ||||
5 Min. In Cache schreiben | 6,25 $ | 6,25 $ | |||
1 Std. Cache-Schreibvorgang | 10,00 $ | 10,00 $ | |||
Cache-Treffer | 0,50 $ | 0,50 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 5,00 $ | 5,00 $ | |||
Batch Cache Hit | 0,25 $ | ||||
Claude Opus 4.6 | Eingabe | 5,00 $ | 5,00 $ | ||
Ausgabe | 25,00 $ | 25,00 $ | |||
Batch-Eingabe | 2,50 $ | ||||
Batch-Ausgabe | 12,50 € | ||||
5 Min. In Cache schreiben | 6,25 $ | 6,25 $ | |||
1 Std. Cache-Schreibvorgang | 10,00 $ | 10,00 $ | |||
Cache-Treffer | 0,50 $ | 0,50 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 5,00 $ | ||||
Batch Cache Hit | 0,25 $ | ||||
Claude Opus 4.5 | Eingabe | 5,00 $ | |||
Ausgabe | 25,00 $ | ||||
Batch-Eingabe | 2,50 $ | ||||
Batch-Ausgabe | 12,50 € | ||||
5 Min. In Cache schreiben | 6,25 $ | ||||
Cache-Treffer | 0,50 $ | ||||
5 Min. Batch-Cache-Schreibvorgang | 3,125 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 5,00 $ | ||||
Batch Cache Hit | 0,25 $ | ||||
Claude 4.6 Sonnet | Eingabe | 3,00 $ | 3,00 $ | ||
Ausgabe | 15,00 $ | 15,00 $ | |||
Batch-Eingabe | 1,50 $ | ||||
Batch-Ausgabe | 7,50 $ | ||||
5 Min. In Cache schreiben | 3,75 $ | 3,75 $ | |||
1 Std. Cache-Schreibvorgang | 6,00 $ | 6,00 $ | |||
Cache-Treffer | 0,30 $ | 0,30 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 1,88 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 3,00 $ | ||||
Batch Cache Hit | 0,15 $ | ||||
Claude Sonnet 4.5 | Eingabe | 3,00 $ | 6,00 $ | ||
Ausgabe | 15,00 $ | 22,50 $ | |||
Batch-Eingabe | 1,50 $ | ||||
Batch-Ausgabe | 7,50 $ | ||||
5 Min. In Cache schreiben | 3,75 $ | 7,50 $ | |||
1 Std. Cache-Schreibvorgang | 6,00 $ | $ 12,00 | |||
Cache-Treffer | 0,30 $ | 0,60 $ | |||
5 Min. Batch-Cache-Schreibvorgang | 1,88 $ | ||||
1 Std. Batch-Cache-Schreibvorgang | 3,00 $ | ||||
Batch Cache Hit | 0,15 $ | ||||
5 Min. Batch-Cache-Schreibvorgang | 1,00 $ | ||||
Claude Haiku 4.5 | Eingabe | 1,00 $ | |||
Ausgabe | 5,00 $ | ||||
Batch-Eingabe | 0,50 $ | ||||
Batch-Ausgabe | 2,50 $ | ||||
5 Min. In Cache schreiben | 1,25 $ | ||||
Batch Cache Hit | 0,05 $ | ||||
1 Std. Cache-Schreibvorgang | 2,00 $ | ||||
Cache-Treffer | 0,10 $ | ||||
5 Min. Batch-Cache-Schreibvorgang | 0,625 $ |
* Wenn der Kontext einer Abfrageeingabe 200.000 Tokens oder mehr umfasst, werden alle Tokens (Eingabe und Ausgabe) zu den Tarifen für lange Kontexte abgerechnet.
** Wenn der Kontext einer Abfrageeingabe länger als oder gleich 100.000 Tokens ist, werden alle Tokens (Eingabe und Ausgabe) zu den Preisen für langen Kontext berechnet.
Preise für Tools
Tool | Preis (in $) |
|---|---|
Websuchanfrage | 10 $ pro 1.000 Suchanfragen Unterstützte Modelle: Claude Haiku 4.5, Claude Sonnet 4.5, Claude Sonnet 4.6, Claude Sonnet 4, Claude Opus 4, Claude Opus 4.5 und Claude Opus 4.6. |
* Wenn der Kontext einer Abfrageeingabe 200.000 Tokens oder mehr umfasst, werden alle Tokens (Eingabe und Ausgabe) zu den Tarifen für lange Kontexte abgerechnet.
Modell | Typ | Preis (/1M Tokens) =< 200K Eingabetokens | Preis (/1M Tokens) > 200.000 Eingabetokens |
|---|---|---|---|
Grok 4.7 | Eingabe | 2,00 $ | 4,00 $ |
Ausgabe | 6,00 $ | $ 12,00 | |
Cache-Treffer | 0,50 $ | 1,00 $ | |
Grok 4.6 | Eingabe | 2,00 $ | 4,00 $ |
Ausgabe | 6,00 $ | $ 12,00 | |
Cache-Treffer | 0,50 $ | 1,00 $ | |
Grok 4.20 Reasoning | Eingabe | 1,25 $ | 2,50 $ |
Ausgabe | 2,50 $ | 5,00 $ | |
Cache-Treffer | 0,20 $ | 0,40 $ | |
Grok 4.20 Non-Reasoning | Eingabe | 1,25 $ | 2,50 $ |
Ausgabe | 2,50 $ | 5,00 $ | |
Cache-Treffer | 0,20 $ | 0,40 $ | |
Grok 4.3 | Eingabe | 1,25 $ | 2,50 $ |
Ausgabe | 2,50 $ | 5,00 $ | |
Cache-Treffer | 0,20 $ | 0,40 $ |
* Wenn der Kontext einer Abfrageeingabe länger als 200.000 Tokens ist, werden alle Tokens zu den Preisen für lange Kontexte berechnet.
Modell | Typ | Preis pro Mio. Tokens (USD) |
|---|---|---|
Grok 4.1 Fast Reasoning | Eingabe | 0,20 $ |
Ausgabe | 0,50 $ | |
Cache-Treffer | 0,05 $ | |
Grok 4.1 Fast Non-Reasoning | Eingabe | 0,20 $ |
Ausgabe | 0,50 $ | |
Cache-Treffer | 0,05 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
DeepSeek-V3.1 | Eingabe | 0,60 $ |
Ausgabe | 1,70 $ | |
Cache-Treffer | 0,06 $ | |
Batch-Eingabe | 0,30 $ | |
Batch-Ausgabe | 0,85 $ | |
DeepSeek-V3.2 | Eingabe | 0,56 $ |
Ausgabe | 1,68 $ | |
Cache-Treffer | 0,056 $ | |
Batch-Eingabe | 0,28 $ | |
Batch-Ausgabe | 0,84 $ | |
DeepSeek-R1 (0528) | Eingabe | 1,35 $ |
Ausgabe | 5,40 $ | |
Batch-Eingabe | 0,675 $ | |
Batch-Ausgabe | 2,70 $ | |
DeepSeek-OCR | Eingabe | 0,30 $ |
Ausgabe | 1,20 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
MiniMax-M2 | Eingabe | 0,30 $ |
Ausgabe | 1,20 $ | |
Cache-Treffer | 0,03 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Kimi-K2-Thinking | Eingabe | 0,60 $ |
Ausgabe | 2,50 $ | |
Cache-Treffer | 0,06 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Qwen3-Next-80B-Thinking | Eingabe | 0,15 $ |
Ausgabe | 1,20 $ | |
Qwen3-Next-80B-Instruct | Eingabe | 0,15 $ |
Ausgabe | 1,20 $ | |
Qwen3-Coder-480B-A35B-Instruct | Eingabe | 0,22 $ |
Ausgabe | 1,80 $ | |
Cache-Treffer | 0,022 $ | |
Batch-Eingabe | 0,11 $ | |
Batch-Ausgabe | 0,90 $ | |
Qwen3-235B-A22B-Instruct-2507 | Eingabe | 0,22 $ |
Ausgabe | 0,88 $ | |
Batch-Eingabe | 0,11 $ | |
Batch-Ausgabe | 0,44 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
GLM-4.7 | Eingabe | 0,60 $ |
Ausgabe | 2,20 $ | |
Cache-Treffer | 0,06 $ | |
GLM-5 | Eingabe | 1,00 $ |
Ausgabe | 3,20 $ | |
Cache-Treffer | 0,10 $ | |
GLM-5.2 | Eingabe | 1,40 $ |
Ausgabe | 4,40 $ | |
Eingabe im Cache: | 0,14 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
gpt-oss-120b | Eingabe | 0,09 $ |
Ausgabe | 0,36 $ | |
Batch-Eingabe | 0,045 $ | |
Batch-Ausgabe | 0,18 $ | |
gpt-oss-20b | Eingabe | 0,07 $ |
Ausgabe | 0,25 $ | |
Cache-Treffer | 0,007 $ | |
Batch-Eingabe | 0,035 $ | |
Batch-Ausgabe | 0,125 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Llama 3.3 70B | Eingabe | 0,72 $ |
Ausgabe | 0,72 $ | |
Batch-Eingabe | 0,36 $ | |
Batch-Ausgabe | 0,36 $ | |
Llama 4 Scout | Eingabe | 0,25 $ |
Ausgabe | 0,70 $ | |
Batch-Eingabe | 0,125 $ | |
Batch-Ausgabe | 0,35 $ | |
Llama 4 Maverick | Eingabe | 0,35 $ |
Ausgabe | 1,15 $ | |
Batch-Eingabe | 0,175 $ | |
Batch-Ausgabe | 0,575 $ |
Modell | Typ | Preis /1M (USD) |
|---|---|---|
Mistral OCR (25.05) | Eingabe | 0,0005 $ (oder 0,0005 $/Seite) |
Ausgabe | 0,0005 $ (oder 0,0005 $/Seite) | |
Mistral Medium 3 | Eingabe | 0,40 $ |
Ausgabe | 2,00 $ | |
Mistral Small 3.1 (25.03) | Eingabe | 0,10 $ |
Ausgabe | 0,30 $ | |
Codestral 2 | Eingabe | 0,30 $ |
Ausgabe | 0,90 $ |