I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
Ti vengono addebitati solo i costi delle richieste che restituiscono un codice di risposta 200. Le richieste che restituiscono altri codici di risposta, come i codici 4xx e 5xx, non vengono addebitate per l'input o l'output.
In questa pagina vengono illustrati i prezzi dell'AI generativa su Agent Platform. Per tutti gli altri prezzi di Agent Platform, inclusi i servizi ML Platform e MLOps, fai riferimento alla pagina dei prezzi di Agent Platform.
I piani di risparmio flessibili (FSP) sono sconti per impegno di utilizzo basati sulla spesa che ti aiutano a risparmiare sull'utilizzo dei prodotti idonei su Google Cloud. Per ulteriori informazioni sul funzionamento degli FSP e sui prodotti idonei, vedi Piani di risparmio flessibili.
Modello | Tipo | Regione | Prezzo (per 1 M di token) <= 200.000 token di input | Prezzo (/1 M di token) > 200.000 token di input | Prezzo (per 1 M di token) <= 200.000 token di input memorizzati nella cache | Prezzo (per 1 M di token) > 200.000 token di input memorizzati nella cache |
|---|---|---|---|---|---|---|
Gemini 3.1 Pro (anteprima) | Input (testo, immagine, video, audio) | Globale | 2,00 USD | 4,00 USD | 0,20 USD | 0,40 USD |
Output di testo (risposta e ragionamento) | Globale | 12,00 USD | 18,00 USD | N/A | N/A | |
Gemini 3.5 Flash | Input (testo, immagine, video, audio) | Globale | 1,50 USD | 1,50 USD | 0,15 USD | 0,15 USD |
Non globale* | 1,65 USD | 1,65 USD | 0,165 USD | 0,165 USD | ||
Output di testo (risposta e ragionamento) | Globale | 9,00 USD | 9,00 USD | N/A | N/A | |
Non globale* | 9,90 USD | 9,90 USD | N/A | N/A | ||
Gemini 3.6 Flash | Input (testo, immagine, video, audio) | Globale | 1,50 USD | 1,50 USD | 0,15 USD | 0,15 USD |
Output di testo (risposta e ragionamento) | Globale | 7,50 USD | 7,50 USD | N/A | N/A | |
Gemini 3.5 Flash-Lite | Input (testo, immagine, video, audio) | Globale | 0,30 USD | 0,30 USD | 0,03 USD | 0,03 USD |
Non globale* | 0,33 USD | 0,33 USD | 0,033 USD | 0,033 USD | ||
Output di testo (risposta e ragionamento) | Globale | 2,50 USD | 2,50 USD | N/A | N/A | |
Non globale* | 2,75 USD | 2,75 USD | N/A | N/A | ||
Gemini 3 Flash (anteprima) | Input (testo, immagine, video) | Globale | 0,50 USD | 0,50 USD | 0,05 USD | 0,05 USD |
Input (audio) | Globale | 1,00 USD | 1,00 USD | 0,10 USD | 0,10 USD | |
Output di testo (risposta e ragionamento) | Globale | 3,00 USD | 3,00 USD | N/A | N/A | |
Gemini 3.1 Flash-Lite | Input (testo, immagine, video) | Globale | 0,25 USD | 0,25 USD | 0,025 USD | 0,025 USD |
Non globale* | 0,275 USD | 0,275 USD | 0,0275 USD | 0,0275 USD | ||
Input (audio) | Globale | 0,50 USD | 0,50 USD | 0,05 USD | 0,05 USD | |
Non globale* | 0,55 USD | 0,55 USD | 0,055 USD | 0,055 USD | ||
Output di testo (risposta e ragionamento) | Globale | 1,50 USD | 1,50 USD | N/A | N/A | |
Non globale* | 1,65 USD | 1,65 USD | N/A | N/A | ||
Immagine Gemini 3.1 Flash-Lite (Nano Banana 2 Lite) | Input (testo, immagine, video) | Globale | 0,25 USD | N/A | 0,025 USD | N/A |
Output di testo (risposta e ragionamento) | Globale | 1,50 USD | N/A | N/A | N/A | |
Output di immagini**** | Globale | 30,00 USD | N/A | N/A | N/A | |
Gemini 3.1 Flash Image (Nano Banana 2) | Input (testo, immagine, video) | Globale | 0,50 USD | N/A | 0,05 USD | N/A |
Output di testo (risposta e ragionamento) | Globale | 3,00 USD | N/A | N/A | N/A | |
Output immagine*** | Globale | 60,00 USD | N/A | N/A | N/A | |
Immagine di Gemini 3 Pro (Nano Banana Pro) | Input (testo, immagine) | Globale | 2,00 USD | N/A | $ 0,20 | N/A |
Output di testo (risposta e ragionamento) | Globale | 12,00 $ | N/A | N/A | N/A | |
Output di immagini** | Globale | 120,00 USD | N/A | N/A | N/A |
Prezzi con grounding
Funzionalità | Utilizzo | Prezzo (USD) |
|---|---|---|
Grounding con la Ricerca Google e Grounding web per aziende | Include 5000 query di grounding al mese senza costi, aggregate su tutti i modelli Gemini 3. Le query di grounding che superano questi limiti vengono fatturate a 14$per 1000 query di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno. Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini esegue una o più query su un indice web di Google (ciascuna delle quali è una "query di grounding") . Ti verrà addebitato il costo di ogni singola query di grounding eseguita. La fatturazione inizierà il 5 gennaio 2026. I token di input forniti da grounding con la Ricerca Google o Web Grounding for Enterprise non vengono addebitati. I clienti possono decidere di non mostrare i suggerimenti di ricerca con risultati fondati nelle loro applicazioni cliente al prezzo standard per meno di 1 milione di prompt di grounding al giorno. | 0 count to 5,000 count 0,00 USD (Free) 5,000 count and above 14,00 USD |
Grounding con Google Maps | Include 5000 query di ricerca al mese senza costi, aggregate su tutti i modelli Gemini 3. Le query Maps che superano questi limiti vengono fatturate a 14 $per 1000 query. Una richiesta inviata da un cliente a Gemini può generare una o più query a Google Maps. Ti verrà addebitato un costo per ogni singola query eseguita. La fatturazione inizierà il 5 gennaio 2026 I token di input forniti da Google Maps non vengono addebitati. | 0 count to 5,000 count 0,00 USD (Free) 5,000 count and above 14,00 USD |
Grounding con i tuoi dati | 2,50 $ per 1000 prompt. | 2,50 USD |
Strumento per l'uso del computer | Il prezzo si basa sul numero totale di token di input inviati al modello e sui token di output risultanti generati. I prezzi dei token si basano sul rispettivo modello utilizzato. A partire da Gemini 3.5, le dichiarazioni di funzione sono incluse nel conteggio dei token di input. Per ulteriori dettagli, consulta la documentazione. |
* Per gli endpoint non globali, i prezzi entreranno in vigore per le famiglie di modelli Gemini 3 e successive disponibili a livello generale il 1° luglio 2026. Prima del 1° luglio 2026, i prezzi degli endpoint globali si applicano agli endpoint non globali.
* Se il contesto di input di una query è più lungo di 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.
* L'endpoint del modello ottimizzato sarà 1,5 volte quello del modello di base.
** Gemini 3 Pro Image addebita 560 token per immagine di input, con costi per immagine di output che scalano in base alla risoluzione: 1120 token (0,134 $) per 1K e 2K (circa 1 MP e 4 MP) e 2000 token (0,24 $) per 4K (circa 16 MP).
*** Gemini 3.1 Flash Image addebita 1120 token per immagine di input, con costi dell'immagine di output che scalano in base alla risoluzione: 747 token (0,045 $) per 512 (circa 0,25 MP), 1120 token (0,067 $) per 1K (circa 1 MP), 1680 token (0,101 $) per 2K (circa 4 MP) e 2520 token (0,15 $) per 4K (circa 16 MP).
**** Gemini 3.1 Flash-Lite Image addebita 1120 token per immagine di input e 1120 token (0, 034 $) per 1000 immagini di output (circa 1 MP)
Modello | Tipo | Prezzo token <= 200.000 token | Prezzo > 200.000 token | Prezzo <= 200.000 token di input memorizzati nella cache | Prezzo > 200.000 token di input memorizzati nella cache |
|---|---|---|---|---|---|
Gemini 2.5 Pro | Input (testo, immagine, video, audio) | 1,25 USD | 2,50 USD | 0,125 USD | 0,25 USD |
Output di testo (risposta e ragionamento) | 10,00 USD | 15,00 USD | N/A | N/A | |
Gemini 2.5 Pro Uso del computer - Anteprima | Input (testo, immagine, video, audio) | 1,25 USD | 2,50 USD | N/A | N/A |
Output di testo (risposta e ragionamento) | 10,00 USD | 15,00 USD | N/A | N/A | |
Gemini 2.5 Flash | Input (testo, immagine, video) | 0,30 USD | 0,30 USD | 0,03 USD | 0,03 USD |
Input audio | 1,00 USD | 0,30 USD | 0,10 USD | 0,10 USD | |
Output di testo (risposta e ragionamento) | 2,50 USD | 2,50 USD | N/A | N/A | |
Gemini 2.5 Flash Image | Input (testo, immagine)*** | 0,30 USD | N/A | N/A | N/A |
Output di testo (risposta e ragionamento) | $ 2,50 | N/A | N/A | N/A | |
Output immagine*** | 30,00 USD | N/A | N/A | N/A | |
API Gemini 2.5 Flash Live | Testo di input | 0,50 USD | 0,50 $ | N/A | N/A |
Input (video, immagine) | 3,00 USD | $ 3,00 | N/A | N/A | |
Input audio | 3,00 USD | $ 3,00 | N/A | N/A | |
Output di testo | 2,00 USD | 2,00 USD | N/A | N/A | |
1 Mln di token audio di output | 12,00 USD | 12,00 $ | N/A | N/A | |
Gemini 2.5 Flash-Lite | Input (testo, immagine, video) | 0,10 USD | 0,10 $ | 0,01 USD | 0,01 $ |
Input audio | 0,30 USD | $ 0,30 | 0,03 USD | 0,03 $ | |
Output di testo (risposta e ragionamento) | 0,40 USD | 0,40 USD | N/A | N/A |
Prezzi con grounding
Funzionalità | Utilizzo | Prezzo (USD) |
|---|---|---|
Grounding con la Ricerca Google | Gemini 2.0 Flash, 2.5 Flash e 2.5 Flash-Lite includono un totale di 1500 prompt di grounding al giorno senza costi aggiuntivi. Gemini 2.5 Pro include 10.000 prompt di grounding al giorno senza costi aggiuntivi. I prompt di grounding che superano questi limiti vengono fatturati a 35$per 1000 prompt di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno. Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini esegue una o più query su un indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo prompt di grounding. | 0 count to 10,000 count 0,00 USD (Free) 10,000 count and above 35,00 USD |
Grounding web per aziende | 45$per 1000 prompt di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno. Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini effettua una o più query a un indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo costo per un prompt di grounding. | 45,00 USD |
Grounding con i tuoi dati | 2,5 $ per 1000 richieste. | 2,50 USD |
Grounding con Google Maps | 25$per 1000 prompt basati su dati. Un prompt basato su dati è una richiesta inviata a Gemini che esegue almeno una query su Google Maps. | 0 count to 1,500 count 0,00 USD (Free) 1,500 count and above 25,00 USD |
* Se il contesto di input di una query è più lungo di 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.
* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.
** Il grounding con la Ricerca Google e il grounding web per le aziende vengono fatturati solo quando un prompt di grounding restituisce correttamente le fonti (ovvero risultati contenenti almeno un URL di supporto dal web). Le tariffe di utilizzo del modello Gemini vengono applicate separatamente.
*** Un'immagine 1024x1024 consuma 1290 token (0,039 $ per 1000 immagini di output). Il numero di token per immagine varia in base alla risoluzione dell'immagine. Per maggiori informazioni su come calcolare i token, puoi consultare la nostra documentazione.
**** La fatturazione dell'utilizzo del computer utilizza lo SKU Gemini 2.5 Pro per suddividere i costi di utilizzo del computer e applicare i tag di fatturazione. Scopri di più qui.
Gemini 2.0 viene fatturato in base ai token. Per calcolare il numero di token di input nella tua richiesta prima di inviarla, puoi utilizzare il tokenizzatore SDK o l'API countTokens. Se la richiesta non va a buon fine e viene restituito un errore 400 o 500, non ti verranno addebitati i token utilizzati.
Usa l'opzione di attivazione/disattivazione nella tabella dei prezzi per confrontare i prezzi basati su token e quelli basati su modalità.
Modello | Tipo | Prezzo per 1 M di token (USD) | Prezzo per 1 M di token (USD) con l'API Batch |
|---|---|---|---|
Gemini 2.0 Flash | Testo di input | 0,15 USD | 0,075 USD |
Audio di input | 1,00 USD | 0,50 USD | |
Testo di output | 0,60 USD | 0,30 USD | |
Addestramento di ottimizzazione | 0,003 USD | ||
Generazione di immagini con Gemini 2.0 Flash | Token di input | 0,15 USD | |
Token audio di input | 1,00 USD | ||
Token video di input | 0,15 USD | ||
Token di testo di output | 0,60 USD | ||
Token immagine di output | 30,00 USD | ||
API Gemini 2.0 Flash Live | Token di testo di input | 0,50 USD | |
Token audio di input | 3,00 USD | ||
Token video/immagine di input | 3,00 USD | ||
Token di testo di output | 2,00 USD | ||
Token audio di output | 12,00 USD | ||
Gemini 2.0 Flash Lite | Token di input | 0,075 USD | 0,0375 USD |
Token audio di input | 0,075 USD | 0,0375 USD | |
Token di testo di output | 0,30 USD | 0,15 USD | |
Ottimizzazione per i token di addestramento | 0,001 USD |
* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
* I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche.
* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.
* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.
* API Gemini 2.0 Flash Live: 25 token al secondo di audio (input/output), 258 token al secondo di video (input). Il grounding con la Ricerca Google rimane senza costi mentre l'API Gemini 2.0 Flash Live è in anteprima.
Prezzo con grounding
Funzionalità | Utilizzo | Prezzo (USD) |
|---|---|---|
Grounding con la Ricerca Google*, ** | Gemini 2.0 Flash, 2.5 Flash e 2.5 Flash-Lite includono un totale di 1500 prompt di grounding al giorno senza costi aggiuntivi. Gemini 2.5 Pro include 10.000 prompt di grounding al giorno senza costi aggiuntivi. I prompt di grounding che superano questi limiti vengono fatturati a 35$per 1000 prompt di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno. Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini esegue una o più query su un indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo prompt di grounding. | 0 count to 10,000 count 0,00 USD (Free) 10,000 count and above 35,00 USD |
Grounding web per aziende*, ** | 45$per 1000 prompt di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno. Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini effettua una o più query a un indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo costo per un prompt di grounding. | 45,00 USD |
Grounding con i tuoi dati* | 2,5 $ per 1000 richieste. | 2,50 USD |
Grounding con Google Maps* | I modelli Gemini includono una serie di prompt basati a terra giornalieri senza costi aggiuntivi:
I prompt basati che superano questi limiti vengono fatturati a 25 $per 1000 prompt basati. Un prompt basato su dati è una richiesta inviata a Gemini che esegue almeno una query su Google Maps. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt basati su dati al giorno. | 0 count to 1,500 count 0,00 USD (Free) 1,500 count and above 25,00 USD |
* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
* I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche.
* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.
* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.
* API Gemini 2.0 Flash Live: 25 token al secondo di audio (input/output), 258 token al secondo di video (input). Il grounding con la Ricerca Google rimane senza costi mentre l'API Gemini 2.0 Flash Live è in anteprima.
** Il grounding con la Ricerca Google e il grounding web per le aziende vengono fatturati solo quando un prompt restituisce correttamente fonti (ovvero risultati contenenti almeno un URL di supporto dal web). Le tariffe di utilizzo del modello Gemini vengono applicate separatamente.
Tutti i modelli Gemini diversi da Gemini 2.0 o Gemini 2.5 vengono fatturati in base alle modalità, ad esempio caratteri, immagini, secondi di video/audio.
Gemini 1.5
Modello | Funzionalità | Tipo | Prezzo ( =< 128.000 token di input) | Prezzo ( > 128.000 token di input) |
|---|---|---|---|---|
Gemini 1.5 Flash | Multimodale | Input immagine | 0,00002 USD / 1 count | 0,00004 USD / 1 count |
Input video | 0,00002 USD / 1 count | 0,00004 USD / 1 count | ||
Immissione testo | 0,00001875 USD / 1,000 count | 0,0000375 USD / 1,000 count | ||
Input audio | 0,000002 USD / 1 count | 0,000004 USD / 1 count | ||
Output di testo | 0,000075 USD / 1,000 count | 0,00015 USD / 1,000 count | ||
Ottimizzazione* | Token di addestramento | 0,008 USD / 1,000 count | ||
Gemini 1.5 Pro | Multimodale | Input immagine | 0,00032875 USD / 1 count | 0,0006575 USD / 1 count |
Input video | 0,00032875 USD / 1 count | 0,0006575 USD / 1 count | ||
Immissione testo | 0,0003125 USD / 1,000 count | 0,000625 USD / 1,000 count | ||
Input audio | 0,00003125 USD / 1 count | 0,0000625 USD / 1 count | ||
Output di testo | 0,00125 USD / 1,000 count | 0,0025 USD / 1,000 count | ||
Ottimizzazione* | Token di addestramento | 0,08 USD / 1,000 count | ||
Gemini 1.0 Pro | Multimodale | Input immagine | 0,0025 USD / 1 count | |
Input video | 0,002 USD / 1 count | |||
Immissione testo | 0,000125 USD / 1,000 count | |||
Output di testo | 0,000375 USD / 1,000 count |
* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
* Se il contesto di una query è più lungo di 128.000, tutti i token vengono addebitati alle tariffe per contesto lungo.
* I modelli Gemini sono disponibili in modalità batch con uno sconto del 50%.
* Gemini 1.0 Pro supporta solo una finestra contestuale fino a 32.000 token.
* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.
* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.
** Il grounding con la Ricerca Google e il grounding web per le aziende vengono fatturati solo quando un prompt restituisce correttamente fonti (ovvero risultati web contenenti almeno un URL di supporto dal web). Le tariffe di utilizzo del modello Gemini vengono applicate separatamente.
Prezzi con grounding
Funzionalità | Prezzo (USD) |
|---|---|
Grounding con la Ricerca Google | 35$per 1000 prompt di ancoraggio. Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini effettua una o più query all'indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo prompt di grounding. |
Grounding web per aziende | 45$per 1000 prompt di ancoraggio. Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini effettua una o più query all'indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo prompt di grounding. |
Grounding con i tuoi dati | 2,5 $ per 1000 richieste a partire dal 16 giugno 2025. |
** Il grounding con la Ricerca Google e il grounding web per le aziende vengono fatturati solo quando un prompt restituisce correttamente fonti (ovvero risultati web contenenti almeno un URL di supporto dal web). Le tariffe di utilizzo del modello Gemini vengono applicate separatamente.
Imagen
Con Imagen su Agent Platform, puoi generare nuove immagini e modificare quelle esistenti in base ai prompt di testo che fornisci oppure modificare solo parti delle immagini utilizzando un'area di maschera che definisci insieme a una serie di altre funzionalità.
Modello | Funzionalità | Descrizione | Input | Output | Prezzo per 1 unità (USD) |
|---|---|---|---|---|---|
Imagen 4 Ultra | Generazione di immagini | Genera un'immagine | Prompt di testo | Immagine | 0,06 USD |
Imagen 4 | Upscale | Aumenta la risoluzione di un'immagine generata a 2K, 3K e 4K | Immagine | Immagine | 0,06 $ |
Imagen 4 | Generazione di immagini | Genera un'immagine | Prompt di testo | Immagine | 0,04 USD |
Imagen 4 Fast | Generazione di immagini | Genera un'immagine | Prompt di testo | Immagine | 0,02 USD |
Imagen 3 | Generazione di immagini | Genera un'immagine Modifica un'immagine Personalizza un'immagine | Prompt di testo | Immagine | 0,04 USD |
Imagen 3 Fast | Generazione di immagini | Genera un'immagine | Prompt di testo | Immagine | 0,02 USD |
Imagen 2, Imagen 1 | Generazione di immagini | Genera un'immagine | Prompt di testo | Immagine | 0,02 USD |
Imagen 2, Imagen 1 | Modifica delle immagini | Modifica un'immagine utilizzando l'approccio con o senza maschera | Prompt immagine/testo | Immagine | 0,02 USD |
Imagen 1 | Upscale | Aumenta la risoluzione di un'immagine generata a 2k e 4k | Immagine | Immagine | 0,003 USD |
Imagen 1 | Ottimizzazione | Consenti l'utilizzo di un "soggetto" fornito dall'utente nei prompt di Imagen (addestramento few-shot) | Soggetti con identificatore di testo e 4-8 immagini per soggetto | Modello ottimizzato (dopo l'addestramento con soggetti forniti dall'utente) | $ per ora nodo (prezzi dell'addestramento personalizzato di Agent Platform) |
Imagen | Didascalia visiva | Genera una didascalia di testo breve o lunga per un'immagine | Immagine | Didascalia testuale | 0,0015 USD |
Imagen | Visual Question Answering | Fornisci una risposta basata su una domanda che fa riferimento a un'immagine | Prompt immagine/testo | Risposta di testo | 0,0015 USD |
Imagen | Ricontestualizzazione del prodotto | Reimmagina i prodotti in una nuova scena | 1-3 immagini dello stesso prodotto e un prompt di testo che descrive la scena desiderata | Immagine | $ 0,12 |
Prova virtuale | Crea immagini di persone che indossano vestiti diversi | 1 immagine di una persona e 1 immagine di un capo di abbigliamento | Immagine | 0,06 USD |
I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
Veo
Modello | Funzionalità | Descrizione | Input | Output | Risoluzione di output | Prezzo (USD) |
|---|---|---|---|---|---|---|
Veo 3.1 | Generazione di video e audio | Genera video di alta qualità con effetti sonori/vocali sincronizzati da un prompt testuale o da un'immagine di riferimento | Prompt di testo/immagine | Video + audio | 720p, 1080p | 0,40 USD / 1 count |
4000 | 0,60 USD / 1 count | |||||
Generazione di video | Genera video di alta qualità da un prompt testuale o da un'immagine di riferimento | Prompt di testo/immagine | Video | 720p, 1080p | 0,20 USD / 1 count | |
4000 | 0,40 USD / 1 count | |||||
Veo 3.1 Fast | Generazione di video e audio | Genera più velocemente video con discorsi/effetti sonori sincronizzati da un prompt testuale o da un'immagine di riferimento | Prompt di testo/immagine | Video + audio | 720p | 0,10 USD / 1 count |
1080p | 0,12 USD / 1 count | |||||
4000 | 0,30 USD / 1 count | |||||
Generazione di video | Genera video da un prompt testuale o da un'immagine di riferimento più velocemente | Prompt di testo/immagine | Video | 720p | 0,08 USD / 1 count | |
1080p | 0,10 USD / 1 count | |||||
4000 | 0,25 USD / 1 count | |||||
Veo 3.1 Lite | Generazione di video e audio | Genera video con parlato/effetti sonori sincronizzati da un prompt testuale o da un'immagine di riferimento nel modo più veloce | Prompt di testo/immagine | Video + audio | 720p | 0,05 $ per conteggio |
1080p | 0,08 $ per unità | |||||
Generazione di video | Genera video da un prompt testuale o da un'immagine di riferimento nel modo più veloce | Prompt di testo/immagine | Video | 720p | 0,03 $ per conteggio | |
1080p | 0,05 $ per conteggio | |||||
Veo 3 | Generazione di video e audio | Genera video di alta qualità con effetti sonori/vocali sincronizzati da un prompt testuale o da un'immagine di riferimento | Prompt di testo/immagine | Video + audio | 720p, 1080p | 0,40 USD / 1 count |
Generazione di video | Genera video di alta qualità da un prompt testuale o da un'immagine di riferimento | Prompt di testo/immagine | Video | 720p, 1080p | 0,20 USD / 1 count | |
Veo 3 Fast | Generazione di video e audio | Genera più velocemente video con discorsi/effetti sonori sincronizzati da un prompt testuale o da un'immagine di riferimento | Prompt di testo/immagine | Video + audio | 720p | 0,10 USD / 1 count |
1080p | 0,12 USD / 1 count | |||||
Generazione di video | Genera video da un prompt testuale o da un'immagine di riferimento più velocemente | Prompt di testo/immagine | Video | 720p | 0,08 USD / 1 count | |
1080p | 0,10 USD / 1 count | |||||
Veo 2 | Generazione di video | Genera video da un prompt testuale o da un'immagine di riferimento | Prompt di testo/immagine | Video | 720p | 0,50 USD / 1 count |
Controlli avanzati | Genera video tramite interpolazione dei fotogrammi iniziale e finale, estendi i video generati e applica i controlli della fotocamera | Prompt di testo/immagine/video | Video | 720p | 0,50 USD / 1 count |
Lyria
La famiglia di modelli Lyria offre una generazione di musica di alta qualità, ideale per composizioni sofisticate ed esplorazioni creative dettagliate in cui l'output sfumato è fondamentale.
Modello | Funzionalità | Descrizione | Input | Output | Prezzo (USD) |
|---|---|---|---|---|---|
Lyria 3 Pro | Generazione di musica completa | Lyria 3 Pro crea composizioni musicali complete a partire da input multimodali come testo o immagini | Testo, immagine | Brano integrale | 0,08 USD / 1 count |
Lyria 3 | Generazione di clip musicali di 30 secondi | Lyria 3 genera clip audio di 30 secondi ad alta fedeltà da prompt di testo o immagine | Testo, immagine | Clip musicale di 30 secondi | 0,04 USD / 1 count |
Lyria 2 | Generazione di musica | Genera musica da un prompt testuale | Prompt di testo | Musica | 0,06 USD / 1 count |
Costi di incorporamento
L'API Gemini offre modelli di incorporamento per generare incorporamenti per testo, immagini, video e altri contenuti.
Modello | Tipo | Regione | Tipo di richiesta | Prezzo per 1000 caratteri (USD) |
|---|---|---|---|---|
Incorporamento di Gemini | Input | Globale | Richieste online | 0,00015 USD |
Richieste batch | 0,00012 USD | |||
Output | Globale | Richieste online | Nessun costo | |
Richieste batch | Nessun costo | |||
Incorporamenti per il testo (escluso l'incorporamento Gemini) | Input | Globale | Richieste online | 0,000025 USD |
Richieste batch | 0,00002 USD | |||
Output | Globale | Richieste online | Nessun costo | |
Richieste batch | Nessun costo |
Gemini Omni
Modello | Tipo | Prezzo token /1 Mln (USD) |
|---|---|---|
Gemini Omni Flash | Input (testo, immagine, video, audio) | 1,50 USD |
Output di testo (risposta e ragionamento) | 9,00 USD | |
Uscita video* | 17,50 USD |
* Gemini Omni Flash addebita 2040 token per immagine, 32 token per secondo di audio e 5792 token per secondo di video per l'input. Per l'output video, Gemini Omni Flash addebita 5792 per secondo di output video a 720p (con audio).
Agenti
Modello | Tipo | Prezzo (per 1 M di token) | Prezzo (per milione di token di input memorizzati nella cache) |
|---|---|---|---|
Agente Gemini Deep Research | Input (testo) | 2 $ | 0,2 $ |
Output di testo (risposta e ragionamento) | 12 $ | N/A |
Prezzi con grounding
Funzionalità | Utilizzo | Prezzo (USD) |
|---|---|---|
Grounding con la Ricerca Google e la Ricerca Immagini e Grounding web per aziende* | Include 5000 query di ricerca al mese senza costi, aggregate su tutti i modelli Gemini 3. Le query di ricerca che superano questi limiti vengono fatturate a 14 $per 1000 query di ricerca. Una richiesta inviata da un cliente a Gemini può generare una o più query alla Ricerca Google (o Web Grounding for Enterprise). Ti verrà addebitato il costo di ogni singola query di ricerca eseguita. La fatturazione inizierà il 5 gennaio 2026. I token di input forniti da grounding con la Ricerca Google o Web Grounding for Enterprise non vengono addebitati. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt basati su dati al giorno. I clienti possono decidere di non mostrare i Suggerimenti di ricerca con i Risultati fondati nell'interfaccia della loro Applicazione del Cliente al prezzo standard. | 0 count to 5,000 count 0,00 USD (Free) 5,000 count and above 14,00 USD |
Grounding con i tuoi dati | 2,50 USD |
CodeMender
Il prezzo di CodeMender si basa sui token ed è determinato dal modello utilizzato
Modello | Tipo | Prezzo del modello per 1 M di token (USD) | Prezzo di CodeMender per 1 Mln di token (USD) |
|---|---|---|---|
Gemini 3.5 Flash | Token di input | 1,50 USD | 1,50 USD |
Token memorizzati nella cache | 0,15 USD | 0,15 USD | |
Token di output | 9,00 USD | 9,00 USD | |
Gemini 3.1 Pro | Token di input | 2,00 USD | 2,00 USD |
Token memorizzati nella cache | 0,20 USD | 0,20 USD | |
Token di output | 12,00 USD | 12,00 USD | |
Gemini 3 Flash | Token di input | 0,50 USD | 0,50 USD |
Token memorizzati nella cache | 0,05 USD | 0,05 USD | |
Token di output | 3,00 USD | 3,00 USD |
Gemma
Modello | Tipo | Prezzo (/1 M di token (USD) |
|---|---|---|
Gemma 4 26B | Input | 0,15 USD |
Output | 0,60 USD | |
Successo della cache | 0,015 USD |
Agent Platform Model Optimizer semplifica l'utilizzo di Gemini per i clienti aziendali fornendo un singolo meta-endpoint per le richieste del modello Gemini: i clienti che utilizzano questo servizio non devono specificare se utilizzare Flash, Pro o una versione specifica. Invece, forniscono semplicemente un'impostazione configurabile (costo, qualità o bilanciamento) per indicare le proprie preferenze e Model Optimizer applica il livello di intelligenza appropriato per l'attività inviando ogni query al modello più adatto.
L'ottimizzatore del modello di Agent Platform applica prezzi dinamici. Ciò significa che il prezzo medio per token dipende dal livello di intelligenza del modello applicato per completare l'attività. Per questo motivo, di seguito sono riportati esempi di prezzi per illustrare scenari probabili in base all'impostazione della configurazione (vedi le tabelle di seguito). Gli SKU di Model Optimizer sono SKU da 1 $che funzionano come unità di acquisto da applicare alla fatturazione. La fatturazione avviene comunque in base al consumo dopo l'utilizzo dei modelli.
Esempio 1: chatbot con rapporto I/O 5:1
NOTA: questi intervalli non sono garantiti, i risultati dei singoli clienti possono variare
Preferenza del cliente | Token di input del cliente inviati al MO | Token di output del cliente inviati al MO | Prezzo medio di input per milione di token (intervallo alto) | Prezzo medio di output per milione di token (intervallo alto) | Prezzo medio di input per milione di token (intervallo basso) | Prezzo medio di output per milione di token (intervallo basso) |
|---|---|---|---|---|---|---|
Costo | 10.000.000 | 2.000.000 | 0,63 $ | $ 2,50 | $ 0,16 | 0,63 $ |
Bilanciato | 10.000.000 | 2.000.000 | $ 1,26 | 5,00 $ | 0,63 $ | $ 2,50 |
Qualità | 10.000.000 | 2.000.000 | 1,89 $ | $ 7,50 | $ 1,26 | 5,00 $ |
Esempio 2: Generazione di contenuti: rapporto I/O 1:20
Preferenza del cliente | Token di input del cliente inviati al MO | Token di output del cliente inviati al MO | Prezzo medio di input per milione di token (intervallo alto) | Prezzo medio di output per milione di token (intervallo alto) | Prezzo medio di input per milione di token (intervallo basso) | Prezzo medio di output per milione di token (intervallo basso) |
|---|---|---|---|---|---|---|
Costo | 1.000.000 | 20.000.000 | 0,63 $ | $ 2,50 | $ 0,16 | 0,63 $ |
Bilanciato | 1.000.000 | 20.000.000 | $ 1,26 | 5,00 $ | 0,63 $ | $ 2,50 |
Qualità | 1.000.000 | 20.000.000 | 1,89 $ | $ 7,50 | $ 1,26 | 5,00 $ |
* Model Optimizer è un'offerta sperimentale a pagamento e potrebbe instradare le richieste verso versioni sperimentali di Gemini su Agent Platform.
Embedding multimodali
Modello | Tipo | Descrizione | Tipo di richiesta | Prezzo per 1 M di token (USD) |
|---|---|---|---|---|
Gemini Embedding 2 (multimodale unificato, anteprima) | Testo di input | Genera incorporamenti utilizzando il testo come input | Richieste online | 0,20 USD |
Richieste batch | 0,10 USD | |||
Immagine di input | Genera incorporamenti utilizzando l'immagine come input | Richieste online | 0,45 USD | |
Richieste batch | 0,225 USD | |||
Video di input | Genera incorporamenti utilizzando il video come input | Richieste online | 12,00 USD | |
Richieste batch | 6,00 USD | |||
Audio di input | Genera incorporamenti utilizzando l'audio come input | Richieste online | 6,50 USD | |
Richieste batch | 3,25 USD |
*Nessun addebito per i token di output.
Modello | Funzionalità | Descrizione | Input | Output | Prezzo (USD) |
|---|---|---|---|---|---|
multimodalembedding | Incorporamenti per multimodale: testo | Genera incorporamenti utilizzando il testo come input | Testo | Embedding | 0,0002 USD / 1,000 count |
Incorporamenti per multimodale: immagine | Genera incorporamenti utilizzando l'immagine come input | Immagine | Embedding | 0,0001 USD / 1 count | |
Incorporamenti per multimodale: video e altro | Video Plus | Video | Incorporamenti (fino a 15 incorporamenti al minuto di video) | 0,002 USD / 1 count | |
Incorporamenti per multimodale: standard video | Standard video | Video | Incorporamenti (fino a 8 incorporamenti al minuto di video) | 0,001 USD / 1 count | |
Embedding per multimodale: video essenziale | Video Essential | Video | Incorporamenti (fino a 4 incorporamenti per minuto di video) | 0,0005 USD / 1 count |
Modello open source | Tipo | Tipo di richiesta | Prezzo per 1 M di token (USD) |
|---|---|---|---|
multilingual-e5-small | Input | Richieste online | 0,015 USD |
Output | Richieste online | Nessun costo | |
Input batch | Richieste batch | 0,0075 USD | |
Output batch | Richieste batch | Nessun costo | |
multilingual-e5-large | Input | Richieste online | 0,025 USD |
Output | Richieste online | Nessun costo | |
Input batch | Richieste batch | 0,0125 USD | |
Output batch | Richieste batch | Nessun costo |
I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
L'AI generativa su Agent Platform addebita ogni 1000 caratteri di input (prompt) e ogni 1000 caratteri di output (risposta). I caratteri vengono contati in base ai punti di codice UTF-8 e gli spazi bianchi vengono esclusi dal conteggio. Durante la fase di anteprima, i costi sono scontati al 100%. Le richieste di previsione che portano a risposte filtrate vengono addebitate solo per l'input. Alla fine di ogni ciclo di fatturazione, le frazioni di un centesimo di dollaro (0,01 $) vengono arrotondate a un centesimo.
Nota: i prezzi delle previsioni per gli endpoint del modello ottimizzato sono gli stessi del foundation model di base.
Modello | Tipo | Regione | Tipo di richiesta | Prezzo per 1000 token (USD) |
|---|---|---|---|---|
Codey per il completamento del codice | Input | Globale | Richieste online | 0,00025 USD |
Output | Globale | Richieste online | 0,0005 USD |
I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
Traduzione (testo)
Utilizza l'API Agent Platform e il modello LLM di traduzione per tradurre il testo. Le traduzioni LLM tendono a essere più fluide e a suonare più umane rispetto ai modelli di traduzione classici, ma hanno un supporto linguistico più limitato (Scopri di più).
Modello | Metodo | Utilizzo | Prezzo Prezzo /1 Mln di token (USD) |
|---|---|---|---|
LLM | Il numero di caratteri di input al mese | 10,00 USD | |
Il numero di caratteri di output al mese | 10,00 USD | ||
LLM di traduzione 002 | Il numero di caratteri di input al mese | 20,00 USD | |
Il numero di caratteri di output al mese | 20,00 USD |
I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
*Il prezzo è per carattere elaborato dal modello. Per informazioni dettagliate sui caratteri conteggiati, consulta Caratteri addebitati
Prezzo di archiviazione nella cache di contesto per la memorizzazione esplicita nella cache
Questa tabella contiene i prezzi per l'archiviazione della cache di contesto in base all'input (testo, immagine, video, audio)
Modello | Prezzo token/ora<= 200.000 token di input | Prezzo token/ora > 200.000 token di input |
|---|---|---|
Gemini 3.1 Pro | 0,0000045 USD | 0,0000045 USD |
Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3 Flash | 0,000001 USD | 0,000001 USD |
Gemini 3.5 Flash Lite, Gemini 3.1 Flash Lite | 0,000001 USD | 0,000001 USD |
Gemini 3 Pro | 0,0000045 USD | 0,0000045 USD |
Gemini 2.5 Pro | 0,0000045 USD | 0,0000045 USD |
Gemini 2.5 Flash | 0,000001 USD | 0,000001 USD |
Gemini 2.5 Flash-Lite | 0,000001 $ / 1 ora | 0,000001 $ |
Modelli Gemini 2.0
Modello | Tipo | Archiviazione (M tok-hour) | Prezzo /1 (USD) |
|---|---|---|---|
Gemini 2.0 Flash | Token di input | 0,000001 USD | 0,0375 USD |
Token audio di input | 0,000001 USD | 0,25 USD | |
Token di testo di output | NA | NA | |
Gemini 2.0 Flash Lite | Token di input | 0,000001 USD | 0,01875 USD |
Token audio di input | 0,000001 USD | 0,01875 USD | |
Token di testo di output | NA | NA |
* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.
* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.
* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.
Prezzi con grounding
Funzionalità | Prezzo (USD) |
|---|---|
Grounding con la Ricerca Google* | Gemini 2.0 Flash include fino a 1500 richieste basate al giorno senza costi aggiuntivi. Le richieste basate che superano le 1500 al giorno vengono fatturate a 35 $per 1000 richieste (fino a 1 milione di richieste al giorno). Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di richieste al giorno. I clienti possono decidere di non mostrare i Suggerimenti di ricerca con i Risultati fondati nell'interfaccia della loro Applicazione del Cliente; tuttavia, ciò è soggetto a prezzi alternativi. Contatta il team dedicato all'account Google Cloud per richiedere questa deroga. |
Grounding web per aziende* | 45 $ per 1000 richieste (fino a 1 milione di richieste al giorno) a partire dal 5 maggio 2025. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di richieste al giorno. I clienti possono decidere di non mostrare i Suggerimenti di ricerca con i Risultati fondati nell'interfaccia della loro Applicazione del Cliente; tuttavia, ciò è soggetto a prezzi alternativi. Contatta il team dedicato all'account Google Cloud per richiedere questa deroga. |
* Questo si applica ai prezzi basati sulla modalità.
Nota: il grounding con la Ricerca Google viene fatturato solo per le richieste che restituiscono risultati contenenti almeno un URL di supporto per il grounding dal web. Si applicano anche le tariffe standard per l'utilizzo del modello Gemini.
Il throughput sottoposto a provisioning garantisce il throughput per le tue esigenze di AI generativa e viene negoziato tramite unità della scala di AI generativa o GSU. Scopri di più sulla quantità di velocità effettiva fornita da ogni GSU qui e usa il nostro strumento di stima online qui.
Durata | Prezzo globale per ora di GSU (USD) | Prezzo non globale*per ora GSU (USD) |
|---|---|---|
Impegno di 1 settimana | 7,14 USD | 7,854 USD |
Impegno di 1 mese | 3,698630137 USD | 4,068493151 USD |
Impegno di 3 mesi | 3,287671233 USD | 3,616438356 USD |
Impegno di 1 anno | 2,739726027 USD | 3,01369863 USD |
* Per gli endpoint non globali, i prezzi entreranno in vigore per le famiglie di modelli Gemini 3 e successive disponibili a livello generale il 1° luglio 2026. Prima del 1° luglio 2026, i prezzi degli endpoint globali si applicano agli endpoint non globali.
Esempio di calcolo dei costi
Un utente deve assicurarsi di poter supportare 10 query al secondo (QPS) di una query con input di 1000 token di testo e 500 token audio e ricevere un output di 300 token di testo utilizzando gemini-2.0-flash.
Utilizzando la tabella della velocità effettiva e della velocità di esaurimento, per gemini-2.0-flash sappiamo che la velocità di esaurimento di un token di testo di input è di 1 token, quella di un token audio di input è di 7 token e quella di un token di testo di output è di 4 token.
Il totale dei token di input dell'utente è 1000* (1 token per token di testo di input) + 500* (7 token per token audio di input) = 4500 token di input con riduzione. Il numero totale di token di output dell'utente è 300* (4 token per token di testo di output) = 1200 token di output con riduzione. Sommandoli, otteniamo 4500 token di input con burn-down regolato + 1200 token di output con burn-down regolato = 5700 token totali per query.
Moltiplicando il numero totale di token per query per il QPS otteniamo 5700 token totali per query * 10 QPS = 57.000 token totali al secondo.
Dividendo questo valore per la velocità effettiva totale al secondo per GSU otteniamo 57.000 token totali al secondo ÷ 3360 velocità effettiva al secondo per GSU = 16,96 GSU. L'incremento minimo di acquisto di GSU per questo modello è 1, quindi l'utente avrebbe bisogno di 17 GSU.
Se l'utente volesse mantenere questa velocità effettiva per 1 settimana, il costo sarebbe di 1200 $ * 17 GSU = 20.400 $a settimana. Se volessero mantenere questa velocità effettiva per 1 mese, il costo sarebbe di 2700 $ * 17 GSU = 45.900 $al mese. Se volessero mantenere questa velocità effettiva per 3 mesi, il costo sarebbe di 2400 $ * 17 GSU = 40.800 $al mese. Infine, se volessero mantenere questa velocità effettiva per 1 anno, il costo sarebbe di 2000 $ * 17 GSU = 34.000 $al mese.
Ottimizzazione del modello
L'ottimizzazione del modello è un modo efficace per personalizzare i modelli di grandi dimensioni in base alle tue attività. È un passaggio fondamentale per migliorare la qualità e l'efficienza del modello. La messa a punto del modello offre i seguenti vantaggi:
L'ottimizzazione viene addebitata per milione di token di addestramento. I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche. A partire da Gemini 3, il prezzo di previsione dell'endpoint del modello ottimizzato sarà 1,5 volte quello del modello di base. Il prezzo di previsione dei vecchi modelli Gemini (Gemini 2.5 e precedenti) rimane lo stesso del modello di base.
Modello | Tipo | Prezzo (USD) |
|---|---|---|
Gemini 3.5 Flash | Fine-tuning supervisionato Ottimizzazione del reinforcement learning | 0,01 USD |
Gemini 3.1 Flash Lite | Fine-tuning supervisionato | 0,003 USD |
Gemini 2.5 Pro | Fine-tuning supervisionato | 0,025 USD |
Gemini 2.5 Flash | Fine-tuning supervisionato Ottimizzazione delle preferenze | 0,005 USD |
Gemini 2.5 Flash-Lite | Fine-tuning supervisionato Ottimizzazione delle preferenze | 0,0015 USD |
Gemma 3 1B IT | Fine-tuning supervisionato | 0,47 USD |
Gemma 3 4B IT | Fine-tuning supervisionato | 1,14 USD |
Gemma 3 12B IT | Fine-tuning supervisionato | 1,82 USD |
Gemma 3 27B IT | Fine-tuning supervisionato | 6,83 USD |
Medgemma 1.5 4B IT | Fine-tuning supervisionato | 1,14 USD |
Llama 3.1 8B | Fine-tuning supervisionato | 0,67 USD |
Llama 3.2 1B | Fine-tuning supervisionato | 0,28 USD |
Llama 3.2 3B | Fine-tuning supervisionato | 0,61 USD |
Llama 3.3 70B | Fine-tuning supervisionato | 6,72 USD |
Llama 4 Scout 17B 16E | Fine-tuning supervisionato | 5,77 USD |
Qwen 3 4B | Fine-tuning supervisionato | 1,35 USD |
Qwen 3 8B | Fine-tuning supervisionato | 4,18 USD |
Qwen 3 14B | Fine-tuning supervisionato | 8,46 USD |
Qwen 3 32B | Fine-tuning supervisionato | 6,57 USD |
* I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche.
* Per l'inferenza del modello a partire da Gemini 3, il prezzo di previsione dell'endpoint del modello ottimizzato sarà 1,5 volte quello del modello di base. Il prezzo di previsione dei vecchi modelli Gemini rimane lo stesso del modello di base.
Caso speciale di ricarica tramite personaggi
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
LLM di traduzione 002 | Fine-tuning supervisionato | 6,25 USD |
AlphaEvolve
Il costo di AlphaEvolve è determinato dal costo del modello Gemini utilizzato più il costo dell'agente AlphaEvolve.
Modello di Gemini | Tipo | Prezzo del modello Gemini per 1 M (USD) | Prezzo agente AlphaEvolve /1 Mln (USD) | Prezzo totale /1 Mln (USD) |
|---|---|---|---|---|
Gemini 3.1 Pro (anteprima) | Prezzo per 1 M di token di input | 2,00 USD | 4,00 USD | 6,00 $ |
Prezzo per 1 milione di token di output e di ragionamento | 12,00 USD | 24,00 USD | 36,00 $ | |
Gemini 3.5 Flash | Prezzo per 1 M di token di input | 1,50 USD | 3,00 USD | $ 4,50 |
Prezzo per 1 milione di token di output e di ragionamento | 9,00 USD | 18,00 USD | 27,00 $ |
I modelli partner sono un elenco selezionato di modelli di AI generativa sviluppati dai partner di Google. I modelli dei partner vengono offerti come API gestite. Per saperne di più, consulta Panoramica dei modelli partner. Le sezioni seguenti elencano i dettagli dei prezzi per i modelli dei partner Google.
Modelli con prezzi regionali
Modello | Tipo | ModelPrice (/1M tokens) =< 200K input tokens | Prezzo (/1 M di token) > 200.000 token di input |
|---|---|---|---|
Opus 5 | Input | 5,00 $ | 5,00 $ |
Output | $ 25,00 | $ 25,00 | |
Input batch | $ 2,50 | ||
Output batch | 12,50 $ | ||
Scrittura cache di 5 min | 6,25 $ | 6,25 $ | |
Scrittura cache 1 ora | $ 10,00 | $ 10,00 | |
Successo della cache | 0,50 $ | 0,50 $ | |
Scrittura cache batch da 5 m | 3,125 $ | ||
Scrittura cache batch 1 ora | 5,00 $ | ||
Riscontro nella cache batch | $ 0,25 | ||
Claude Sonnet 5 (prezzo promozionale fino al 31 agosto 2026) | Input | 2,00 $ | 2,00 $ |
Output | $ 10,00 | $ 10,00 | |
Input batch | 1,00 $ | 1,00 $ | |
Output batch | 5,00 $ | 5,00 $ | |
Scrittura cache di 5 min | $ 2,50 | $ 2,50 | |
Scrittura cache 1 ora | $ 4,00 | $ 4,00 | |
Successo della cache | $ 0,20 | $ 0,20 | |
Claude Sonnet 5 (prezzo standard a partire dal 1° settembre 2026) | Input | $ 3,00 | $ 3,00 |
Output | 15,00 $ | 15,00 $ | |
Input batch | $ 1,50 | $ 1,50 | |
Output batch | $ 7,50 | $ 7,50 | |
Scrittura cache di 5 min | $ 3,75 | $ 3,75 | |
Scrittura cache 1 ora | 6,00 $ | 6,00 $ | |
Successo della cache | $ 0,30 | $ 0,30 | |
Claude Fable 5 | Input | $ 10,00 | $ 10,00 |
Output | $ 50,00 | $ 50,00 | |
Input batch | 5,00 $ | ||
Output batch | $ 25,00 | ||
Scrittura cache di 5 min | 12,50 $ | 12,50 $ | |
Scrittura cache 1 ora | $ 20,00 | $ 20,00 | |
Successo della cache | 1,00 $ | 1,00 $ | |
Scrittura cache batch da 5 m | 6,25 $ | ||
Scrittura cache batch 1 ora | $ 10,00 | ||
Riscontro nella cache batch | 0,50 $ | ||
Claude Opus 4.8 | Input | 5,00 $ | 5,00 $ |
Output | $ 25,00 | $ 25,00 | |
Input batch | $ 2,50 | ||
Output batch | 12,50 $ | ||
Scrittura cache di 5 min | 6,25 $ | 6,25 $ | |
Scrittura cache 1 ora | $ 10,00 | $ 10,00 | |
Successo della cache | 0,50 $ | 0,50 $ | |
Scrittura cache batch da 5 m | 3,125 $ | ||
Scrittura cache batch 1 ora | 5,00 $ | ||
Riscontro nella cache batch | $ 0,25 | ||
Claude Opus 4.7 | Input | 5,00 $ | 5,00 $ |
Output | $ 25,00 | $ 25,00 | |
Input batch | $ 2,50 | ||
Output batch | 12,50 $ | ||
Scrittura cache di 5 min | 6,25 $ | 6,25 $ | |
Scrittura cache 1 ora | $ 10,00 | $ 10,00 | |
Successo della cache | 0,50 $ | 0,50 $ | |
Scrittura cache batch da 5 m | 3,125 $ | ||
Scrittura cache batch 1 ora | 5,00 $ | 5,00 $ | |
Riscontro nella cache batch | $ 0,25 | ||
Claude Opus 4.6 | Input | 5,00 $ | 5,00 $ |
Output | $ 25,00 | $ 25,00 | |
Input batch | $ 2,50 | ||
Output batch | 12,50 $ | ||
Scrittura cache di 5 min | 6,25 $ | 6,25 $ | |
Scrittura cache 1 ora | $ 10,00 | $ 10,00 | |
Successo della cache | 0,50 $ | 0,50 $ | |
Scrittura cache batch da 5 m | 3,125 $ | ||
Scrittura cache batch 1 ora | 5,00 $ | ||
Riscontro nella cache batch | $ 0,25 | ||
Claude Opus 4.5 | Input | 5,00 $ | |
Output | $ 25,00 | ||
Input batch | $ 2,50 | ||
Output batch | 12,50 $ | ||
Scrittura cache di 5 min | 6,25 $ | ||
Scrittura cache 1 ora | $ 10,00 | ||
Successo della cache | 0,50 $ | ||
Scrittura cache batch da 5 m | 3,125 $ | ||
Scrittura cache batch 1 ora | 5,00 $ | ||
Riscontro nella cache batch | $ 0,25 | ||
Claude Sonnet 4.6 | Input | $ 3,00 | $ 3,00 |
Output | 15,00 $ | 15,00 $ | |
Input batch | $ 1,50 | ||
Output batch | $ 7,50 | ||
Scrittura cache di 5 min | $ 3,75 | $ 3,75 | |
Scrittura cache 1 ora | 6,00 $ | 6,00 $ | |
Successo della cache | $ 0,30 | $ 0,30 | |
Scrittura cache batch da 5 m | 1,88 $ | ||
Scrittura cache batch 1 ora | $ 3,00 | ||
Riscontro nella cache batch | $ 0,15 | ||
Claude Sonnet 4.5 | Input | $ 3,00 | 6,00 $ |
Output | 15,00 $ | 22,50 $ | |
Input batch | $ 1,50 | ||
Output batch | $ 7,50 | ||
Scrittura cache di 5 min | $ 3,75 | $ 7,50 | |
Scrittura cache 1 ora | 6,00 $ | 12,00 $ | |
Successo della cache | $ 0,30 | $ 0,60 | |
Scrittura cache batch da 5 m | 1,88 $ | ||
Scrittura cache batch 1 ora | $ 3,00 | ||
Riscontro nella cache batch | $ 0,15 | ||
Scrittura cache batch da 5 m | 1,00 $ | ||
Claude Haiku 4.5 | Input | 1,00 $ | |
Output | 5,00 $ | ||
Input batch | 0,50 $ | ||
Output batch | $ 2,50 | ||
Scrittura cache di 5 min | $ 1,25 | ||
Riscontro nella cache batch | 0,05 $ | ||
Scrittura cache 1 ora | 2,00 $ | ||
Successo della cache | 0,10 $ | ||
Scrittura cache batch da 5 m | $ 0,625 |
* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.
Modelli con prezzi uniformi in tutte le regioni
Modello | Tipo | Prezzo (per 1 M di token) =< 200.000 token di input | Prezzo (/1 M di token) > 200.000 token di input |
|---|---|---|---|
Claude Opus 4.1 | Input | 15 $ | N/A |
Output | 75 $ | N/A | |
Input batch | $ 7,50 | N/A | |
Output batch | 37,50 $ | N/A | |
Scrittura cache di 5 min | 18,75 $ | N/A | |
Scrittura cache 1 ora | 30 $ | N/A | |
Successo della cache | $ 1,50 | N/A | |
Scrittura cache batch da 5 m | 9,375 $ | N/A | |
Scrittura cache batch 1 ora | 15,00 $ | N/A | |
Riscontro nella cache batch | $ 0,75 | N/A |
* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.
Prezzi degli strumenti
Strumento | Prezzo (USD) |
|---|---|
Richiesta di ricerca web | 10$ogni 1000 ricerche Modelli supportati: Claude Haiku 4.5, Claude Sonnet 4.5, Claude Sonnet 4.6, Claude Sonnet 4, Claude Opus 4.1, Claude Opus 4, Claude Opus 4.5 e Claude Opus 4.6. |
* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.
Modello | Tipo | Prezzo (per 1 M di token) =< 200.000 token di input | Prezzo (/1 M di token) > 200.000 token di input |
|---|---|---|---|
Ragionamento di Grok 4.20 | Input | $ 1,25 | $ 2,50 |
Output | $ 2,50 | 5,00 $ | |
Successo della cache | $ 0,20 | $ 0,40 | |
Grok 4.20 Non-Reasoning | Input | $ 1,25 | $ 2,50 |
Output | $ 2,50 | 5,00 $ | |
Successo della cache | $ 0,20 | $ 0,40 | |
Grok 4.3 | Input | $ 1,25 | $ 2,50 |
Output | $ 2,50 | 5,00 $ | |
Successo della cache | $ 0,20 | $ 0,40 |
* Se il contesto di input di una query è più lungo di 200.000 token, tutti i token vengono addebitati alle tariffe per contesto lungo.
Modello | Tipo | Prezzo per 1 M di token (USD) |
|---|---|---|
Grok 4.1 Fast Reasoning | Input | $ 0,20 |
Output | 0,50 $ | |
Successo della cache | 0,05 $ | |
Grok 4.1 Fast Non-Reasoning | Input | $ 0,20 |
Output | 0,50 $ | |
Successo della cache | 0,05 $ |
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
DeepSeek-V3.1 | Input | 0,60 USD |
Output | 1,70 USD | |
Successo della cache | 0,06 USD | |
Input batch | 0,30 USD | |
Output batch | 0,85 USD | |
DeepSeek-V3.2 | Input | 0,56 USD |
Output | 1,68 USD | |
Successo della cache | 0,056 USD | |
Input batch | $0,28 | |
Output batch | $0.84 | |
DeepSeek-R1 (0528) | Input | 1,35 USD |
Output | 5,40 USD | |
Input batch | 0,675 USD | |
Output batch | 2,70 USD | |
DeepSeek-OCR | Input | 0,30 USD |
Output | 1,20 USD |
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
MiniMax-M2 | Input | 0,30 USD |
Output | 1,20 USD | |
Successo della cache | 0,03 USD |
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
Kimi-K2-Thinking | Input | 0,60 USD |
Output | 2,50 USD | |
Successo della cache | 0,06 USD |
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
Qwen3-Next-80B-Thinking | Input | 0,15 USD |
Output | 1,20 USD | |
Qwen3-Next-80B-Instruct | Input | 0,15 USD |
Output | 1,20 USD | |
Qwen3-Coder-480B-A35B-Instruct | Input | 0,22 USD |
Output | 1,80 USD | |
Successo della cache | 0,022 USD | |
Input batch | 0,11 USD | |
Output batch | 0,90 USD | |
Qwen3-235B-A22B-Instruct-2507 | Input | 0,22 USD |
Output | 0,88 USD | |
Input batch | 0,11 USD | |
Output batch | 0,44 USD |
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
GLM-4.7 | Input | 0,60 USD |
Output | 2,20 USD | |
Successo della cache | 0,06 USD | |
GLM-5 * | Input | 1,00 USD |
Output | 3,20 USD | |
Successo della cache | 0,10 USD |
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
gpt-oss-120b | Input | 0,09 USD |
Output | 0,36 USD | |
Input batch | 0,045 USD | |
Output batch | 0,18 USD | |
gpt-oss-20b | Input | 0,07 USD |
Output | 0,25 USD | |
Successo della cache | 0,007 USD | |
Input batch | 0,035 USD | |
Output batch | 0,125 USD |
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
Llama 3.3 70B | Input | 0,72 USD |
Output | 0,72 USD | |
Input batch | 0,36 USD | |
Output batch | 0,36 USD | |
Lama 4 Scout | Input | 0,25 USD |
Output | 0,70 USD | |
Input batch | 0,125 USD | |
Output batch | 0,35 USD | |
Llama 4 Maverick | Input | 0,35 USD |
Output | 1,15 USD | |
Input batch | 0,175 USD | |
Output batch | 0,575 USD |
Modello | Tipo | Prezzo /1 Mln (USD) |
|---|---|---|
Mistral OCR (25.05) | Input | 0,0005 $ (o 0,0005 $/pagina) |
Output | 0,0005 $ (o 0,0005 $/pagina) | |
Mistral Medium 3 | Input | $ 0,40 |
Output | 2,00 $ | |
Mistral Small 3.1 (25.03) | Input | 0,10 $ |
Output | $ 0,30 | |
Codestral 2 | Input | $ 0,30 |
Output | $ 0,90 |