Costo di creazione e deployment dei modelli di AI in Agent Platform

I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

Ti vengono addebitati solo i costi delle richieste che restituiscono un codice di risposta 200. Le richieste che restituiscono altri codici di risposta, come i codici 4xx e 5xx, non vengono addebitate per l'input o l'output.

In questa pagina vengono illustrati i prezzi dell'AI generativa su Agent Platform. Per tutti gli altri prezzi di Agent Platform, inclusi i servizi ML Platform e MLOps, fai riferimento alla pagina dei prezzi di Agent Platform.

I piani di risparmio flessibili (FSP) sono sconti per impegno di utilizzo basati sulla spesa che ti aiutano a risparmiare sull'utilizzo dei prodotti idonei su Google Cloud. Per ulteriori informazioni sul funzionamento degli FSP e sui prodotti idonei, vedi Piani di risparmio flessibili.

Modelli Google

Gemini 3

Modello

Tipo

Regione

Prezzo (per 1 M di token) <= 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Prezzo (per 1 M di token) <= 200.000 token di input memorizzati nella cache

Prezzo (per 1 M di token) > 200.000 token di input memorizzati nella cache

Gemini 3.1 Pro (anteprima)

Input (testo, immagine, video, audio)

Globale

2,00 USD4,00 USD0,20 USD0,40 USD

Output di testo (risposta e ragionamento)

Globale

12,00 USD18,00 USD

N/A

N/A

Gemini 3.5 Flash

Input (testo, immagine, video, audio)

Globale

1,50 USD1,50 USD0,15 USD0,15 USD

Non globale*


1,65 USD1,65 USD0,165 USD0,165 USD

Output di testo (risposta e ragionamento)

Globale

9,00 USD9,00 USD

N/A

N/A

Non globale*

9,90 USD9,90 USD

N/A

N/A

Gemini 3.6 Flash

Input (testo, immagine, video, audio)

Globale

1,50 USD1,50 USD0,15 USD0,15 USD

Output di testo (risposta e ragionamento)

Globale

7,50 USD7,50 USD

N/A

N/A

Gemini 3.5 Flash-Lite


Input (testo, immagine, video, audio)

Globale

0,30 USD0,30 USD0,03 USD0,03 USD

Non globale*

0,33 USD0,33 USD0,033 USD0,033 USD

Output di testo (risposta e ragionamento)

Globale

2,50 USD2,50 USD

N/A

N/A

Non globale*

2,75 USD2,75 USD

N/A

N/A

Gemini 3 Flash (anteprima)

Input (testo, immagine, video)

Globale

0,50 USD0,50 USD0,05 USD0,05 USD

Input (audio)

Globale

1,00 USD1,00 USD0,10 USD0,10 USD

Output di testo (risposta e ragionamento)

Globale

3,00 USD3,00 USD

N/A

N/A

Gemini 3.1 Flash-Lite

Input (testo, immagine, video)

Globale

0,25 USD0,25 USD0,025 USD0,025 USD

Non globale*

0,275 USD0,275 USD0,0275 USD0,0275 USD

Input (audio)

Globale

0,50 USD0,50 USD0,05 USD0,05 USD

Non globale*

0,55 USD0,55 USD0,055 USD0,055 USD

Output di testo (risposta e ragionamento)

Globale

1,50 USD1,50 USD

N/A

N/A

Non globale*

1,65 USD1,65 USD

N/A

N/A

Immagine Gemini 3.1 Flash-Lite (Nano Banana 2 Lite)

Input (testo, immagine, video)

Globale

0,25 USD

N/A

0,025 USD

N/A

Output di testo (risposta e ragionamento)

Globale

1,50 USD

N/A

N/A

N/A

Output di immagini****

Globale

30,00 USD

N/A

N/A

N/A

Gemini 3.1 Flash Image (Nano Banana 2)

Input (testo, immagine, video)

Globale

0,50 USD

N/A

0,05 USD

N/A

Output di testo (risposta e ragionamento)

Globale

3,00 USD

N/A

N/A

N/A

Output immagine***

Globale

60,00 USD

N/A

N/A

N/A

Immagine di Gemini 3 Pro (Nano Banana Pro)

Input (testo, immagine)

Globale

2,00 USD

N/A

$ 0,20

N/A

Output di testo (risposta e ragionamento)

Globale

12,00 $

N/A

N/A

N/A

Output di immagini**

Globale

120,00 USD

N/A

N/A

N/A

Modello

Tipo

Regione

Prezzo (per 1 Mln di token) <= 200.000 token di input con priorità

Prezzo (per milione di token) > 200.000 token di input con priorità

Prezzo (per 1 M di token) <= 200.000 token di input memorizzati nella cache con priorità

Prezzo (per 1 M di token) > 200.000 token di input memorizzati nella cache con priorità

Gemini 3.1 Pro (anteprima)

Input (testo, immagine, video, audio)

Globale

3,60 USD7,20 USD0,36 USD0,72 USD

Output di testo (risposta e ragionamento)

Globale

21,60 USD32,40 USD

N/A

N/A

Gemini 3.5 Flash

Input (testo, immagine, video, audio)

Globale

2,70 USD2,70 USD0,27 USD0,27 USD

Non globale*

2,97 USD2,97 USD0,297 USD0,297 USD

Output di testo (risposta e ragionamento)

Globale

16,20 USD16,20 USD

N/A

N/A

Non globale*

17,82 USD17,82 USD

N/A

N/A

Gemini 3.6 Flash

Input (testo, immagine, video, audio)

Globale

2,70 USD2,70 USD0,27 USD0,27 USD

Output di testo (risposta e ragionamento)

Globale

13,50 USD13,50 USD

N/A

N/A

Gemini 3.5 Flash-Lite

Input (testo, immagine, video, audio)

Globale

0,54 USD0,54 USD0,054 USD0,054 USD

Non globale*

0,594 USD0,594 USD0,0594 USD0,0594 USD

Output di testo (risposta e ragionamento)

Globale

4,50 USD4,50 USD

N/A

N/A

Non globale*

4,95 USD4,95 USD

N/A

N/A

Gemini 3 Flash (anteprima)

Input (testo, immagine, video)

Globale

0,90 USD0,90 USD0,09 USD0,09 USD

Input (audio)

Globale

1,80 USD1,80 USD0,18 USD0,18 USD

Output di testo (risposta e ragionamento)

Globale

5,40 USD5,40 USD

N/A

N/A

Gemini 3.1 Flash-Lite

Input (testo, immagine, video)

Globale

0,45 USD0,45 USD0,045 USD0,045 USD

Non globale*

0,495 USD0,495 USD0,0495 USD0,0495 USD

Input (audio)

Globale

0,90 USD0,90 USD0,09 USD0,09 USD

Non globale*

0,99 USD0,99 USD0,099 USD0,099 USD

Output di testo (risposta e ragionamento)

Globale

2,70 USD2,70 USD

N/A

N/A

Non globale*

2,97 USD2,97 USD

N/A

N/A

Immagine Gemini 3.1 Flash-Lite (Nano Banana 2 Lite)

Input (testo, immagine, video)

Globale

N/A

N/A

N/A

N/A

Output di testo (risposta e ragionamento)

Globale

N/A

N/A

N/A

N/A

Output di immagini****

Globale

N/A

N/A

N/A

N/A

Gemini 3.1 Flash Image (Nano Banana 2)

Input (testo, immagine, video)

Globale

N/A

N/A

N/A

N/A

Output di testo (risposta e ragionamento)

Globale

N/A

N/A

N/A

N/A

Output immagine***

Globale

N/A

N/A

N/A

N/A

Immagine di Gemini 3 Pro (Nano Banana Pro)

Input (testo, immagine, video, audio)

Globale

N/A

N/A

N/A

N/A

Output di testo (risposta e ragionamento)

Globale

N/A

N/A

N/A

N/A

Output di immagini**

Globale

N/A

N/A

N/A

N/A

Modello

Tipo

Regione

Prezzo (per 1 M di token) <= 200.000 token di input con Flex/Batch

Prezzo (per 1 M di token) > 200.000 token di input con flessibilità/batch

Prezzo (per 1 M di token) <= 200.000 token di input memorizzati nella cache con Flex/Batch

Prezzo (per 1 M di token) > 200.000 token di input memorizzati nella cache con Flex/Batch

Gemini 3.1 Pro (anteprima)

Input (testo, immagine, video, audio)

Globale

1,00 USD2,00 USD

N/A

N/A

Output di testo (risposta e ragionamento)

Globale

6,00 USD9,00 USD

N/A

N/A

Gemini 3.5 Flash

Input (testo, immagine, video, audio)

Globale (batch)

0,75 USD0,75 USD0,075 USD0,075 USD

Globale (flessibile)

0,75 USD0,75 USD0,075 USD0,075 USD

Non globale*

0,825 USD0,825 USD0,0825 USD0,0825 USD

Output di testo (risposta e ragionamento)

Globale

4,50 USD4,50 USD

N/A

N/A

Non globale*

4,95 USD4,95 USD

N/A

N/A

Gemini 3.6 Flash

Input (testo, immagine, video, audio)

Globale

0,75 USD0,75 USD0,075 USD0,075 USD

Output di testo (risposta e ragionamento)

Globale

3,75 USD3,75 USD

N/A

N/A

Gemini 3.5 Flash-Lite

Input (testo, immagine, video, audio)

Globale

0,15 USD0,15 USD0,015 USD0,015 USD

Non globale*

0,165 USD0,165 USD0,0165 USD0,0165 USD

Output di testo (risposta e ragionamento)

Globale

1,25 USD1,25 USD

N/A

N/A

Non globale*

1,375 USD1,375 USD

N/A

N/A

Gemini 3 Flash (anteprima)

Input (testo, immagine, video)

Globale

0,25 USD0,25 USD

N/A

N/A

Input (audio)

Globale

0,50 USD0,50 USD

N/A

N/A

Output di testo (risposta e ragionamento)

Globale

1,50 USD1,50 USD

N/A

N/A

Gemini 3.1 Flash-Lite

Input (testo, immagine, video)

Globale

0,125 USD0,125 USD0,0125 USD0,0125 USD

Non globale*

0,1375 USD0,1375 USD0,01375 USD0,01375 USD

Input (audio)

Globale

0,25 USD0,25 USD0,025 USD0,025 USD

Non globale*

0,275 USD0,275 USD0,0275 USD0,0275 USD

Output di testo (risposta e ragionamento)

Globale

0,75 USD0,75 USD

N/A

N/A

Non globale*

0,825 USD0,825 USD

N/A

N/A

Immagine Gemini 3.1 Flash-Lite (Nano Banana 2 Lite)

Input (testo, immagine, video)

Globale

0,125 USD

N/A

0,0125 USD

N/A

Output di testo (risposta e ragionamento)

Globale

0,75 USD

N/A

N/A

N/A

Output di immagini****

Globale

15,00 USD

N/A

N/A

N/A

Gemini 3.1 Flash Image (Nano Banana 2)

Input (testo, immagine, video)

Globale

0,25 USD

N/A

0,025 USD

N/A

Output di testo (risposta e ragionamento)

Globale

1,50 USD

N/A

N/A

N/A

Output immagine***

Globale

30,00 USD

N/A

N/A

N/A

Immagine di Gemini 3 Pro (Nano Banana Pro)

Input (testo, immagine)

Globale

1,00 $

N/A

0,10 $

N/A

Output di testo (risposta e ragionamento)

Globale

6,00 $

N/A

N/A

N/A

Output immagine***

Globale

$ 60,00

N/A

N/A

N/A

Prezzi con grounding

Funzionalità

Utilizzo

Prezzo (USD)

Grounding con la Ricerca Google e Grounding web per aziende

Include 5000 query di grounding al mese senza costi, aggregate su tutti i modelli Gemini 3.

Le query di grounding che superano questi limiti vengono fatturate a 14$per 1000 query di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno.

Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini esegue una o più query su un indice web di Google (ciascuna delle quali è una "query di grounding") . Ti verrà addebitato il costo di ogni singola query di grounding eseguita. La fatturazione inizierà il 5 gennaio 2026. 

I token di input forniti da grounding con la Ricerca Google o Web Grounding for Enterprise non vengono addebitati.

I clienti possono decidere di non mostrare i suggerimenti di ricerca con risultati fondati nelle loro applicazioni cliente al prezzo standard per meno di 1 milione di prompt di grounding al giorno.

0 count to 5,000 count
0,00 USD (Free)
5,000 count and above
14,00 USD

Grounding con Google Maps

Include 5000 query di ricerca al mese senza costi, aggregate su tutti i modelli Gemini 3.

Le query Maps che superano questi limiti vengono fatturate a 14 $per 1000 query. Una richiesta inviata da un cliente a Gemini può generare una o più query a Google Maps. Ti verrà addebitato un costo per ogni singola query eseguita. La fatturazione inizierà il 5 gennaio 2026

I token di input forniti da Google Maps non vengono addebitati.

0 count to 5,000 count
0,00 USD (Free)
5,000 count and above
14,00 USD

Grounding con i tuoi dati

2,50 $ per 1000 prompt.

2,50 USD

Strumento per l'uso del computer

Il prezzo si basa sul numero totale di token di input inviati al modello e sui token di output risultanti generati. I prezzi dei token si basano sul rispettivo modello utilizzato.

A partire da Gemini 3.5, le dichiarazioni di funzione sono incluse nel conteggio dei token di input.

Per ulteriori dettagli, consulta la documentazione.

* Per gli endpoint non globali, i prezzi entreranno in vigore per le famiglie di modelli Gemini 3 e successive disponibili a livello generale il 1° luglio 2026. Prima del 1° luglio 2026, i prezzi degli endpoint globali si applicano agli endpoint non globali.

* Se il contesto di input di una query è più lungo di 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

* L'endpoint del modello ottimizzato sarà 1,5 volte quello del modello di base.

** Gemini 3 Pro Image addebita 560 token per immagine di input, con costi per immagine di output che scalano in base alla risoluzione: 1120 token (0,134 $) per 1K e 2K (circa 1 MP e 4 MP) e 2000 token (0,24 $) per 4K (circa 16 MP).

*** Gemini 3.1 Flash Image addebita 1120 token per immagine di input, con costi dell'immagine di output che scalano in base alla risoluzione: 747 token (0,045 $) per 512 (circa 0,25 MP), 1120 token (0,067 $) per 1K (circa 1 MP), 1680 token (0,101 $) per 2K (circa 4 MP) e 2520 token (0,15 $) per 4K (circa 16 MP).

**** Gemini 3.1 Flash-Lite Image addebita 1120 token per immagine di input e 1120 token (0, 034 $) per 1000 immagini di output (circa 1 MP)

Gemini 2.5

Modello

Tipo

Prezzo token <= 200.000 token

Prezzo > 200.000 token

Prezzo <= 200.000 token di input memorizzati nella cache

Prezzo > 200.000 token di input memorizzati nella cache

Gemini 2.5 Pro

Input (testo, immagine, video, audio)

1,25 USD2,50 USD0,125 USD0,25 USD

Output di testo (risposta e ragionamento)

10,00 USD15,00 USD

N/A

N/A

Gemini 2.5 Pro

Uso del computer - Anteprima

Input (testo, immagine, video, audio)

1,25 USD2,50 USD

N/A

N/A

Output di testo (risposta e ragionamento)

10,00 USD15,00 USD

N/A

N/A

Gemini 2.5 Flash

Input (testo, immagine, video)

0,30 USD0,30 USD0,03 USD0,03 USD

Input audio

1,00 USD0,30 USD0,10 USD0,10 USD

Output di testo (risposta e ragionamento)

2,50 USD2,50 USD

N/A

N/A

Gemini 2.5 Flash Image

Input (testo, immagine)***

0,30 USD

N/A

N/A

N/A

Output di testo (risposta e ragionamento)

$ 2,50

N/A

N/A

N/A

Output immagine***

30,00 USD

N/A

N/A

N/A

API Gemini 2.5 Flash Live

Testo di input

0,50 USD

0,50 $

N/A

N/A

Input (video, immagine)

3,00 USD

$ 3,00

N/A

N/A

Input audio

3,00 USD

$ 3,00

N/A

N/A

Output di testo

2,00 USD2,00 USD

N/A

N/A

1 Mln di token audio di output

12,00 USD

12,00 $

N/A

N/A

Gemini 2.5 Flash-Lite

Input (testo, immagine, video)

0,10 USD

0,10 $

0,01 USD

0,01 $

Input audio

0,30 USD

$ 0,30

0,03 USD

0,03 $

Output di testo (risposta e ragionamento)

0,40 USD0,40 USD

N/A

N/A

Modello

Tipo

Prezzo (per 1 Mln di token) <= 200.000 token di input con priorità

Prezzo (per milione di token) > 200.000 token di input con priorità

Prezzo (per 1 M di token) <= 200.000 token di input memorizzati nella cache con priorità

Prezzo (per 1 M di token) > 200.000 token di input memorizzati nella cache con priorità

Gemini 2.5 Pro

Input (testo, immagine, video, audio)

2,25 USD4,50 USD0,225 USD0,45 USD

Output di testo (risposta e ragionamento)

18,00 USD27,00 USD

N/A

N/A

Gemini 2.5 Pro

Uso del computer - Anteprima

Input (testo, immagine, video, audio)

N/A

N/A

N/A

N/A

Output di testo (risposta e ragionamento)

N/A

N/A

N/A

N/A

Gemini 2.5 Flash

Input (testo, immagine, video)

0,54 USD0,54 USD0,054 USD0,054 USD

Input audio

1,80 USD1,80 USD0,18 USD0,18 USD

Output di testo (risposta e ragionamento)

4,50 USD4,50 USD

N/A

N/A

Gemini 2.5 Flash Image

Input (testo, immagine)***

N/A

N/A

N/A

N/A

Output di testo (risposta e ragionamento)

N/A

N/A

N/A

N/A

Output immagine***

N/A

N/A

N/A

N/A

API Gemini 2.5 Flash Live

1 milione di token di testo di input

N/A

N/A

N/A

N/A

1 milione di token audio di input

N/A

N/A

N/A

N/A

1 Mln di token di input video/immagine

N/A

N/A

N/A

N/A

1 Mln di token di testo di output

N/A

N/A

N/A

N/A

1 Mln di token audio di output

N/A

N/A

N/A

N/A

Gemini 2.5 Flash-Lite

Input (testo, immagine, video)

0,18 USD0,18 USD0,018 USD0,018 USD

Input audio

0,54 USD0,54 USD0,054 USD0,054 USD

Output di testo (risposta e ragionamento)

0,72 USD0,72 USD

N/A

N/A

Modello

Tipo

Prezzo (per 1 M di token) <= 200.000 token di input con Flex/Batch

Prezzo (per 1 M di token) > 200.000 token di input con flessibilità/batch

Gemini 2.5 Pro

Input (testo, immagine, video, audio)

0,625 USD1,25 USD

Output di testo (risposta e ragionamento)

5,00 USD7,50 USD

Gemini 2.5 Pro

Uso del computer - Anteprima

Input (testo, immagine, video, audio)

N/A

N/A

Output di testo (risposta e ragionamento)

N/A

N/A

Gemini 2.5 Flash

Input (testo, immagine, video)

0,15 USD0,15 USD

Input audio

0,50 USD0,50 USD

Output di testo (risposta e ragionamento)

1,25 USD1,25 USD

Gemini 2.5 Flash Image

Input (testo, immagine, video)***

$ 0,15

N/A

Output di testo (risposta e ragionamento)

$ 1,25

N/A

Output immagine***

15,00 $

N/A

API Gemini 2.5 Flash Live

1 milione di token di testo di input

N/A

N/A

1 milione di token audio di input

N/A

N/A

1 Mln di token di input video/immagine

N/A

N/A

1 Mln di token di testo di output

N/A

N/A

1 Mln di token audio di output

N/A

N/A

Gemini 2.5 Flash-Lite

Input (testo, immagine, video)

0,05 USD0,05 USD

Input audio

0,05 USD0,05 USD

Output di testo (risposta e ragionamento)

0,20 USD0,20 USD

Prezzi con grounding

Funzionalità

Utilizzo

Prezzo (USD)

Grounding con la Ricerca Google

Gemini 2.0 Flash, 2.5 Flash e 2.5 Flash-Lite includono un totale di 1500 prompt di grounding al giorno senza costi aggiuntivi. Gemini 2.5 Pro include 10.000 prompt di grounding al giorno senza costi aggiuntivi.

I prompt di grounding che superano questi limiti vengono fatturati a 35$per 1000 prompt di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno.

Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini esegue una o più query su un indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo prompt di grounding.

0 count to 10,000 count
0,00 USD (Free)
10,000 count and above
35,00 USD

Grounding web per aziende

45$per 1000 prompt di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno.

Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini effettua una o più query a un indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo costo per un prompt di grounding.

45,00 USD

Grounding con i tuoi dati

2,5 $ per 1000 richieste.

2,50 USD

Grounding con Google Maps

25$per 1000 prompt basati su dati.

Un prompt basato su dati è una richiesta inviata a Gemini che esegue almeno una query su Google Maps.

0 count to 1,500 count
0,00 USD (Free)
1,500 count and above
25,00 USD

* Se il contesto di input di una query è più lungo di 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.

** Il grounding con la Ricerca Google e il grounding web per le aziende vengono fatturati solo quando un prompt di grounding restituisce correttamente le fonti (ovvero risultati contenenti almeno un URL di supporto dal web). Le tariffe di utilizzo del modello Gemini vengono applicate separatamente.

*** Un'immagine 1024x1024 consuma 1290 token (0,039 $ per 1000 immagini di output). Il numero di token per immagine varia in base alla risoluzione dell'immagine. Per maggiori informazioni su come calcolare i token, puoi consultare la nostra documentazione.

**** La fatturazione dell'utilizzo del computer utilizza lo SKU Gemini 2.5 Pro per suddividere i costi di utilizzo del computer e applicare i tag di fatturazione. Scopri di più qui.

  • Spiegazione della fatturazione della finestra di contesto della sessione LiveAPI: ti vengono addebitati i costi per ogni turno per tutti i token presenti nella finestra di contesto della sessione. La finestra del contesto della sessione include nuovi token (turno corrente) + tutti i token accumulati dai turni precedenti. Ciò significa che i token dei turni precedenti vengono rielaborati e presi in considerazione in ogni nuovo turno, fino alla dimensione della finestra contestuale configurata. Un "turno" è costituito dall'input utente e dalla risposta del modello.
  • Modalità audio proattiva: quando è abilitata, i token di input vengono addebitati mentre LiveAPI è in ascolto. I token di output vengono addebitati solo quando l'API risponde.
  • Quando è abilitata la trascrizione da audio a testo, tutti i token di testo generati per la trascrizione vengono addebitati alla tariffa di output dei token di testo.

Gemini 2.0

Gemini 2.0 viene fatturato in base ai token. Per calcolare il numero di token di input nella tua richiesta prima di inviarla, puoi utilizzare il tokenizzatore SDK o l'API countTokens. Se la richiesta non va a buon fine e viene restituito un errore 400 o 500, non ti verranno addebitati i token utilizzati.

Usa l'opzione di attivazione/disattivazione nella tabella dei prezzi per confrontare i prezzi basati su token e quelli basati su modalità.

Modello

Tipo

Prezzo per 1 M di token (USD)

Prezzo per 1 M di token (USD) con l'API Batch

Gemini 2.0 Flash

Testo di input

0,15 USD0,075 USD

Audio di input

1,00 USD0,50 USD

Testo di output

0,60 USD0,30 USD

Addestramento di ottimizzazione

0,003 USD

Generazione di immagini con Gemini 2.0 Flash

Token di input

0,15 USD

Token audio di input

1,00 USD

Token video di input

0,15 USD

Token di testo di output

0,60 USD

Token immagine di output

30,00 USD

API Gemini 2.0 Flash Live

Token di testo di input

0,50 USD

Token audio di input

3,00 USD

Token video/immagine di input

3,00 USD

Token di testo di output

2,00 USD

Token audio di output

12,00 USD

Gemini 2.0 Flash Lite

Token di input

0,075 USD0,0375 USD

Token audio di input

0,075 USD0,0375 USD

Token di testo di output

0,30 USD0,15 USD

Ottimizzazione per i token di addestramento

0,001 USD

* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

* I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche.

* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.

* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.

* API Gemini 2.0 Flash Live: 25 token al secondo di audio (input/output), 258 token al secondo di video (input). Il grounding con la Ricerca Google rimane senza costi mentre l'API Gemini 2.0 Flash Live è in anteprima.

I prezzi delle modalità riportati di seguito si basano su casi d'uso medi solo a scopo di riferimento. La fatturazione effettiva si baserà solo sui token:

  • 4 caratteri generano circa 1 token di testo, spazi inclusi.
  • Per un'immagine 1024x1024, consuma 1290 token. Il numero di token per immagine varia in base alla risoluzione dell'immagine. Per maggiori informazioni su come calcolare i token, puoi consultare la nostra documentazione.
  • L'input video consuma 258 token al secondo alla frequenza di campionamento di un frame al secondo. I video con audio vengono fatturati sia per i token video che per i token audio.
  • L'input audio consuma 25 token al secondo senza timestamp.

Modello

Tipo

Prezzo (per 1 M di token) (USD)

Prezzo (per 1 M di token) (USD) con l'API Batch

Gemini 2.0 Flash

Testo di input ($/M di caratteri)

$ 0,0375

0,01875 $

Immagine di input ($/immagine)

0,0001935 $

0,00009675 $

Video di input ($/sec)

0,0000387 $

0,00001935 $

Audio di input ($/sec)

0,000025 $

0,0000125 $

Testo di output ($/M di caratteri)

$ 0,15

0,075 $

Generazione di immagini con Gemini 2.0 Flash

Testo di input ($/M di caratteri)

$ 0,0375

Immagine di input ($/immagine)

0,0001935 $

Video di input ($/sec)

0,0000387 $

Audio di input ($/sec)

0,000025 $

Testo di output ($/M di caratteri)

$ 0,15

Immagine di output ($/immagine)

0,04 $

Gemini 2.0 Flash Lite

Testo di input ($/M di caratteri)

0,01875 $

0,009375 $

Immagine di input ($/immagine)

0,00009675 $

0,000048375 $

Video di input ($/sec)

0,00001935 $

0,000009675 $

Audio di input ($/sec)

0,000001875 $

0,000000938 $

Testo di output ($/M di caratteri)

0,075 $

$ 0,0375

* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

* I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche.

* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.

* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.

* API Gemini 2.0 Flash Live: 25 token al secondo di audio (input/output), 258 token al secondo di video (input). Il grounding con la Ricerca Google rimane senza costi mentre l'API Gemini 2.0 Flash Live è in anteprima.

Prezzo con grounding

Funzionalità

Utilizzo

Prezzo (USD)

Grounding con la Ricerca Google*, **

Gemini 2.0 Flash, 2.5 Flash e 2.5 Flash-Lite includono un totale di 1500 prompt di grounding al giorno senza costi aggiuntivi. Gemini 2.5 Pro include 10.000 prompt di grounding al giorno senza costi aggiuntivi.

I prompt di grounding che superano questi limiti vengono fatturati a 35$per 1000 prompt di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno.

Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini esegue una o più query su un indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo prompt di grounding.

0 count to 10,000 count
0,00 USD (Free)
10,000 count and above
35,00 USD

Grounding web per aziende*, **

45$per 1000 prompt di grounding. Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt di grounding al giorno.

Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini effettua una o più query a un indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo costo per un prompt di grounding.

45,00 USD

Grounding con i tuoi dati*

2,5 $ per 1000 richieste.

2,50 USD

Grounding con Google Maps*

I modelli Gemini includono una serie di prompt basati a terra giornalieri senza costi aggiuntivi:

  • Gemini Flash e Flash-Lite: 1500 prompt basati a terra combinati al giorno.
  • Gemini Pro: 10.000 prompt basati su dati al giorno.

I prompt basati che superano questi limiti vengono fatturati a 25 $per 1000 prompt basati.

Un prompt basato su dati è una richiesta inviata a Gemini che esegue almeno una query su Google Maps.

Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt basati su dati al giorno.

0 count to 1,500 count
0,00 USD (Free)
1,500 count and above
25,00 USD

* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

* I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche.

* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.

* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.

* API Gemini 2.0 Flash Live: 25 token al secondo di audio (input/output), 258 token al secondo di video (input). Il grounding con la Ricerca Google rimane senza costi mentre l'API Gemini 2.0 Flash Live è in anteprima.

** Il grounding con la Ricerca Google e il grounding web per le aziende vengono fatturati solo quando un prompt restituisce correttamente fonti (ovvero risultati contenenti almeno un URL di supporto dal web). Le tariffe di utilizzo del modello Gemini vengono applicate separatamente.

  • Spiegazione della fatturazione della finestra di contesto della sessione LiveAPI: ti vengono addebitati i costi per ogni turno per tutti i token presenti nella finestra di contesto della sessione. La finestra di contesto della sessione include nuovi token (turno corrente) + tutti i token accumulati dai turni precedenti. Ciò significa che i token dei turni precedenti vengono rielaborati e presi in considerazione in ogni nuovo turno, fino alla dimensione della finestra contestuale configurata. Un "turno" è costituito dall'input utente e dalla risposta del modello.
  • Quando è abilitata la trascrizione da audio a testo, tutti i token di testo generati per la trascrizione vengono addebitati alla tariffa di output dei token di testo.

Altri modelli Gemini

Tutti i modelli Gemini diversi da Gemini 2.0 o Gemini 2.5 vengono fatturati in base alle modalità, ad esempio caratteri, immagini, secondi di video/audio.

  • L'input di testo viene addebitato per ogni 1000 caratteri di input (prompt) e per ogni 1000 caratteri di output (risposta).
  • I caratteri vengono conteggiati in base ai punti di codice UTF-8 e gli spazi bianchi vengono esclusi dal conteggio, con un risultato di circa 4 caratteri per token.
  • Le richieste di previsione che portano a risposte filtrate vengono addebitate solo per l'input.
  • Alla fine di ogni ciclo di fatturazione, le frazioni di un centesimo di dollaro (0,01 $) vengono arrotondate a un centesimo. L'input multimediale viene addebitato per immagine o per secondo (video).
  • Se la richiesta non va a buon fine e viene restituito un errore 400 o 500, non ti verranno addebitati i token utilizzati.

Gemini 1.5

Modello

Funzionalità

Tipo

Prezzo ( =< 128.000 token di input)

Prezzo ( > 128.000 token di input)

Gemini 1.5 Flash

Multimodale

Input immagine

0,00002 USD / 1 count0,00004 USD / 1 count

Input video

0,00002 USD / 1 count0,00004 USD / 1 count

Immissione testo

0,00001875 USD / 1,000 count0,0000375 USD / 1,000 count

Input audio

0,000002 USD / 1 count0,000004 USD / 1 count

Output di testo

0,000075 USD / 1,000 count0,00015 USD / 1,000 count

Ottimizzazione*

Token di addestramento

0,008 USD / 1,000 count

Gemini 1.5 Pro

Multimodale

Input immagine

0,00032875 USD / 1 count0,0006575 USD / 1 count

Input video

0,00032875 USD / 1 count0,0006575 USD / 1 count

Immissione testo

0,0003125 USD / 1,000 count0,000625 USD / 1,000 count

Input audio

0,00003125 USD / 1 count0,0000625 USD / 1 count

Output di testo

0,00125 USD / 1,000 count0,0025 USD / 1,000 count

Ottimizzazione*

Token di addestramento

0,08 USD / 1,000 count

Gemini 1.0 Pro

Multimodale

Input immagine

0,0025 USD / 1 count

Input video

0,002 USD / 1 count

Immissione testo

0,000125 USD / 1,000 count

Output di testo

0,000375 USD / 1,000 count

* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

* Se il contesto di una query è più lungo di 128.000, tutti i token vengono addebitati alle tariffe per contesto lungo.

* I modelli Gemini sono disponibili in modalità batch con uno sconto del 50%.

* Gemini 1.0 Pro supporta solo una finestra contestuale fino a 32.000 token.

* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.

* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.

** Il grounding con la Ricerca Google e il grounding web per le aziende vengono fatturati solo quando un prompt restituisce correttamente fonti (ovvero risultati web contenenti almeno un URL di supporto dal web). Le tariffe di utilizzo del modello Gemini vengono applicate separatamente.

Prezzi con grounding

Funzionalità

Prezzo (USD)

Grounding con la Ricerca Google

35$per 1000 prompt di ancoraggio.

Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini effettua una o più query all'indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo prompt di grounding.

Grounding web per aziende

45$per 1000 prompt di ancoraggio.

Un "prompt di grounding" è un prompt dell'utente finale che il cliente invia a Gemini e per il quale Gemini effettua una o più query all'indice web di Google (ciascuna delle quali è una "query di grounding")**. Anche se vengono inviate più query di grounding, viene addebitato un solo prompt di grounding.

Grounding con i tuoi dati

2,5 $ per 1000 richieste a partire dal 16 giugno 2025.

** Il grounding con la Ricerca Google e il grounding web per le aziende vengono fatturati solo quando un prompt restituisce correttamente fonti (ovvero risultati web contenenti almeno un URL di supporto dal web). Le tariffe di utilizzo del modello Gemini vengono applicate separatamente.

Imagen

Con Imagen su Agent Platform, puoi generare nuove immagini e modificare quelle esistenti in base ai prompt di testo che fornisci oppure modificare solo parti delle immagini utilizzando un'area di maschera che definisci insieme a una serie di altre funzionalità.

Modello

Funzionalità

Descrizione

Input

Output

Prezzo per 1 unità (USD)

Imagen 4 Ultra

Generazione di immagini

Genera un'immagine

Prompt di testo

Immagine

0,06 USD

Imagen 4

Upscale

Aumenta la risoluzione di un'immagine generata a 2K, 3K e 4K

Immagine

Immagine

0,06 $

Imagen 4

Generazione di immagini

Genera un'immagine

Prompt di testo

Immagine

0,04 USD

Imagen 4 Fast

Generazione di immagini

Genera un'immagine

Prompt di testo

Immagine

0,02 USD

Imagen 3

Generazione di immagini

Genera un'immagine

Modifica un'immagine

Personalizza un'immagine

Prompt di testo

Immagine

0,04 USD

Imagen 3 Fast

Generazione di immagini

Genera un'immagine

Prompt di testo

Immagine

0,02 USD

Imagen 2, Imagen 1

Generazione di immagini

Genera un'immagine

Prompt di testo

Immagine

0,02 USD

Imagen 2, Imagen 1

Modifica delle immagini

Modifica un'immagine utilizzando l'approccio con o senza maschera

Prompt immagine/testo

Immagine

0,02 USD

Imagen 1

Upscale

Aumenta la risoluzione di un'immagine generata a 2k e 4k

Immagine

Immagine

0,003 USD

Imagen 1

Ottimizzazione

Consenti l'utilizzo di un "soggetto" fornito dall'utente nei prompt di Imagen (addestramento few-shot)

Soggetti con identificatore di testo e 4-8 immagini per soggetto

Modello ottimizzato (dopo l'addestramento con soggetti forniti dall'utente)

$ per ora nodo (prezzi dell'addestramento personalizzato di Agent Platform)

Imagen

Didascalia visiva

Genera una didascalia di testo breve o lunga per un'immagine

Immagine

Didascalia testuale

0,0015 USD

Imagen

Visual Question Answering

Fornisci una risposta basata su una domanda che fa riferimento a un'immagine

Prompt immagine/testo

Risposta di testo

0,0015 USD

Imagen

Ricontestualizzazione del prodotto

Reimmagina i prodotti in una nuova scena

1-3 immagini dello stesso prodotto e un prompt di testo che descrive la scena desiderata

Immagine

$ 0,12

Prova virtuale

Crea immagini di persone che indossano vestiti diversi

1 immagine di una persona e 1 immagine di un capo di abbigliamento

Immagine

0,06 USD

I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

Veo

Modello

Funzionalità

Descrizione

Input

Output

Risoluzione di output

Prezzo (USD)

Veo 3.1

Generazione di video e audio

Genera video di alta qualità con effetti sonori/vocali sincronizzati da un prompt testuale o da un'immagine di riferimento

Prompt di testo/immagine

Video + audio

720p, 1080p

0,40 USD / 1 count

4000

0,60 USD / 1 count

Generazione di video

Genera video di alta qualità da un prompt testuale o da un'immagine di riferimento

Prompt di testo/immagine

Video

720p, 1080p

0,20 USD / 1 count

4000

0,40 USD / 1 count

Veo 3.1 Fast

Generazione di video e audio

Genera più velocemente video con discorsi/effetti sonori sincronizzati da un prompt testuale o da un'immagine di riferimento

Prompt di testo/immagine

Video + audio

720p

0,10 USD / 1 count

1080p

0,12 USD / 1 count

4000

0,30 USD / 1 count

Generazione di video

Genera video da un prompt testuale o da un'immagine di riferimento più velocemente

Prompt di testo/immagine

Video

720p

0,08 USD / 1 count

1080p

0,10 USD / 1 count

4000

0,25 USD / 1 count

Veo 3.1 Lite

Generazione di video e audio

Genera video con parlato/effetti sonori sincronizzati da un prompt testuale o da un'immagine di riferimento nel modo più veloce

Prompt di testo/immagine

Video + audio

720p

0,05 $ per conteggio

1080p

0,08 $ per unità

Generazione di video

Genera video da un prompt testuale o da un'immagine di riferimento nel modo più veloce

Prompt di testo/immagine

Video

720p

0,03 $ per conteggio

1080p

0,05 $ per conteggio

Veo 3

Generazione di video e audio

Genera video di alta qualità con effetti sonori/vocali sincronizzati da un prompt testuale o da un'immagine di riferimento

Prompt di testo/immagine

Video + audio

720p, 1080p

0,40 USD / 1 count

Generazione di video

Genera video di alta qualità da un prompt testuale o da un'immagine di riferimento

Prompt di testo/immagine

Video

720p, 1080p

0,20 USD / 1 count

Veo 3 Fast

Generazione di video e audio

Genera più velocemente video con discorsi/effetti sonori sincronizzati da un prompt testuale o da un'immagine di riferimento

Prompt di testo/immagine

Video + audio

720p

0,10 USD / 1 count

1080p

0,12 USD / 1 count

Generazione di video

Genera video da un prompt testuale o da un'immagine di riferimento più velocemente

Prompt di testo/immagine

Video

720p

0,08 USD / 1 count

1080p

0,10 USD / 1 count

Veo 2

Generazione di video

Genera video da un prompt testuale o da un'immagine di riferimento

Prompt di testo/immagine

Video

720p

0,50 USD / 1 count

Controlli avanzati

Genera video tramite interpolazione dei fotogrammi iniziale e finale, estendi i video generati e applica i controlli della fotocamera

Prompt di testo/immagine/video

Video

720p

0,50 USD / 1 count

Lyria

La famiglia di modelli Lyria offre una generazione di musica di alta qualità, ideale per composizioni sofisticate ed esplorazioni creative dettagliate in cui l'output sfumato è fondamentale.

Modello

Funzionalità

Descrizione

Input

Output

Prezzo (USD)

Lyria 3 Pro

Generazione di musica completa

Lyria 3 Pro crea composizioni musicali complete a partire da input multimodali come testo o immagini

Testo, immagine

Brano integrale

0,08 USD / 1 count

Lyria 3

Generazione di clip musicali di 30 secondi

Lyria 3 genera clip audio di 30 secondi ad alta fedeltà da prompt di testo o immagine

Testo, immagine

Clip musicale di 30 secondi

0,04 USD / 1 count

Lyria 2

Generazione di musica

Genera musica da un prompt testuale

Prompt di testo

Musica

0,06 USD / 1 count

Costi di incorporamento

L'API Gemini offre modelli di incorporamento per generare incorporamenti per testo, immagini, video e altri contenuti.

Modello

Tipo

Regione

Tipo di richiesta

Prezzo per 1000 caratteri (USD)

Incorporamento di Gemini

Input

Globale

Richieste online

0,00015 USD

Richieste batch

0,00012 USD

Output

Globale

Richieste online

Nessun costo

Richieste batch

Nessun costo

Incorporamenti per il testo (escluso l'incorporamento Gemini)

Input

Globale

Richieste online

0,000025 USD

Richieste batch

0,00002 USD

Output

Globale

Richieste online

Nessun costo

Richieste batch

Nessun costo

Gemini Omni

Modello

Tipo

Prezzo token /1 Mln (USD)

Gemini Omni Flash

Input (testo, immagine, video, audio)

1,50 USD

Output di testo (risposta e ragionamento)

9,00 USD

Uscita video*

17,50 USD

* Gemini Omni Flash addebita 2040 token per immagine, 32 token per secondo di audio e 5792 token per secondo di video per l'input. Per l'output video, Gemini Omni Flash addebita 5792 per secondo di output video a 720p (con audio).

Agenti

Modello

Tipo

Prezzo (per 1 M di token)

Prezzo (per milione di token di input memorizzati nella cache)

Agente Gemini Deep Research

Input (testo)

2 $

0,2 $

Output di testo (risposta e ragionamento)

12 $

N/A

Prezzi con grounding

Funzionalità

Utilizzo

Prezzo (USD)

Grounding con la Ricerca Google e la Ricerca Immagini e Grounding web per aziende*

Include 5000 query di ricerca al mese senza costi, aggregate su tutti i modelli Gemini 3.

Le query di ricerca che superano questi limiti vengono fatturate a 14 $per 1000 query di ricerca. Una richiesta inviata da un cliente a Gemini può generare una o più query alla Ricerca Google (o Web Grounding for Enterprise). Ti verrà addebitato il costo di ogni singola query di ricerca eseguita. La fatturazione inizierà il 5 gennaio 2026.

I token di input forniti da grounding con la Ricerca Google o Web Grounding for Enterprise non vengono addebitati.

Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di prompt basati su dati al giorno.

I clienti possono decidere di non mostrare i Suggerimenti di ricerca con i Risultati fondati nell'interfaccia della loro Applicazione del Cliente al prezzo standard.


0 count to 5,000 count
0,00 USD (Free)
5,000 count and above
14,00 USD

Grounding con i tuoi dati

2,50 USD

CodeMender

Il prezzo di CodeMender si basa sui token ed è determinato dal modello utilizzato

Modello

Tipo

Prezzo del modello per 1 M di token (USD)

Prezzo di CodeMender per 1 Mln di token (USD)

Gemini 3.5 Flash

Token di input

1,50 USD1,50 USD

Token memorizzati nella cache

0,15 USD0,15 USD

Token di output

9,00 USD9,00 USD

Gemini 3.1 Pro

Token di input

2,00 USD2,00 USD

Token memorizzati nella cache

0,20 USD0,20 USD

Token di output

12,00 USD12,00 USD

Gemini 3 Flash

Token di input

0,50 USD0,50 USD

Token memorizzati nella cache

0,05 USD0,05 USD

Token di output

3,00 USD3,00 USD

Gemma

Modello

Tipo

Prezzo (/1 M di token (USD)

Gemma 4 26B

Input

0,15 USD

Output

0,60 USD

Successo della cache

0,015 USD

Prezzi dell'ottimizzatore del modello di Agent Platform (sperimentale)*

Agent Platform Model Optimizer semplifica l'utilizzo di Gemini per i clienti aziendali fornendo un singolo meta-endpoint per le richieste del modello Gemini: i clienti che utilizzano questo servizio non devono specificare se utilizzare Flash, Pro o una versione specifica. Invece, forniscono semplicemente un'impostazione configurabile (costo, qualità o bilanciamento) per indicare le proprie preferenze e Model Optimizer applica il livello di intelligenza appropriato per l'attività inviando ogni query al modello più adatto.

L'ottimizzatore del modello di Agent Platform applica prezzi dinamici. Ciò significa che il prezzo medio per token dipende dal livello di intelligenza del modello applicato per completare l'attività. Per questo motivo, di seguito sono riportati esempi di prezzi per illustrare scenari probabili in base all'impostazione della configurazione (vedi le tabelle di seguito). Gli SKU di Model Optimizer sono SKU da 1 $che funzionano come unità di acquisto da applicare alla fatturazione. La fatturazione avviene comunque in base al consumo dopo l'utilizzo dei modelli.

Esempio 1: chatbot con rapporto I/O 5:1

NOTA: questi intervalli non sono garantiti, i risultati dei singoli clienti possono variare

Preferenza del cliente

Token di input del cliente inviati al MO

Token di output del cliente inviati al MO

Prezzo medio di input per milione di token (intervallo alto)

Prezzo medio di output per milione di token (intervallo alto)

Prezzo medio di input per milione di token (intervallo basso)

Prezzo medio di output per milione di token (intervallo basso)

Costo

10.000.000

2.000.000

0,63 $

$ 2,50

$ 0,16

0,63 $

Bilanciato

10.000.000

2.000.000

$ 1,26

5,00 $

0,63 $

$ 2,50

Qualità

10.000.000

2.000.000

1,89 $

$ 7,50

$ 1,26

5,00 $

Esempio 2: Generazione di contenuti: rapporto I/O 1:20

Preferenza del cliente

Token di input del cliente inviati al MO

Token di output del cliente inviati al MO

Prezzo medio di input per milione di token (intervallo alto)

Prezzo medio di output per milione di token (intervallo alto)

Prezzo medio di input per milione di token (intervallo basso)

Prezzo medio di output per milione di token (intervallo basso)

Costo

1.000.000

20.000.000

0,63 $

$ 2,50

$ 0,16

0,63 $

Bilanciato

1.000.000

20.000.000

$ 1,26

5,00 $

0,63 $

$ 2,50

Qualità

1.000.000

20.000.000

1,89 $

$ 7,50

$ 1,26

5,00 $

* Model Optimizer è un'offerta sperimentale a pagamento e potrebbe instradare le richieste verso versioni sperimentali di Gemini su Agent Platform.

Embedding multimodali

Modello

Tipo

Descrizione

Tipo di richiesta

Prezzo per 1 M di token (USD)

Gemini Embedding 2 (multimodale unificato, anteprima)

Testo di input

Genera incorporamenti utilizzando il testo come input

Richieste online

0,20 USD

Richieste batch

0,10 USD

Immagine di input

Genera incorporamenti utilizzando l'immagine come input

Richieste online

0,45 USD

Richieste batch

0,225 USD

Video di input

Genera incorporamenti utilizzando il video come input

Richieste online

12,00 USD

Richieste batch

6,00 USD

Audio di input

Genera incorporamenti utilizzando l'audio come input

Richieste online

6,50 USD

Richieste batch

3,25 USD

*Nessun addebito per i token di output.

Modello

Funzionalità

Descrizione

Input

Output

Prezzo (USD)

multimodalembedding

Incorporamenti per multimodale: testo

Genera incorporamenti utilizzando il testo come input

Testo

Embedding

0,0002 USD / 1,000 count

Incorporamenti per multimodale: immagine

Genera incorporamenti utilizzando l'immagine come input

Immagine

Embedding

0,0001 USD / 1 count

Incorporamenti per multimodale: video e altro

Video Plus

Video

Incorporamenti (fino a 15 incorporamenti al minuto di video)

0,002 USD / 1 count

Incorporamenti per multimodale: standard video

Standard video

Video

Incorporamenti (fino a 8 incorporamenti al minuto di video)

0,001 USD / 1 count

Embedding per multimodale: video essenziale

Video Essential

Video

Incorporamenti (fino a 4 incorporamenti per minuto di video)

0,0005 USD / 1 count

Modello open source

Tipo

Tipo di richiesta

Prezzo per 1 M di token (USD)

multilingual-e5-small

Input

Richieste online

0,015 USD

Output

Richieste online

Nessun costo

Input batch

Richieste batch

0,0075 USD

Output batch

Richieste batch

Nessun costo

multilingual-e5-large

Input

Richieste online

0,025 USD

Output

Richieste online

Nessun costo

Input batch

Richieste batch

0,0125 USD

Output batch

Richieste batch

Nessun costo

I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

Prezzi per il completamento del codice di Agent Platform

L'AI generativa su Agent Platform addebita ogni 1000 caratteri di input (prompt) e ogni 1000 caratteri di output (risposta). I caratteri vengono contati in base ai punti di codice UTF-8 e gli spazi bianchi vengono esclusi dal conteggio. Durante la fase di anteprima, i costi sono scontati al 100%. Le richieste di previsione che portano a risposte filtrate vengono addebitate solo per l'input. Alla fine di ogni ciclo di fatturazione, le frazioni di un centesimo di dollaro (0,01 $) vengono arrotondate a un centesimo.

Nota: i prezzi delle previsioni per gli endpoint del modello ottimizzato sono gli stessi del foundation model di base.

Modello

Tipo

Regione

Tipo di richiesta

Prezzo per 1000 token (USD)

Codey per il completamento del codice

Input

Globale

Richieste online

0,00025 USD

Output

Globale

Richieste online

0,0005 USD

I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

Traduzione (testo)

Utilizza l'API Agent Platform e il modello LLM di traduzione per tradurre il testo. Le traduzioni LLM tendono a essere più fluide e a suonare più umane rispetto ai modelli di traduzione classici, ma hanno un supporto linguistico più limitato (Scopri di più).

Modello

Metodo

Utilizzo

Prezzo Prezzo /1 Mln di token (USD)

LLM

Traduzione di testi*

Il numero di caratteri di input al mese

10,00 USD

Il numero di caratteri di output al mese

10,00 USD

LLM di traduzione 002

Traduzione di testi*

Il numero di caratteri di input al mese

20,00 USD

Il numero di caratteri di output al mese

20,00 USD

I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

*Il prezzo è per carattere elaborato dal modello. Per informazioni dettagliate sui caratteri conteggiati, consulta Caratteri addebitati

Prezzo di archiviazione nella cache di contesto per la memorizzazione esplicita nella cache

Questa tabella contiene i prezzi per l'archiviazione della cache di contesto in base all'input (testo, immagine, video, audio)

Modello

Prezzo token/ora<= 200.000 token di input

Prezzo token/ora > 200.000 token di input

Gemini 3.1 Pro

0,0000045 USD0,0000045 USD

Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3 Flash

0,000001 USD0,000001 USD

Gemini 3.5 Flash Lite, Gemini 3.1 Flash Lite

0,000001 USD0,000001 USD

Gemini 3 Pro

0,0000045 USD0,0000045 USD

Gemini 2.5 Pro

0,0000045 USD0,0000045 USD

Gemini 2.5 Flash

0,000001 USD0,000001 USD

Gemini 2.5 Flash-Lite

0,000001 $ / 1 ora

0,000001 $

Modelli Gemini 2.0

Modello

Tipo

Archiviazione (M tok-hour)

Prezzo /1 (USD)

Gemini 2.0 Flash

Token di input

0,000001 USD0,0375 USD

Token audio di input

0,000001 USD0,25 USD

Token di testo di output

NA

NA

Gemini 2.0 Flash Lite

Token di input

0,000001 USD0,01875 USD

Token audio di input

0,000001 USD0,01875 USD

Token di testo di output

NA

NA

* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.

* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.

I prezzi delle modalità riportati di seguito si basano su casi d'uso medi solo a scopo di riferimento. La fatturazione effettiva si baserà solo sui token:

  • 4 caratteri generano circa 1 token di testo, spazi inclusi.
  • Per un'immagine 1024x1024, consuma 1290 token. Il numero di token per immagine varia in base alla risoluzione dell'immagine. Per maggiori informazioni su come calcolare i token, puoi consultare la nostra documentazione.
  • L'input video consuma 258 token al secondo alla frequenza di campionamento di un frame al secondo. I video con audio vengono fatturati sia per i token video che per i token audio.
  • L'input audio consuma 25 token al secondo senza timestamp.

Modello

Tipo

Archiviazione (modalità-ora)

Prezzo (USD)

Gemini 2.0 Flash

Testo di input ($/M di caratteri)

$ 0,25

0,009375 $

Immagine di input ($/immagine)

0,00129 $

0,000048375 $

Video di input ($/sec)

0,000258 $

0,000009675 $

Audio di input ($/sec)

0,000025 $

0,00000625 $

Testo di output ($/M di caratteri)

NA

NA

Gemini 2.0 Flash Lite

Testo di input ($/M di caratteri)

$ 0,25

0,0046875 $

Immagine di input ($/immagine)

0,00129 $

Video di input ($/sec)

0,000258 $

0,000009675 $

Audio di input ($/sec)

0,000258 $

0,0000048375 $

Testo di output ($/M di caratteri)

NA

NA

* I prezzi sono indicati in dollari statunitensi (USD). Se la valuta utilizzata per il pagamento è diversa da USD, si applicano i prezzi elencati nella tua valuta negli SKU di Cloud Platform.

* I PDF vengono fatturati come input di immagini, con una pagina PDF equivalente a un'immagine.

* L'endpoint del modello ottimizzato ha lo stesso prezzo di previsione del modello di base.

Prezzi con grounding

Funzionalità

Prezzo (USD)

Grounding con la Ricerca Google*

Gemini 2.0 Flash include fino a 1500 richieste basate al giorno senza costi aggiuntivi. Le richieste basate che superano le 1500 al giorno vengono fatturate a 35 $per 1000 richieste (fino a 1 milione di richieste al giorno).

Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di richieste al giorno.

I clienti possono decidere di non mostrare i Suggerimenti di ricerca con i Risultati fondati nell'interfaccia della loro Applicazione del Cliente; tuttavia, ciò è soggetto a prezzi alternativi. Contatta il team dedicato all'account Google Cloud per richiedere questa deroga.

Grounding web per aziende*

45 $ per 1000 richieste (fino a 1 milione di richieste al giorno) a partire dal 5 maggio 2025.

Contatta il team dedicato al tuo account se hai bisogno di più di 1 milione di richieste al giorno.

I clienti possono decidere di non mostrare i Suggerimenti di ricerca con i Risultati fondati nell'interfaccia della loro Applicazione del Cliente; tuttavia, ciò è soggetto a prezzi alternativi. Contatta il team dedicato all'account Google Cloud per richiedere questa deroga.

* Questo si applica ai prezzi basati sulla modalità.

Nota: il grounding con la Ricerca Google viene fatturato solo per le richieste che restituiscono risultati contenenti almeno un URL di supporto per il grounding dal web. Si applicano anche le tariffe standard per l'utilizzo del modello Gemini.

Throughput riservato

Il throughput sottoposto a provisioning garantisce il throughput per le tue esigenze di AI generativa e viene negoziato tramite unità della scala di AI generativa o GSU. Scopri di più sulla quantità di velocità effettiva fornita da ogni GSU qui e usa il nostro strumento di stima online qui.

Durata

Prezzo globale per ora di GSU (USD)

Prezzo non globale*per ora GSU (USD)

Impegno di 1 settimana

7,14 USD7,854 USD

Impegno di 1 mese

3,698630137 USD4,068493151 USD

Impegno di 3 mesi

3,287671233 USD3,616438356 USD

Impegno di 1 anno

2,739726027 USD3,01369863 USD

* Per gli endpoint non globali, i prezzi entreranno in vigore per le famiglie di modelli Gemini 3 e successive disponibili a livello generale il 1° luglio 2026. Prima del 1° luglio 2026, i prezzi degli endpoint globali si applicano agli endpoint non globali.

Esempio di calcolo dei costi

Un utente deve assicurarsi di poter supportare 10 query al secondo (QPS) di una query con input di 1000 token di testo e 500 token audio e ricevere un output di 300 token di testo utilizzando gemini-2.0-flash.

Utilizzando la tabella della velocità effettiva e della velocità di esaurimento, per gemini-2.0-flash sappiamo che la velocità di esaurimento di un token di testo di input è di 1 token, quella di un token audio di input è di 7 token e quella di un token di testo di output è di 4 token.

Il totale dei token di input dell'utente è 1000* (1 token per token di testo di input) + 500* (7 token per token audio di input) = 4500 token di input con riduzione. Il numero totale di token di output dell'utente è 300* (4 token per token di testo di output) = 1200 token di output con riduzione. Sommandoli, otteniamo 4500 token di input con burn-down regolato + 1200 token di output con burn-down regolato = 5700 token totali per query.

Moltiplicando il numero totale di token per query per il QPS otteniamo 5700 token totali per query * 10 QPS = 57.000 token totali al secondo.

Dividendo questo valore per la velocità effettiva totale al secondo per GSU otteniamo 57.000 token totali al secondo ÷ 3360 velocità effettiva al secondo per GSU = 16,96 GSU. L'incremento minimo di acquisto di GSU per questo modello è 1, quindi l'utente avrebbe bisogno di 17 GSU.

Se l'utente volesse mantenere questa velocità effettiva per 1 settimana, il costo sarebbe di 1200 $ * 17 GSU = 20.400 $a settimana. Se volessero mantenere questa velocità effettiva per 1 mese, il costo sarebbe di 2700 $ * 17 GSU = 45.900 $al mese. Se volessero mantenere questa velocità effettiva per 3 mesi, il costo sarebbe di 2400 $ * 17 GSU = 40.800 $al mese. Infine, se volessero mantenere questa velocità effettiva per 1 anno, il costo sarebbe di 2000 $ * 17 GSU = 34.000 $al mese.

Ottimizzazione del modello

L'ottimizzazione del modello è un modo efficace per personalizzare i modelli di grandi dimensioni in base alle tue attività. È un passaggio fondamentale per migliorare la qualità e l'efficienza del modello. La messa a punto del modello offre i seguenti vantaggi:

  • Qualità superiore per le tue attività specifiche
  • Maggiore robustezza del modello
  • Latenza e costi di inferenza inferiori grazie a prompt più brevi

L'ottimizzazione viene addebitata per milione di token di addestramento. I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche. A partire da Gemini 3, il prezzo di previsione dell'endpoint del modello ottimizzato sarà 1,5 volte quello del modello di base. Il prezzo di previsione dei vecchi modelli Gemini (Gemini 2.5 e precedenti) rimane lo stesso del modello di base.

Modello

Tipo

Prezzo (USD)

Gemini 3.5 Flash

Fine-tuning supervisionato

Ottimizzazione del reinforcement learning

0,01 USD

Gemini 3.1 Flash Lite

Fine-tuning supervisionato

0,003 USD

Gemini 2.5 Pro

Fine-tuning supervisionato

0,025 USD

Gemini 2.5 Flash

Fine-tuning supervisionato

Ottimizzazione delle preferenze

0,005 USD

Gemini 2.5 Flash-Lite

Fine-tuning supervisionato

Ottimizzazione delle preferenze

0,0015 USD

Gemma 3 1B IT

Fine-tuning supervisionato

0,47 USD

Gemma 3 4B IT

Fine-tuning supervisionato

1,14 USD

Gemma 3 12B IT

Fine-tuning supervisionato

1,82 USD

Gemma 3 27B IT

Fine-tuning supervisionato

6,83 USD

Medgemma 1.5 4B IT

Fine-tuning supervisionato

1,14 USD

Llama 3.1 8B

Fine-tuning supervisionato

0,67 USD

Llama 3.2 1B

Fine-tuning supervisionato

0,28 USD

Llama 3.2 3B

Fine-tuning supervisionato

0,61 USD

Llama 3.3 70B

Fine-tuning supervisionato

6,72 USD

Llama 4 Scout 17B 16E

Fine-tuning supervisionato

5,77 USD

Qwen 3 4B

Fine-tuning supervisionato

1,35 USD

Qwen 3 8B

Fine-tuning supervisionato

4,18 USD

Qwen 3 14B

Fine-tuning supervisionato

8,46 USD

Qwen 3 32B

Fine-tuning supervisionato

6,57 USD

* I token di addestramento vengono calcolati in base al numero totale di token nel set di dati di addestramento, moltiplicato per il numero di epoche.

* Per l'inferenza del modello a partire da Gemini 3, il prezzo di previsione dell'endpoint del modello ottimizzato sarà 1,5 volte quello del modello di base. Il prezzo di previsione dei vecchi modelli Gemini rimane lo stesso del modello di base.

Caso speciale di ricarica tramite personaggi

Modello

Tipo

Prezzo /1 Mln (USD)

LLM di traduzione 002

Fine-tuning supervisionato

6,25 USD

AlphaEvolve

Il costo di AlphaEvolve è determinato dal costo del modello Gemini utilizzato più il costo dell'agente AlphaEvolve.

Modello di Gemini

Tipo

Prezzo del modello Gemini per 1 M (USD)

Prezzo agente AlphaEvolve /1 Mln (USD)

Prezzo totale /1 Mln (USD)

Gemini 3.1 Pro (anteprima)

Prezzo per 1 M di token di input

2,00 USD4,00 USD

6,00 $

Prezzo per 1 milione di token di output e di ragionamento

12,00 USD24,00 USD

36,00 $

Gemini 3.5 Flash

Prezzo per 1 M di token di input

1,50 USD3,00 USD

$ 4,50

Prezzo per 1 milione di token di output e di ragionamento

9,00 USD18,00 USD

27,00 $

Modelli di partner su Agent Platform

I modelli partner sono un elenco selezionato di modelli di AI generativa sviluppati dai partner di Google. I modelli dei partner vengono offerti come API gestite. Per saperne di più, consulta Panoramica dei modelli partner. Le sezioni seguenti elencano i dettagli dei prezzi per i modelli dei partner Google.

Modelli Claude di Anthropic

Modelli con prezzi regionali

Modello

Tipo

ModelPrice (/1M tokens) =< 200K input tokens

Prezzo (/1 M di token) > 200.000 token di input

Opus 5

Input

5,00 $

5,00 $

Output

$ 25,00

$ 25,00

Input batch

$ 2,50

Output batch

12,50 $

Scrittura cache di 5 min

6,25 $

6,25 $

Scrittura cache 1 ora

$ 10,00

$ 10,00

Successo della cache

0,50 $

0,50 $

Scrittura cache batch da 5 m

3,125 $

Scrittura cache batch 1 ora

5,00 $

Riscontro nella cache batch

$ 0,25

Claude Sonnet 5 (prezzo promozionale fino al 31 agosto 2026)

Input

2,00 $

2,00 $

Output

$ 10,00

$ 10,00

Input batch

1,00 $

1,00 $

Output batch

5,00 $

5,00 $

Scrittura cache di 5 min

$ 2,50

$ 2,50

Scrittura cache 1 ora

$ 4,00

$ 4,00

Successo della cache

$ 0,20

$ 0,20

Claude Sonnet 5 (prezzo standard a partire dal 1° settembre 2026)

Input

$ 3,00

$ 3,00

Output

15,00 $

15,00 $

Input batch

$ 1,50$ 1,50

Output batch

$ 7,50

$ 7,50

Scrittura cache di 5 min

$ 3,75

$ 3,75

Scrittura cache 1 ora

6,00 $

6,00 $

Successo della cache

$ 0,30

$ 0,30

Claude Fable 5

Input

$ 10,00

$ 10,00

Output

$ 50,00

$ 50,00

Input batch

5,00 $

Output batch

$ 25,00

Scrittura cache di 5 min

12,50 $

12,50 $

Scrittura cache 1 ora

$ 20,00

$ 20,00

Successo della cache

1,00 $

1,00 $

Scrittura cache batch da 5 m

6,25 $

Scrittura cache batch 1 ora

$ 10,00

Riscontro nella cache batch

0,50 $

Claude Opus 4.8

Input

5,00 $

5,00 $

Output

$ 25,00

$ 25,00

Input batch

$ 2,50

Output batch

12,50 $

Scrittura cache di 5 min

6,25 $

6,25 $

Scrittura cache 1 ora

$ 10,00

$ 10,00

Successo della cache

0,50 $

0,50 $

Scrittura cache batch da 5 m

3,125 $

Scrittura cache batch 1 ora

5,00 $

Riscontro nella cache batch

$ 0,25

Claude Opus 4.7

Input

5,00 $

5,00 $

Output

$ 25,00

$ 25,00

Input batch

$ 2,50

Output batch

12,50 $

Scrittura cache di 5 min

6,25 $

6,25 $

Scrittura cache 1 ora

$ 10,00

$ 10,00

Successo della cache

0,50 $

0,50 $

Scrittura cache batch da 5 m

3,125 $

Scrittura cache batch 1 ora

5,00 $

5,00 $

Riscontro nella cache batch

$ 0,25

Claude Opus 4.6

Input

5,00 $

5,00 $

Output

$ 25,00

$ 25,00

Input batch

$ 2,50

Output batch

12,50 $

Scrittura cache di 5 min

6,25 $

6,25 $

Scrittura cache 1 ora

$ 10,00

$ 10,00

Successo della cache

0,50 $

0,50 $

Scrittura cache batch da 5 m

3,125 $

Scrittura cache batch 1 ora

5,00 $

Riscontro nella cache batch

$ 0,25

Claude Opus 4.5

Input

5,00 $

Output

$ 25,00

Input batch

$ 2,50

Output batch

12,50 $

Scrittura cache di 5 min

6,25 $

Scrittura cache 1 ora

$ 10,00

Successo della cache

0,50 $

Scrittura cache batch da 5 m

3,125 $

Scrittura cache batch 1 ora

5,00 $

Riscontro nella cache batch

$ 0,25

Claude Sonnet 4.6

Input

$ 3,00

$ 3,00

Output

15,00 $

15,00 $

Input batch

$ 1,50

Output batch

$ 7,50

Scrittura cache di 5 min

$ 3,75

$ 3,75

Scrittura cache 1 ora

6,00 $

6,00 $

Successo della cache

$ 0,30

$ 0,30

Scrittura cache batch da 5 m

1,88 $

Scrittura cache batch 1 ora

$ 3,00

Riscontro nella cache batch

$ 0,15

Claude Sonnet 4.5

Input

$ 3,00

6,00 $

Output

15,00 $

22,50 $

Input batch

$ 1,50

Output batch

$ 7,50

Scrittura cache di 5 min

$ 3,75

$ 7,50

Scrittura cache 1 ora

6,00 $

12,00 $

Successo della cache

$ 0,30

$ 0,60

Scrittura cache batch da 5 m

1,88 $

Scrittura cache batch 1 ora

$ 3,00

Riscontro nella cache batch

$ 0,15

Scrittura cache batch da 5 m

1,00 $

Claude Haiku 4.5

Input

1,00 $

Output

5,00 $

Input batch

0,50 $

Output batch

$ 2,50

Scrittura cache di 5 min

$ 1,25

Riscontro nella cache batch

0,05 $

Scrittura cache 1 ora

2,00 $

Successo della cache

0,10 $

Scrittura cache batch da 5 m

$ 0,625

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Modello

Tipo

Prezzo (per 1 M di token) =< 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Opus 5

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Sonnet 5 (prezzo promozionale fino al 31 agosto 2026)

Input

$ 2,20

$ 2,20

Output

11,00 $

11,00 $

Input batch

1,10 $

1,10 $

Output batch

5,50 $

5,50 $

Scrittura cache di 5 min

2,75 $

2,75 $

Scrittura cache 1 ora

$ 4,40

$ 4,40

Successo della cache

$ 0,22

$ 0,22

Claude Sonnet 5 (prezzo standard a partire dal 1° settembre 2026)

Input

3,30 $

3,30 $

Output

$ 16,50

$ 16,50

Input batch

1,65 $

1,65 $

Output batch

8,25 $

8,25 $

Scrittura cache di 5 min

4125 $

4125 $

Scrittura cache 1 ora

6,60 $

6,60 $

Successo della cache

$ 0,33

$ 0,33

Claude Fable 5

Input

 11,00 $

 11,00 $

Output

55,00 $

55,00 $

Input batch

5,50 $

Output batch

27,50 $

Scrittura cache di 5 min

13,75 $

13,75 $

Scrittura cache 1 ora

$ 22,00

$ 22,00

Successo della cache

1,10 $

1,10 $

Scrittura cache batch da 5 m

6,875 $

Scrittura cache batch 1 ora

11,00 $

Riscontro nella cache batch

$ 0,55

Claude Opus 4.8

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Opus 4.7

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Modello

Tipo

Prezzo (per 1 M di token) =< 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Opus 5

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Sonnet 5 (prezzo promozionale fino al 31 agosto 2026)

Input

$ 2,20

$ 2,20

Output

11,00 $

11,00 $

Input batch

1,10 $

1,10 $

Output batch

5,50 $

5,50 $

Scrittura cache di 5 min

2,75 $

2,75 $

Scrittura cache 1 ora

$ 4,40

$ 4,40

Successo della cache

$ 0,22

$ 0,22

Claude Sonnet 5 (prezzo standard a partire dal 1° settembre 2026)

Input

3,30 $

3,30 $

Output

$ 16,50

$ 16,50

Input batch

1,65 $

1,65 $

Output batch

8,25 $

8,25 $

Scrittura cache di 5 min

4125 $

4125 $

Scrittura cache 1 ora

6,60 $

6,60 $

Successo della cache

$ 0,33

$ 0,33

Claude Fable 5

Input

11,00 $

11,00 $

Output

55,00 $

55,00 $

Input batch

5,50 $

Output batch

27,50 $

Scrittura cache di 5 min

13,75 $

13,75 $

Scrittura cache 1 ora

$ 22,00

$ 22,00

Successo della cache

1,10 $

1,10 $

Scrittura cache batch da 5 m

6,875 $

Scrittura cache batch 1 ora

11,00 $

Riscontro nella cache batch

$ 0,55

Claude Opus 4.8

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Opus 4.7

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Modello

Tipo

Prezzo (per 1 M di token) =< 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Claude Opus 4.6

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Opus 4.5

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Sonnet 4.6

Input

3,30 $

3,30 $

Output

$ 16,50

$ 16,50

Input batch

1,65 $

Output batch

8,25 $

Scrittura cache di 5 min

4,13 $

4,13 $

Scrittura cache 1 ora

6,60 $

6,60 $

Successo della cache

$ 0,33

$ 0,33

Scrittura cache batch da 5 m

2,06 $

Scrittura cache batch 1 ora

3,30 $

Riscontro nella cache batch

0,17 $

Input

6,60 $

Output

24,75 $

Claude Sonnet 4.5

Input

3,30 $

6,60 $

Output

$ 16,50

24,75 $

Input batch

1,65 $

Output batch

8,25 $

Scrittura cache di 5 min

4,13 $

8,25 $

Scrittura cache 1 ora

6,60 $

13,20 $

Successo della cache

$ 0,33

0,66 $

Scrittura cache batch da 5 m

2,06 $

Riscontro nella cache batch di 1 ora

3,30 $

Riscontro nella cache batch

0,17 $

Claude Haiku 4.5

Input

1,10 $

Output

5,50 $

Input batch

$ 0,55

Output batch

2,75 $

Scrittura cache di 5 min

1,375 $

Scrittura cache 1 ora

$ 2,20

Scrittura nella cache

1,375 $

Successo della cache

$ 0,11

Scrittura cache batch da 5 m

0,688 $

Scrittura cache batch 1 ora

1,10 $

Riscontro nella cache batch

0,055 $

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Modello

Tipo

Prezzo (per 1 M di token) =< 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Claude Opus 4.6

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Opus 4.5

Input

5,50 $

Output

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

Scrittura cache 1 ora

11,00 $

Successo della cache

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Sonnet 4.6

Input

3,30 $

3,30 $

Output

$ 16,50

$ 16,50

Input batch

1,65 $

Output batch

8,25 $

Scrittura in batch di 5 mln

4,13 $

4,13 $

Scrittura cache 1 ora

6,60 $

6,60 $

Successo della cache

$ 0,33

$ 0,33

5 mln di riscontri nella cache batch

2,06 $

Scrittura cache batch 1 ora

3,30 $

Riscontro nella cache batch

0,17 $

Claude Sonnet 4.5

Input

3,30 $

6,60 $

Output

$ 16,50

24,75 $

Input batch

1,65 $

Output batch

8,25 $

Scrittura cache di 5 min

4,13 $

8,25 $

Scrittura cache 1 ora

6,60 $

13,20 $

Successo della cache

$ 0,33

0,66 $

Scrittura cache batch da 5 m

2,06 $

Scrittura cache batch 1 ora

3,30 $

Riscontro nella cache batch

0,17 $

Claude Haiku 4.5

Input

1,10 $

Output

5,50 $

Input batch

$ 0,55

Output batch

2,75 $

Scrittura cache di 5 min

1,375 $

Scrittura cache 1 ora

$ 2,20

Successo della cache

$ 0,11

Scrittura cache batch da 5 m

0,688 $

Scrittura cache batch 1 ora

1,10 $

Riscontro nella cache batch

0,055 $

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Modello

Tipo

Prezzo (per 1 M di token) =< 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Claude Opus 4.6

Input

5,50 $

5,50 $

Output

27,50 $

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

6,875 $

Scrittura cache 1 ora

11,00 $

11,00 $

Successo della cache

$ 0,55

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Opus 4.5

Input

5,50 $

Output

27,50 $

Input batch

2,75 $

Output batch

13,75 $

Scrittura cache di 5 min

6,875 $

Scrittura cache 1 ora

11,00 $

Successo della cache

$ 0,55

Scrittura cache batch da 5 m

3,438 $

Scrittura cache batch 1 ora

5,50 $

Riscontro nella cache batch

0,275 $

Claude Sonnet 4.6

Input

3,30 $

3,30 $

Output

$ 16,50

$ 16,50

Input batch

1,65 $

Output batch

8,25 $

Scrittura cache di 5 min

4,13 $

4,13 $

Scrittura cache 1 ora

6,60 $

6,60 $

Successo della cache

$ 0,33

Scrittura cache batch da 5 m

2,06 $

Scrittura cache batch 1 ora

3,30 $

Riscontro nella cache batch

0,17 $

Claude Sonnet 4.5

Input

3,30 $

6,60 $

Output

$ 16,50

24,75 $

Input batch

1,65 $

Output batch

8,25 $

Scrittura cache di 5 min

4,13 $

8,25 $

Scrittura cache 1 ora

6,60 $

13,20 $

Successo della cache

$ 0,33

0,66 $

Scrittura cache batch da 5 m

2,06 $

Scrittura cache batch 1 ora

3,30 $

Riscontro nella cache batch

0,17 $

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Modello

Tipo

Prezzo (per 1 M di token) =< 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Claude Haiku 4.5

Input

1,10 $

Output

5,50 $

Input batch

$ 0,55

Output batch

2,75 $

Scrittura cache di 5 min

1,375 $

Scrittura cache 1 ora

$ 2,20

Successo della cache

$ 0,11

Scrittura cache batch da 5 m

0,688 $

Scrittura cache batch 1 ora

1,10 $

Riscontro nella cache batch

0,055 $

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Modelli con prezzi uniformi in tutte le regioni

Modello

Tipo

Prezzo (per 1 M di token) =< 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Claude Opus 4.1

Input

15 $

N/A

Output

75 $

N/A

Input batch

$ 7,50

N/A

Output batch

37,50 $

N/A

Scrittura cache di 5 min

18,75 $

N/A

Scrittura cache 1 ora

30 $

N/A

Successo della cache

$ 1,50

N/A

Scrittura cache batch da 5 m

9,375 $

N/A

Scrittura cache batch 1 ora

15,00 $

N/A

Riscontro nella cache batch

$ 0,75

N/A

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Prezzi degli strumenti

Strumento

Prezzo (USD)

Richiesta di ricerca web

10$ogni 1000 ricerche

Modelli supportati: Claude Haiku 4.5, Claude Sonnet 4.5, Claude Sonnet 4.6, Claude Sonnet 4, Claude Opus 4.1, Claude Opus 4, Claude Opus 4.5 e Claude Opus 4.6.

* Se il contesto di input di una query è maggiore o uguale a 200.000 token, tutti i token (input e output) vengono addebitati alle tariffe per contesto lungo.

Modelli Grok di xAI

Modello

Tipo

Prezzo (per 1 M di token) =< 200.000 token di input

Prezzo (/1 M di token) > 200.000 token di input

Ragionamento di Grok 4.20

Input

$ 1,25

$ 2,50

Output

$ 2,50

5,00 $

Successo della cache

$ 0,20

$ 0,40

Grok 4.20 Non-Reasoning

Input

$ 1,25

$ 2,50

Output

$ 2,50

5,00 $

Successo della cache

$ 0,20

$ 0,40

Grok 4.3

Input

$ 1,25

$ 2,50

Output

$ 2,50

5,00 $

Successo della cache

$ 0,20

$ 0,40

* Se il contesto di input di una query è più lungo di 200.000 token, tutti i token vengono addebitati alle tariffe per contesto lungo.

Modello

Tipo

Prezzo per 1 M di token (USD)

Grok 4.1 Fast Reasoning

Input

$ 0,20

Output

0,50 $

Successo della cache

0,05 $

Grok 4.1 Fast Non-Reasoning

Input

$ 0,20

Output

0,50 $

Successo della cache

0,05 $

Modelli di Deepseek

Modello

Tipo

Prezzo /1 Mln (USD)

DeepSeek-V3.1

Input

0,60 USD

Output

1,70 USD

Successo della cache

0,06 USD

Input batch

0,30 USD

Output batch

0,85 USD

DeepSeek-V3.2

Input

0,56 USD

Output

1,68 USD

Successo della cache

0,056 USD

Input batch

$0,28

Output batch

$0.84

DeepSeek-R1 (0528)

Input

1,35 USD

Output

5,40 USD

Input batch

0,675 USD

Output batch

2,70 USD

DeepSeek-OCR

Input

0,30 USD

Output

1,20 USD

Modelli di MiniMax

Modello

Tipo

Prezzo /1 Mln (USD)

MiniMax-M2

Input

0,30 USD

Output

1,20 USD

Successo della cache

0,03 USD

Modelli di Moonshot

Modello

Tipo

Prezzo /1 Mln (USD)

Kimi-K2-Thinking

Input

0,60 USD

Output

2,50 USD

Successo della cache

0,06 USD

Modelli di Qwen

Modello

Tipo

Prezzo /1 Mln (USD)

Qwen3-Next-80B-Thinking

Input

0,15 USD

Output

1,20 USD

Qwen3-Next-80B-Instruct

Input

0,15 USD

Output

1,20 USD

Qwen3-Coder-480B-A35B-Instruct

Input

0,22 USD

Output

1,80 USD

Successo della cache

0,022 USD

Input batch

0,11 USD

Output batch

0,90 USD

Qwen3-235B-A22B-Instruct-2507

Input

0,22 USD

Output

0,88 USD

Input batch

0,11 USD

Output batch

0,44 USD

Modelli GLM

Modello

Tipo

Prezzo /1 Mln (USD)

GLM-4.7

Input

0,60 USD

Output

2,20 USD

Successo della cache

0,06 USD

GLM-5 *

Input

1,00 USD

Output

3,20 USD

Successo della cache

0,10 USD

Modelli di OpenAI

Modello

Tipo

Prezzo /1 Mln (USD)

gpt-oss-120b

Input

0,09 USD

Output

0,36 USD

Input batch

0,045 USD

Output batch

0,18 USD

gpt-oss-20b

Input

0,07 USD

Output

0,25 USD

Successo della cache

0,007 USD

Input batch

0,035 USD

Output batch

0,125 USD

Modelli Llama di Meta

Modello

Tipo

Prezzo /1 Mln (USD)

Llama 3.3 70B

Input

0,72 USD

Output

0,72 USD

Input batch

0,36 USD

Output batch

0,36 USD

Lama 4 Scout

Input

0,25 USD

Output

0,70 USD

Input batch

0,125 USD

Output batch

0,35 USD

Llama 4 Maverick

Input

0,35 USD

Output

1,15 USD

Input batch

0,175 USD

Output batch

0,575 USD

Modelli di Mistral AI

Modello

Tipo

Prezzo /1 Mln (USD)

Mistral OCR (25.05)

Input

0,0005 $ (o 0,0005 $/pagina)

Output

0,0005 $ (o 0,0005 $/pagina)

Mistral Medium 3

Input

$ 0,40

Output

2,00 $

Mistral Small 3.1 (25.03)

Input

0,10 $

Output

$ 0,30

Codestral 2

Input

$ 0,30

Output

$ 0,90

Richiedi un preventivo personalizzato

Grazie ai prezzi con pagamento a consumo di Google Cloud, paghi solo per i servizi che utilizzi. Per ricevere un preventivo personalizzato per la tua organizzazione, contatta il nostro team di vendita.
Google Cloud