In Cloud Run werden nur tatsächlich genutzte Ressourcen berechnet, auf eine Zehntelsekunde genau. Die Gesamtrechnung für Cloud Run ist die Summe der Ressourcennutzung in der Preistabelle nach Anwendung der kostenlosen Stufe.
Wenn Sie für concurrency einen Wert festlegen, der höher ist als eine Anfrage gleichzeitig, können sich mehrere Anfragen die zugewiesene CPU und den Arbeitsspeicher einer Instanz teilen.
Für ausgehende Internetdatenübertragungen wird die Premium-Netzwerkdienststufe verwendet und die Google Cloud-Netzwerkpreise gelten. Dabei ist eine kostenlose Stufe von 1 GiB Datenübertragung innerhalb Nordamerikas pro Monat enthalten.
Die Datenübertragung in VPC-Netzwerke (Virtual Private Cloud) wird als Datenübertragung von einer VM abgerechnet und zu den Tarifen für die Datenübertragung in VPC-Netzwerken berechnet. Für Connectors für serverlosen VPC-Zugriff wird auch die für ihre Ausführung erforderliche Rechenleistung in Rechnung gestellt. Siehe Preise für serverlosen VPC-Zugriff.
Für die Datenübertragung zu Google Cloud-Ressourcen in derselben Region fallen keine Gebühren an (z. B. für Traffic von einem Cloud Run-Dienst zu einem anderen Cloud Run-Dienst). Für die Datenübertragung zu Media CDN, Cloud CDN und Cloud Load Balancing fallen keine Gebühren an.
Bei der Bewertung der Preise von Cloud Run sollten Sie Folgendes berücksichtigen:
Preisrechner
Mit dem Google Cloud-Preisrechner können Sie die Kosten für die Verwendung von Cloud Run schätzen.
In den folgenden Preistabellen wird die Einheit GiB-Sekunde verwendet. Ein GiB-Sekunden-Wert bedeutet beispielsweise, dass eine 1-Gibibyte-Instanz 1 Sekunde lang ausgeführt wird oder eine 256-Mebibyte-Instanz 4 Sekunden lang. Dasselbe Prinzip gilt für die Einheit vCPU-Sekunde. CUD steht für Rabatte für zugesicherte Nutzung.
Die Nutzung der kostenlosen Stufe wird über alle Projekte nach Rechnungskonto zusammengefasst und jeden Monat zurückgesetzt. Ihnen wird nur die Nutzung über die kostenlose Stufe hinaus in Rechnung gestellt. Die kostenlose Stufe wird als ausgabenbasierter Rabatt mit Preisstufe 1 angewendet.
Die Preise für Cloud Run hängen von der ausgewählten Region ab. Die Preise für Cloud Run-Dienste hängen auch von der Abrechnungskonfiguration ab.
Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die Preise, die unter Cloud Platform SKUs für Ihre Währung angegeben sind.
Dienste (instanzbasierte Abrechnung)
Dienste mit instanzbasierter Abrechnung
Kostenlose Stufe (basierend auf den Preisen für us-central1):
Ressource | Standard (USD) * | Cloud Run CUD - 1 Year* (USD) | Cloud Run CUD - 3 Year* (USD) | Compute Flexible CUD - 1 Year* (USD) | Compute Flexible CUD - 3 Year* (USD) |
|---|---|---|---|---|---|
CPU (pro vCPU-Sekunde) | 0,000018 $ | 0,00001494 $ | 0,00001494 $ | 0,00001296 $ | 0,00000972 $ |
Arbeitsspeicher (pro GiB-Sekunde) | 0,000002 $ | 0,00000166 $ | 0,00000166 $ | 0,00000144 $ | 0,00000108 $ |
GPU-Typ NVIDIA L4 ohne zonale Redundanz (pro Sekunde) | 0,0001867 $ | - | - | - | - |
GPU-Typ NVIDIA L4, zonale Redundanz (pro Sekunde) | 0,0002909 $ | - | - | - | - |
GPU-Typ NVIDIA RTX PRO 6000 ohne zonale Redundanz (pro Sekunde) | 0,00036522 $ | - | - | - | - |
GPU-Typ NVIDIA RTX PRO 6000, zonale Redundanz (pro Sekunde) | 0,00056913 $ | - | - | - | - |
Cloud Run-Rabatte für zugesicherte Nutzung gelten nur für Cloud Run-Ressourcen. Für mehr Flexibilität verwenden Sie bitte flexible CUDs für Compute.
Flexibler CUD bezieht sich auf flexible Rabatte für zugesicherte Nutzung.
Dienste (anfragebasierte Abrechnung)
Dienste mit anfragebasierter Abrechnung während der abgerechneten Instanzzeit
Kostenlose Stufe (basierend auf den aktiven Preisen für us-central1):
Ressource | Typ | Standard (USD) * | Cloud Run CUD - 1 Year* (USD) | Cloud Run CUD - 3 Year* (USD) | Compute Flexible CUD - 1 Year* (USD) | Compute Flexible CUD - 3 Year* (USD) |
|---|---|---|---|---|---|---|
CPU (pro vCPU-Sekunde) | Aktivitätszeit | 0,000024 $ | 0,00001992 $ | 0,00001992 $ | 0,00001992 $ | 0,00001992 $ |
Leerlaufzeit (Mindestanzahl von Instanzen:1) | 0,0000025 $ | 0,000002075 $ | 0,000002075 $ | 0,000002075 $ | 0,000002075 $ | |
Arbeitsspeicher (pro GiB-Sekunde) | Aktivitätszeit | 0,0000025 $ | 0,000002075 $ | 0,000002075 $ | 0,000002075 $ | 0,000002075 $ |
Leerlaufzeit (Mindestanzahl von Instanzen:1) | 0,0000025 $ | 0,000002075 $ | 0,000002075 $ | 0,000002075 $ | 0,000002075 $ | |
Anfragen (pro 1.000.000) | – | 0,40 $ | 0,332 $ | 0,332 $ | 0,332 $ | 0,332 $ |
1 Inaktive Mindestinstanz bezieht sich auf die abrechenbare Zeit im Leerlauf für Instanzen, die mit Mindestinstanzen einsatzbereit gehalten werden. Inaktive Instanzen, die nicht zu den Mindestinstanzen gehören, werden nicht berechnet.
Anfragen werden nur dann abgerechnet, wenn sie den Container nach erfolgreicher Authentifizierung erreichen. Anfragen, die von der IAM-Richtlinie abgelehnt werden, werden nicht abgerechnet.
Cloud Run-Rabatte für zugesicherte Nutzung gelten nur für Cloud Run-Ressourcen. Für mehr Flexibilität verwenden Sie bitte flexible CUDs für Compute.
CUD steht für Rabatte für zugesicherte Nutzung.
Jobs
Kostenlose Stufe (basierend auf den Preisen für us-central1):
Ressource | Standard (USD) * | Cloud Run CUD - 1 Year* (USD) | Cloud Run CUD - 3 Year* (USD) | Compute Flexible CUD - 1 Year* (USD) | Compute Flexible CUD - 3 Year* (USD) |
|---|---|---|---|---|---|
CPU (pro vCPU-Sekunde) | 0,000018 $ | 0,00001494 $ | 0,00001494 $ | 0,00001296 $ | 0,00000972 $ |
Arbeitsspeicher (pro GiB-Sekunde) | 0,000002 $ | 0,00000166 $ | 0,00000166 $ | 0,00000144 $ | 0,00000108 $ |
GPU-Typ NVIDIA L4 ohne zonale Redundanz (pro Sekunde) | 0,0001867 $ | - | - | - | - |
GPU-Typ NVIDIA RTX PRO 6000 ohne zonale Redundanz (pro Sekunde) | 0,00036522 $ | - | - | - | - |
Cloud Run-Rabatte für zugesicherte Nutzung gelten nur für Cloud Run-Ressourcen. Für mehr Flexibilität verwenden Sie bitte flexible CUDs für Compute.
Flexibler CUD bezieht sich auf flexible Rabatte für zugesicherte Nutzung.
Verzögerte Jobs
Kostenloses Kontingent (basierend auf den Preisen für us-central1):
Ressource | Standard (USD)* | Compute Flexible CUD - 1 Year* (USD) | Compute Flexible CUD - 3 Year* (USD) |
|---|---|---|---|
CPU (pro vCPU-Sekunde) | 0,0000126 $ | 0,000009072 $ | 0,000006804 $ |
Arbeitsspeicher (pro GiB-Sekunde) | 0,0000014 $ | 0,000001008 $ | 0,000000756 $ |
GPU-Typ NVIDIA L4 ohne zonale Redundanz (pro Sekunde) | 0,0001867 $ | - | - |
GPU-Typ NVIDIA RTX PRO 6000 ohne zonale Redundanz (pro Sekunde) | 0,00036522 $ | - | - |
Hinweis: Die Preise für verzögerte Jobs sind dynamisch und können sich bis zu einmal alle 30 Tage ändern.
Cloud Run-Rabatte für zugesicherte Nutzung gelten nur für Cloud Run-Ressourcen. Für mehr Flexibilität verwenden Sie bitte flexible CUDs für Compute.
Flexibler CUD bezieht sich auf Compute-Rabatte für die flexible zugesicherte Nutzung.
Worker-Pools
Kostenlose Stufe (basierend auf den Preisen für us-central1):
Ressource | Standard (USD) * | Compute Flexible CUD - 1 Year* (USD) | Compute Flexible CUD - 3 Year* (USD) |
|---|---|---|---|
CPU (pro vCPU-Sekunde) | 0,000011244 $ | 0,000008096 $ | 0,000006072 $ |
Arbeitsspeicher (pro GiB-Sekunde) | 0,000001235 $ | 0,000000889 $ | 0,000000667 $ |
GPU-Typ NVIDIA L4 ohne zonale Redundanz (pro Sekunde) | 0,0001867 $ | - | - |
GPU-Typ NVIDIA L4, zonale Redundanz (pro Sekunde) | 0,0002909 $ | - | - |
GPU-Typ NVIDIA RTX PRO 6000 ohne zonale Redundanz (pro Sekunde) | 0,00036522 $ | - | - |
GPU-Typ NVIDIA RTX PRO 6000, zonale Redundanz (pro Sekunde) | 0,00056913 $ | - | - |
Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die Preise, die unter Cloud Platform SKUs für Ihre Währung angegeben sind.
Flexibler CUD bezieht sich auf flexible Rabatte für zugesicherte Nutzung.
Instanzen
Ressource | Standard (USD) * | Compute Flexible CUD - 1 Year* (USD) | Compute Flexible CUD - 3 Year* (USD) |
|---|---|---|---|
CPU (pro vCPU-Sekunde) | 0,00000027 $ | 0,000000194 $ | 0,000000146 $ |
Arbeitsspeicher (pro GiB-Sekunde) | 0,00000193 $ | 0,00000139 $ | 0,000001042 $ |
Wenn Sie in einer anderen Währung als US-Dollar bezahlen, gelten die unter Cloud Platform SKUs für Ihre Währung angegebenen Preise.
Flexible CUDs sind flexible Rabatte für zugesicherte Nutzung für Compute Engine.
Flüchtiges Laufwerk
Ressource | Standard-USD * (USD) | Compute Flexible CUD - 1 Year* (USD) | Compute Flexible CUD - 3 Year* (USD) |
|---|---|---|---|
Flüchtiges Laufwerk | 0,000109589 $ / 1 gibibyte hour | 0,000078904 $ / 1 gibibyte hour | 0,000059178 $ / 1 gibibyte hour |
Unterliegt Preisstufe 1
Unterliegt Preisstufe 2
Die abrechenbare Zeit, die von allen Cloud Run-Instanzen zusammengefasst wurde, wird als Cloud Monitoring-Messwert angezeigt. Weitere Informationen finden Sie unter Messwert „container/billable_instance_time“.
Die abrechenbare Instanzzeit wird auf die nächste Zehntelsekunde aufgerundet und hängt von der Abrechnungskonfiguration Ihres Cloud Run-Dienstes ab:
Abrechenbare Instanzzeit für Dienste mit anfragebasierter Abrechnung
Standardmäßig werden in Cloud Run nur die CPU und die Arbeitsspeicherzuweisung berechnet, die einer Instanz zugewiesen sind, wenn:
Wenn Sie eine Mindestanzahl von Instanzen festlegen, wird Ihnen auch ein anderer „Leerlauf“-Tarif in Rechnung gestellt, wenn diese Instanzen keine Anfragen verarbeiten. Siehe Tabelle oben.
Abrechenbare Instanzzeit für Dienste mit instanzbasierter Abrechnung
Wenn Sie die instanzbasierte Abrechnung aktivieren, wird Ihnen die gesamte Lebensdauer von Cloud Run-Containerinstanzen in Rechnung gestellt: von dem Zeitpunkt, an dem der Container gestartet wird, bis zu dem Zeitpunkt, an dem er beendet wird, mindestens jedoch 1 Minute.
Abrechenbare Instanzzeit für Cloud Run-Jobs
Cloud Run-Jobs werden zum Tarif der instanzbasierten Abrechnung für die gesamte Lebensdauer jeder gestarteten Instanz abgerechnet, mindestens jedoch für 1 Minute.
Beispiel 1: Öffentliche API/Website – Datenzugriff durch externe Anwendung
Angenommen, Sie haben einen Cloud Run-Dienst mit anfragebasierter Abrechnung in europe-west1 (Belgien) bereitgestellt, um Websites, Webanwendungen, APIs oder mobile Backends bereitzustellen. Ihr Dienst erhält 10 Millionen Anfragen pro Monat mit einer durchschnittlichen Latenz von 400 Millisekunden pro Anfrage. Dieser Dienst ist mit 1 vCPU, 512 MiB Arbeitsspeicher und maximal 20 gleichzeitigen Anfragen pro Instanz konfiguriert. Das Trafficmuster folgt einem 24-Stunden-Zyklus, wobei das Anfragevolumen über 12 Stunden in einer Glockenkurvenverteilung schwankt.
Die geschätzten monatlichen Kosten für diese Arbeitslast betragen 13,69 $. Ohne das kostenlose Kontingent für vCPU/Arbeitsspeicher würden die Kosten 18, 91 $ betragen.
Wenn Sie sich die Berechnungen genauer ansehen und Einstellungen und Nutzungsschätzungen anpassen möchten, verwenden Sie den Preisrechner.
Beispiel 2: Einzelne Nebenläufigkeit – CPU-intensive/nicht threadsichere App, eine Anfrage pro Instanz
Angenommen, Sie haben einen Cloud Run-Dienst in europe-west1 (Belgien) mit anfragebasierter Abrechnung für eine CPU-intensive, nicht threadsichere Anwendung bereitgestellt, die jeweils eine Anfrage verarbeitet. Ihr Dienst erhält 10 Millionen Anfragen pro Monat mit einer durchschnittlichen Latenz von 400 Millisekunden pro Anfrage. Dieser Dienst ist mit 1 vCPU und 512 MiB Arbeitsspeicher konfiguriert.
Die geschätzten monatlichen Kosten für diese Arbeitslast betragen 81,72 $. Ohne das kostenlose Kontingent für vCPU/Arbeitsspeicher würden die Kosten 86, 49 $ betragen.
Wenn Sie sich die Berechnungen genauer ansehen und Einstellungen und Nutzungsschätzungen anpassen möchten, verwenden Sie den Preisrechner.
Beispiel 3: KI-Inferenzendpunkt – Lokale Modellbereitstellung mit Ollama
Angenommen, Sie haben einen Cloud Run-Dienst in „europe-west1“ (Belgien) bereitgestellt, um in Echtzeit GPU-beschleunigte LLM- oder Bildgenerierung bereitzustellen. Dieser Dienst ist mit 4 vCPUs, 16 GiB Arbeitsspeicher und NVIDIA-L4 (keine zonale Redundanz) konfiguriert. Dieser Dienst erreicht einen täglichen Höchststand von 2 Instanzen und das Traffic-Muster folgt einem 24-Stunden-Zyklus, wobei das Anfragevolumen über 12 Stunden in einer Glockenkurvenverteilung schwankt.
Die geschätzten monatlichen Kosten für diese Arbeitslast betragen 822,40 $. Ohne das kostenlose Kontingent für vCPU/Arbeitsspeicher würden die Kosten 827, 62 $ betragen.
Wenn Sie sich die Berechnungen genauer ansehen und Einstellungen und Nutzungsschätzungen anpassen möchten, verwenden Sie den Preisrechner.
Beispiel 4: Serverlose Funktion – schlanke FaaS für die Größenänderung von Bildern beim Hochladen
Angenommen, Sie haben einen Cloud Run-Dienst mit anfragebasierter Abrechnung in europe-west1 (Belgien) bereitgestellt, um ereignisgesteuerte Code-Ausführung zu ermöglichen (z.B. Dateiupload, HTTP-Anfrage). Ihr Dienst erhält 10 Millionen Anfragen pro Monat mit einer durchschnittlichen Latenz von 200 Millisekunden pro Anfrage. Dieser Dienst ist mit 0,167 vCPU, 256 MiB Arbeitsspeicher und maximal einer gleichzeitigen Anfrage pro Instanz konfiguriert.
Die geschätzten monatlichen Kosten für diese Arbeitslast betragen 7,25 $. Ohne das kostenlose Kontingent für vCPU/Arbeitsspeicher würden die Kosten 12, 47 $ betragen.
Wenn Sie sich die Berechnungen genauer ansehen und Einstellungen und Nutzungsschätzungen anpassen möchten, verwenden Sie den Preisrechner.
Beispiel 5: Batch-Job-Verarbeitung – Umfangreiche, geplante Datentransformationen
Angenommen, Sie haben einen Cloud Run-Job in europe-west1 (Belgien) bereitgestellt, um umfangreiche, geplante Datentransformationen (z.B. Berichte) zu verarbeiten. Ihr Job wird einmal pro Stunde (730-mal pro Monat) ausgeführt und jede Ausführung dauert 1 Minute. Dieser Job ist mit 1 vCPU, 512 MiB Arbeitsspeicher und 1 Task pro Ausführung konfiguriert.
Die geschätzten monatlichen Kosten für diese Arbeitslast betragen 0,00 $. Ohne das kostenlose Kontingent für vCPU/Arbeitsspeicher würden die Kosten 0, 45 $ betragen.
Wenn Sie sich die Berechnungen genauer ansehen und Einstellungen und Nutzungsschätzungen anpassen möchten, verwenden Sie den Preisrechner.
Beispiel 6: Hintergrund-Worker – Asynchrone Auslagerung intensiver Vorgänge
Angenommen, Sie haben einen Cloud Run-Worker-Pool in europe-west1 (Belgien) bereitgestellt, um zeitaufwendige oder rechenintensive Aufgaben (z.B. Massen-E-Mails, Videoverarbeitung) auszulagern und die Reaktionsfähigkeit der Hauptanwendung zu erhalten. Ihr Worker-Pool ist so konfiguriert, dass er einen Monat lang eine einzelne Instanz ausführt. Dieser Worker-Pool ist mit 1 vCPU und 512 MiB Arbeitsspeicher konfiguriert.
Die geschätzten monatlichen Kosten für diese Arbeitslast betragen 11,61 $. Ohne das kostenlose Kontingent für vCPU/Arbeitsspeicher würden die Kosten 16, 83 $ betragen.
Wenn Sie sich die Berechnungen genauer ansehen und Einstellungen und Nutzungsschätzungen anpassen möchten, verwenden Sie den Preisrechner.
Cloud Run-Bereitstellungen aus dem Quellcode und Funktionen werden als Cloud Run-Dienste ausgeführt und entsprechend den oben genannten Bedingungen abgerechnet.
Bei der Bereitstellung aus dem Quellcode oder beim Erstellen einer Funktion verwendet Cloud Run Cloud Build, um den Quellcode oder die Funktion in ein ausführbares Image umzuwandeln. Die Images werden in Cloud Build erstellt und in Artifact Registry gespeichert. Artifact Registry hat eine eigene kostenlose Stufe für Speicher. Wenn Sie Ihren Quellcode oder Ihre Funktion in Artifact Registry bereitstellen und die Nutzung der kostenlosen Stufe von Artifact Registry überschreiten, fallen Gebühren für die Bereitstellung Ihrer Funktionen an, auch wenn Ihre Nutzung von Cloud Run innerhalb der kostenlosen Stufe liegt.
Die Preise für Cloud Build und Artifact Registry sind nicht in den Preisen für Cloud Run enthalten. Preise für diese Dienste finden Sie auf den entsprechenden Seiten für Cloud Build und Artifact Registry.
Cloud Run verwendet Eventarc für die Ereignisbereitstellung. Die Preise für Eventarc sind in den oben genannten Cloud Run-Preisen nicht enthalten. Die Preise finden Sie auf der Seite Eventarc-Preise.
Die Preise für Cloud Run-Funktionen (1. Generation) sind nicht in den Cloud Run-Preisen enthalten. Informationen zu den Preisen finden Sie unter Preise für Cloud Run-Funktionen (1. Generation).