Cloud Run è una piattaforma di applicazioni completamente gestita per l'esecuzione di codice, funzioni o container sull'infrastruttura ad alta scalabilità di Google.
Puoi eseguire il deployment di codice scritto in qualsiasi linguaggio di programmazione su Cloud Run se riesci a creare un'immagine container. Infatti, la creazione di immagini container è facoltativa. Se usi Go, Node.js, Python, Java, .NET, Ruby o un framework supportato, puoi utilizzare l'opzione di deployment basato sull'origine, che crea il container per te, usando le best practice per il linguaggio che stai utilizzando.
Google ha creato Cloud Run per funzionare bene con altri servizi su Google Cloud, in modo da poter creare applicazioni complete.
In breve, Cloud Run consente agli sviluppatori di dedicare il proprio tempo alla scrittura del codice e di dedicare pochissimo tempo al funzionamento, alla configurazione e allo scaling del servizio Cloud Run. Non devi creare un cluster o gestire l'infrastruttura per essere produttivo con Cloud Run.
Servizi, job, pool di worker e istanze: quattro modi per eseguire il codice
Su Cloud Run, il tuo codice può essere eseguito come servizio, job, pool di worker o istanza. Tutti questi tipi di risorse eseguono istanze di container in sandbox nello stesso ambiente di esecuzione e possono integrarsi con i serviziGoogle Cloud .
La tabella seguente fornisce una panoramica generale delle opzioni fornite da ciascun tipo di risorsa Cloud Run.
| Risorsa | Descrizione |
|---|---|
| Servizio | Risponde alle richieste HTTP inviate a un endpoint univoco e stabile, utilizzando istanze di container stateless che supportano sia la scalabilità automatica dinamica sia quella manuale. Risponde anche a eventi e funzioni. |
| Job | Esegue attività parallelizzabili eseguite manualmente o in base a una pianificazione e portate a termine. |
| Pool di worker | Gestisce i carichi di lavoro in background sempre attivi, ad esempio i carichi di lavoro delle code di messaggi (Kafka, Pub/Sub, RabbitMQ). |
| Istanza | Esegue workload di lunga durata che richiedono un ambiente di runtime singleton. |
Servizi Cloud Run
Un servizio Cloud Run fornisce l'infrastruttura necessaria per eseguire un endpoint HTTPS affidabile. Per utilizzare questo servizio, devi assicurarti che il tuo codice sia in ascolto su una porta TCP e gestisca le richieste HTTP in entrata.
Il seguente diagramma illustra come un servizio Cloud Run esegue più istanze container per elaborare richieste web ed eventi da un client:
Un servizio standard include le seguenti funzionalità:
- Endpoint HTTPS univoco per ogni servizio
- Ogni servizio Cloud Run ha un endpoint HTTPS su un sottodominio univoco del dominio
*.run.appe puoi configurare anche domini personalizzati. Cloud Run gestisce TLS per te e supporta WebSocket, HTTP/2 (end-to-end) e gRPC (end-to-end). - Scalabilità automatica rapida basata sulle richieste
- Cloud Run esegue rapidamente lo scale out per gestire tutte le richieste in entrata o per gestire l'aumento dell'utilizzo della CPU al di fuori delle richieste se l'impostazione di fatturazione è impostata sulla fatturazione basata sulle istanze. Un servizio può fare lo scale out rapidamente fino a 1000 istanze o anche di più se richiedi un aumento della quota. Se la domanda diminuisce, Cloud Run rimuove i container inattivi. Se ti preoccupano i costi o il sovraccarico dei sistemi downstream, puoi limitare il numero massimo di istanze.
- Scalabilità manuale facoltativa
- Per impostazione predefinita, Cloud Run esegue automaticamente lo scale up a più istanze per gestire più traffico, ma puoi ignorare questo comportamento utilizzando lo scaling manuale per controllare il comportamento di scalabilità.
- Gestione del traffico integrata
Per ridurre il rischio di deployment di una nuova revisione, Cloud Run supporta l'esecuzione di un'implementazione graduale, incluso il routing del traffico in entrata all'ultima revisione, il rollback a una revisione precedente e la divisione del traffico in più revisioni contemporaneamente.
Ad esempio, puoi iniziare inviando l'1% delle richieste a una nuova revisione e aumentare questa percentuale monitorando la telemetria.
- Servizi pubblici e privati
Un servizio Cloud Run può essere raggiungibile da internet oppure puoi limitare l'accesso nei seguenti modi:
- Specifica una policy di accesso utilizzando Cloud Identity and Access Management (IAM).
- Utilizza le impostazioni di ingresso per limitare l'accesso alla rete. Ciò è utile se vuoi consentire solo il traffico interno dal VPC e dai servizi interni.
- Consenti solo utenti autenticati con Identity-Aware Proxy (IAP).
Puoi pubblicare asset memorizzabili nella cache da una località edge più vicina ai client anteponendo un servizio Cloud Run a una rete CDN (Content Delivery Network), come Firebase Hosting e Cloud CDN.
Scalabilità fino a zero e istanze minime
Per impostazione predefinita, se la fatturazione è impostata sulla fatturazione basata sulle istanze, Cloud Run aggiunge e rimuove automaticamente le istanze per gestire tutte le richieste in entrata o per gestire l'aumento dell'utilizzo della CPU al di fuori delle richieste.
Scalabilità fino a zero
Se non ci sono richieste in entrata al tuo servizio, verrà rimossa anche l'ultima istanza rimanente. Questo comportamento è comunemente indicato come scalabilità a zero.
Quando arriva una nuova richiesta per un servizio senza istanze attive, Cloud Run crea una nuova istanza. Questo processo può aumentare il tempo di risposta per queste richieste iniziali, a seconda della velocità con cui il container diventa pronto a gestire il traffico.
Modificare il comportamento di scalabilità
Puoi modificare questo comportamento predefinito utilizzando uno dei seguenti metodi:
- Istanze minime: configura Cloud Run in modo che mantenga attivo un numero minimo di istanze, in modo che il servizio non venga scalato a zero.
- Scalabilità manuale: utilizza la scalabilità manuale per mantenere un maggiore controllo sul comportamento di scalabilità del tuo servizio.
Prezzi a consumo per i servizi
Lo scale to zero è interessante per motivi economici, in quanto ti viene addebitato il costo della CPU e della memoria allocate a un'istanza con una granularità di 100 ms. Se non configuri le istanze minime, non ti viene addebitato alcun costo se il servizio non viene utilizzato. È disponibile un generoso livello senza costi. Per ulteriori informazioni, consulta la pagina Prezzi.
Puoi attivare due impostazioni di fatturazione:
- Basata sulle richieste
- Se un'istanza non elabora richieste, non ti viene addebitato alcun costo. Paghi una commissione per richiesta.
- Basata sulle istanze
- Ti vengono addebitati i costi per l'intera durata di un'istanza. Non è prevista alcuna tariffa per richiesta.
È disponibile un generoso livello senza costi. Per ulteriori informazioni, consulta i prezzi e le impostazioni di fatturazione per scoprire come attivare la fatturazione basata sulle richieste o sulle istanze per il tuo servizio.
Un file system contenitore usa e getta
Le istanze su Cloud Run sono usa e getta. Ogni container ha un overlay del file system scrivibile in memoria, che non viene mantenuto se il container viene arrestato. Cloud Run determina quando interrompere l'invio di richieste a un'istanza e arrestarla, ad esempio durante lo scale in.
Per ricevere un avviso quando Cloud Run sta per arrestare un'istanza, la tua applicazione può intercettare il segnale SIGTERM. In questo modo, il codice
svuota i buffer locali e salva i dati locali in un datastore esterno.
Per rendere permanenti i file, esegui l'integrazione con Cloud Storage o monta un file system di rete (NFS).
Quando utilizzare i servizi Cloud Run
I servizi Cloud Run sono ideali per il codice che gestisce richieste, eventi o funzioni. Esempi di casi d'uso:
- Siti web e applicazioni web
- Crea la tua app web utilizzando il tuo stack preferito, accedi al tuo database SQL ed esegui il rendering di pagine HTML dinamiche.
- API e microservizi
- Puoi creare un'API REST, un'API GraphQL o microservizi privati che comunicano tramite HTTP o gRPC.
- Elaborazione dei flussi di dati
- I servizi Cloud Run possono ricevere messaggi da sottoscrizioni push di Pub/Sub ed eventi da Eventarc.
- Workload asincroni
- Le funzioni Cloud Run possono rispondere a eventi asincroni, ad esempio un messaggio in un argomento Pub/Sub, una modifica in un bucket Cloud Storage o un evento Firebase.
- Inferenza AI
- I servizi Cloud Run, con o senza GPU configurata, possono ospitare carichi di lavoro di AI come modelli di inferenza e addestramento dei modelli.
Job Cloud Run
Se il codice esegue un lavoro e poi si arresta, ad esempio utilizzando uno script, puoi utilizzare un job Cloud Run per eseguire il codice. Puoi eseguire un job dalla riga di comando utilizzando Google Cloud CLI, pianificando un job ricorrenteo eseguendolo nell'ambito di un flusso di lavoro.
I job array sono un modo più rapido per eseguire i job
Un job può avviare una singola istanza per eseguire il codice, un modo comune per eseguire uno script o uno strumento.
Tuttavia, puoi anche utilizzare un job array, avviando in parallelo molte istanze identiche e indipendenti. I job array sono un modo più rapido per elaborare i job che possono essere suddivisi in più attività indipendenti.
Il seguente diagramma mostra come un job con sette attività richiede più tempo per essere eseguito in sequenza rispetto allo stesso job quando quattro istanze possono elaborare attività indipendenti in parallelo:
Ad esempio, se ridimensioni e ritagli 1000 immagini da Cloud Storage, l'elaborazione consecutiva è più lenta rispetto all'elaborazione in parallelo con molte istanze, con Cloud Run che gestisce la scalabilità automatica.
Quando utilizzare i job Cloud Run
I job Cloud Run sono adatti per eseguire codice che svolge un lavoro (un job) e termina quando il lavoro è terminato. Ecco alcuni esempi:
- Script o strumento
- Esegui uno script per eseguire migrazioni di database o altre attività operative.
- Job array
- Esegui l'elaborazione altamente parallelizzata di tutti i file in un bucket Cloud Storage.
- Job programmato
- Crea e invia fatture a intervalli regolari oppure salva i risultati di una query del database come XML e carica il file ogni poche ore.
- Workload AI
- I job Cloud Run con o senza GPU configurata possono ospitare workload di AI come l'inferenza batch, il perfezionamento dei modelli e l'addestramento dei modelli.
Pool di worker Cloud Run
I pool di worker sono progettati per i workload che non si basano sulla gestione delle richieste HTTP. Forniscono un pool flessibile e scalabile di risorse di calcolo progettato per l'elaborazione in background continua, non HTTP e basata sul pull. Le seguenti caratteristiche chiave definiscono il funzionamento dei pool di worker:
I pool di worker non vengono scalati automaticamente. Scala manualmente il numero di istanze richieste dal pool di worker Cloud Run per gestire il carico di lavoro. Per essere avviato e rimanere attivo, il tuo workload deve avere almeno unƏistanza. Se imposti le istanze minime su
0, l'istanza worker non si avvierà, anche se il deployment è riuscito.Per scalare automaticamente i pool di worker, utilizza la scalabilità automatica delle metriche esterne di Cloud Run (CREMA), che regola il conteggio delle istanze in base a metriche esterne come il ritardo del consumer Kafka, le dimensioni del backlog di Pub/Sub o le query Prometheus.
I pool di worker gestiscono le implementazioni dividendo le istanze tra le revisioni, anziché dividere il traffico. Ad esempio, per un pool di worker con quattro istanze, puoi allocare il 25% (un'istanza) a una nuova revisione e il 75% (tre istanze) a una revisione stabile.
I pool di worker supportano l'uscita e l'entrata VPC dirette e non hanno un endpoint o URL bilanciato del carico. Per ulteriori informazioni sul supporto del server dei metadati (MDS) e sul recupero degli indirizzi IP privati dell'istanza del pool di worker, consulta il contratto di runtime del container.
Cloud Run ti addebita solo la durata di esecuzione delle istanze del pool di worker.
Quando utilizzare i pool di worker Cloud Run
I pool di worker non richiedono endpoint HTTP pubblici. In questo modo, la tua rete è più sicura e il codice dell'applicazione è più semplice. Inoltre, non devi gestire le porte per i controlli di integrità. I seguenti casi d'uso si applicano ai pool di worker:
Workload basati sul pull: esegui il deployment di un workload per estrarre i messaggi da una coda per la gestione. Ad esempio, Kafka Consumer, Pub/Sub pull e RabbitMQ.
Il seguente diagramma mostra i casi d'uso per il deployment di pool di worker per i workload basati sul pull:

In un caso d'uso di Pub/Sub, un sottoscrittore Cloud Run con scalabilità automatica estrae i messaggi da una sottoscrizione Pub/Sub. In un caso d'uso di Kafka, un consumer Cloud Run scalato automaticamente estrae i messaggi da un argomento Kafka.
Workload generici non basati su richieste: esegui un workload basato su container che non è destinato a gestire le richieste in entrata.
Istanze Cloud Run
Un'istanza Cloud Run è progettata per i workload che richiedono un runtime singleton stabile, continuo e indirizzabile individualmente, anziché uno scalabilità orizzontale basata sulle richieste.
A differenza di un servizio, che può avere più istanze container ed essere configurato per la scalabilità automatica o manuale, un'istanza Cloud Run è solo un'istanza.
Un'istanza Cloud Run include le seguenti caratteristiche:
- Gestibili singolarmente: puoi creare, aggiornare ed eliminare ogni istanza singolarmente, avviare e arrestare l'istanza e monitorare le esecuzioni.
- Indirizzabile singolarmente: a ogni istanza viene assegnato un URL univoco.
- Di lunga durata: l'istanza può essere eseguita ininterrottamente per ore o giorni, o anche più a lungo se è configurata per riavviarsi automaticamente dopo aggiornamenti periodici dell'infrastruttura (ogni 1-2 settimane).
- Creazione rapida: il provisioning dell'istanza viene eseguito in circa 20 secondi o meno.
Quando utilizzare le istanze Cloud Run
Le istanze Cloud Run sono progettate per carichi di lavoro di calcolo singleton persistenti progettati per l'esecuzione di carichi di lavoro agentici e workflow non AI. Esempi di casi d'uso:
- Motori di workflow AI e agenti AI di lunga durata
- Crea agenti in background a esecuzione prolungata che eseguono piani di esecuzione in più passaggi, esegui assistenti alla codifica asincroni o gestisci workflow stateful che richiedono un ambiente a singola istanza.
- Serverless computing a lunga durata
- Esegui il deployment di server leggeri e sempre attivi, simili a un server privato virtuale (VPS) in esecuzione continua. Questa opzione è ideale se vuoi workload che non richiedono scalabilità automatica o gestiscono il traffico su larga scala e vuoi dare la priorità a costi inferiori e alla longevità dei singleton rispetto all'alta affidabilità.
- Ambienti di sviluppo e cicli di debug
- Esegui il deployment di ambienti dedicati per eseguire il debug dei processi dei container da remoto, sincronizzare le modifiche al codice e risolvere i problemi relativi agli arresti anomali senza la terminazione automatica dei container.
Google Cloud integrazioni
Cloud Run si integra con l'ecosistema più ampio di Google Cloud, che ti consente di creare applicazioni complete.
Le integrazioni essenziali includono:
- Archiviazione dei dati
- Cloud Run si integra con Cloud SQL (MySQL, PostgreSQL e SQL Server gestiti), Memorystore (Redis e Memcached gestiti), Firestore, Spanner, Cloud Storage e altro ancora. Per un elenco completo, consulta Archiviazione dei dati.
- Logging e segnalazione degli errori
- Cloud Logging importa automaticamente i log dei container. Se nei log sono presenti eccezioni, Error Reporting le aggrega e ti invia una notifica. Sono supportati i seguenti linguaggi: Go, Java, Node.js, PHP, Python, Ruby e .NET.
- Identità di servizio
- Ogni revisione di Cloud Run è collegata a un service account e le librerie client Google Cloud utilizzano in modo trasparente questo account di servizio per l'autenticazione con le API Google Cloud .
- Distribuzione continua
- Se memorizzi il codice sorgente in GitHub, puoi configurare Cloud Run per eseguire automaticamente il deployment dei nuovi commit.
- Networking privato
- Le istanze Cloud Run possono raggiungere le risorse nella rete Virtual Private Cloud (VPC) tramite il connettore di accesso VPC serverless. In questo modo, il tuo servizio può connettersi a macchine virtuali Compute Engine o a prodotti basati su Compute Engine come Google Kubernetes Engine o Memorystore.
- Google Cloud API
- Il codice del tuo servizio si autentica in modo trasparente con le Google Cloud API. Sono incluse le API AI e Machine Learning, come l'API Cloud Vision, l'API Speech-to-Text, l'API Natural Language di AutoML, l'API Cloud Translation e molte altre.
- Attività in background
- Puoi programmare l'esecuzione del codice in un secondo momento o immediatamente dopo aver restituito una richiesta web. Cloud Run funziona bene con Cloud Tasks per fornire un'esecuzione asincrona scalabile e affidabile.
Consulta Connessione ai servizi Google Cloud per un elenco dei numerosi servizi Google Cloud che funzionano bene con Cloud Run.
Il codice viene eseguito in un'immagine container
Sebbene la familiarità con i container non sia necessaria per il deployment del codice su Cloud Run, il codice viene sempre eseguito in istanze di container sandbox.
Se non hai familiarità con i container, ecco una breve introduzione concettuale.
Come mostra il diagramma, utilizzi il codice sorgente, gli asset e le dipendenze della libreria per creare un'immagine container. Questa immagine è un pacchetto contenente tutto ciò di cui il tuo servizio ha bisogno per essere eseguito, inclusi artefatti di build, asset, pacchetti di sistema e, facoltativamente, un runtime. Le applicazioni containerizzate sono intrinsecamente portatili e vengono eseguite ovunque possa essere eseguito un container. Gli artefatti di build includono file binari compilati o script e i runtime includono il runtime JavaScript Node.js o una macchina virtuale Java.
I professionisti esperti apprezzano il fatto che Cloud Run non imponga ulteriori oneri per l'esecuzione del codice e che sia possibile eseguire qualsiasi binario su Cloud Run.
Se vuoi maggiore praticità o vuoi delegare la containerizzazione delle applicazioni a Google, Cloud Run si integra con i buildpack open source di Google Cloud per offrire un deployment basato sull'origine.
Passaggi successivi
- Esegui il deployment di un servizio Cloud Run
- Crea ed esegui un job Cloud Run
- Scopri come eseguire i job in base a una pianificazione
- Esegui il deployment di un worker pool
- Esegui il deployment di un'istanza Cloud Run
- Esplora il modello di risorse
- Scopri di più sul contratto di runtime del container