Skip to content
Guide30 settembre 2026· 8 min di lettura

API Veo 3.1 Fast: prezzo, limiti e come chiamarla

Prezzo al secondo dell'API Veo 3.1 Fast, durata dei clip, risoluzioni, latenza e quote secondo Google, e come chiamarla da codice o da Claude Code, con esempi.

veogooglevideo api
Guide

API Veo 3.1 Fast: prezzo, limiti e come chiamarla

Un clip Veo 3.1 Fast da 8 secondi in 720p costa $0.80 sull'API di Google. Lo stesso clip in 4K costa $2.40. Entrambe le cifre vengono da la pagina dei prezzi della Gemini Developer API, e determinano la maggior parte delle decisioni successive: a quale risoluzione fare le bozze, quante varianti puoi permetterti di scartare e se chiamare Google direttamente o passare da un gateway.

Qui sotto: quanto costa un secondo di Veo 3.1 Fast in ciascun posto in cui puoi acquistarlo, i limiti rigidi della documentazione di Google e la sequenza di chiamate da uno script o da un agente come Claude Code. Tutti i prezzi sono quelli di settembre 2026, data di stesura.

Cos'è Veo 3.1 Fast e dove si colloca nella famiglia

Google ha annunciato Veo 3.1 e Veo 3.1 Fast il 15 ottobre 2025, in anteprima a pagamento sulla Gemini API, su AI Studio e su Vertex AI, secondo l'annuncio sul Google Developers Blog. La stessa versione ha aggiunto la guida con immagini di riferimento (fino a tre), l'estensione di scena per video più lunghi e la generazione a partire da un primo e un ultimo fotogramma. Al lancio Google ha fissato per Veo 3.1 lo stesso prezzo di Veo 3.

La panoramica video della Gemini API descrive Veo 3.1 come un modello che genera video con audio nativo, e indica tra gli input supportati l'estensione video, la generazione per fotogrammi specifici e la regia a partire da immagini. I livelli sono tre, ciascuno con il proprio codice modello nella documentazione per sviluppatori di Veo 3.1:

  • veo-3.1-generate-preview: Standard, il livello più costoso.
  • veo-3.1-fast-generate-preview: Fast, il tema di questa guida.
  • veo-3.1-lite-generate-preview: Lite, il più economico, senza uscita 4K.

La scheda del gateway di Vercel riassume bene lo scopo del livello Fast: è ottimizzato per flussi di lavoro in cui volume e velocità di iterazione contano quanto la qualità finale.

Una regola di scelta per i tre livelli

  1. Usa Lite per bozze usa e getta in cui devi solo giudicare composizione e movimento e non ti serve mai il 4K.
  2. Usa Fast come scelta predefinita per tutto ciò che potrebbe essere pubblicato: hook, B-roll, inquadrature di prodotto, short.
  3. Usa Standard solo per un'inquadratura già validata con Fast che vuoi rifare, perché costa quattro volte di più al secondo in 720p.

Prezzo di Veo 3.1 Fast al secondo e per clip

Google fattura Veo al secondo di output. La pagina dei prezzi della Gemini API riporta queste tariffe alla data di stesura, audio incluso:

  • Veo 3.1 Fast: $0.10/s in 720p, $0.12/s in 1080p, $0.30/s in 4K.
  • Veo 3.1 Standard: $0.40/s in 720p e 1080p, $0.60/s in 4K.
  • Veo 3.1 Lite: $0.05/s in 720p, $0.08/s in 1080p, 4K non supportato.

La stessa pagina afferma: "You will only be charged if your video is successfully generated." I job filtrati o falliti non compaiono in fattura.

Convertito in clip (Veo genera 4, 6 o 8 secondi, e 1080p e 4K solo a 8), il prezzo di listino di Google dà:

  • Fast, 720p: $0.40 per 4 s, $0.60 per 6 s, $0.80 per 8 s.
  • Fast, 1080p (solo 8 s): $0.96.
  • Fast, 4K (solo 8 s): $2.40.
  • Standard, 720p, 8 s: $3.20. Standard, 4K, 8 s: $4.80.
  • Lite, 720p, 8 s: $0.40. Lite, 1080p, 8 s: $0.64.

Il tracker dei prezzi di BenchLM osserva che in 720p Veo 3.1 Fast si colloca al livello di Sora 2 standard o sotto, a $0.10/s, il che lo mette nella fascia bassa del mercato per un modello che produce l'audio nella stessa passata.

I gateway fanno pagare lo stesso modello in modo diverso

Google non è l'unico posto in cui acquistarlo, e non tutti i gateway copiano il listino di Google:

Per un confronto affiancato della tariffa al secondo di ogni grande modello video, vedi il dettaglio dei prezzi delle API video modello per modello.

Quanto costa un lotto realistico

Lotto 1: 20 varianti di hook. Venti clip da 8 secondi in 720p fanno 160 secondi di output.

  • Google diretto: 160 x $0.10 = $16.00.
  • fal con audio: 160 x $0.15 = $24.00.
  • Aitachyon, da: 160 x $0.19 = $30.40.

Poi rifai i tre vincitori in 1080p su Google: 3 x $0.96 = $2.88. Fare tutte e venti le bozze in 1080p costerebbe $19.20, una differenza piccola. In 4K la differenza è grande: venti bozze in 4K costano $48.00, il triplo del lotto in 720p.

Lotto 2: una settimana di short. Tre short al giorno, ciascuno montato con tre clip da 8 secondi, sono 63 clip o 504 secondi a settimana.

  • Google diretto in 720p: $50.40. In 1080p: $60.48. In 4K: $151.20.
  • Aitachyon, da $0.19/s: $95.76.

Questi totali presuppongono che ogni clip sia utilizzabile al primo colpo. Se ne tieni uno su due, raddoppiali. Il volume di hook è dove il conto cresce più in fretta, e una libreria di formule di hook collaudate riduce il numero di render alla cieca che paghi.

I limiti rigidi nella documentazione di Google

Questi vincoli vengono dalla pagina Veo 3.1 della documentazione della Gemini API, salvo diversa indicazione:

  • Durata: durationSeconds accetta 4, 6 o 8. Otto secondi sono obbligatori per le risoluzioni più alte e per le immagini di riferimento.
  • Risoluzione: 720p (predefinita), 1080p o 4k. 1080p e 4k funzionano solo a 8 secondi.
  • Formato: 16:9 (predefinito) o 9:16. Nient'altro.
  • Latenza: un minimo di 11 secondi e fino a 6 minuti nelle ore di punta.
  • Conservazione: i video generati restano sui server di Google per 2 giorni, poi vengono rimossi.
  • Filigrana: tutti i video ricevono una filigrana SynthID.
  • Regole regionali: in UE, Regno Unito, Svizzera e MENA, allow_adult è l'unico valore consentito per personGeneration.
  • Limiti di frequenza: la pagina dei limiti di frequenza di Gemini non elenca Veo nelle tabelle pubblicate. I limiti per progetto sono visibili in AI Studio all'indirizzo aistudio.google.com/rate-limit.
  • Frequenza dei fotogrammi: la scheda di Vercel indica 24 fps sia per il testo-video sia per l'immagine-video.
  • Dimensioni esatte: Leonardo documenta solo 1280x720, 720x1280, 1920x1080 e 1080x1920 nella sua integrazione.

Cosa significano questi limiti in una pipeline reale

  1. Otto secondi sono l'unità di lavoro. Tutto ciò che è più lungo si assembla da più clip o si costruisce con l'estensione di scena. Scrivi gli script come una sequenza di battute da 8 secondi fin dall'inizio.
  2. Non esiste un clip 1080p corto ed economico. Un render da 4 secondi in 1080p non esiste, quindi un'inquadratura in 1080p costa sempre almeno $0.96 nel listino di Google. Se ti servono solo 4 secondi, fai la bozza in 720p e taglia.
  3. Il verticale è nativo. Il 9:16 è un'opzione di prima classe, quindi non devi ritagliare un render orizzontale per Shorts, Reels o TikTok. L'inquadratura conta comunque, e le regole per produrre video 9:16 valgono per il girato generato quanto per quello ripreso.
  4. Progetta per il lavoro asincrono. Un intervallo da 11 secondi a 6 minuti esclude una richiesta sincrona che tenga aperta una connessione HTTP. Metti i job in coda, interroga lo stato e lascia proseguire il resto della pipeline.
  5. Scarica subito. Dopo 2 giorni il file sparisce. Una pipeline che conserva l'URL di Google invece del file si rompe due giorni dopo.
  6. Metti in conto la filigrana. SynthID marca ogni output come generato da IA, quindi scrivi di conseguenza le tue informative.
  7. Controlla la generazione di persone per mercato. Se il tuo team o i tuoi utenti sono in UE, Regno Unito, Svizzera o MENA, prova un prompt con persone da quella regione prima di promettere una funzione che ne dipende.

Come chiamare Veo 3.1 Fast dal codice

Il flusso della Gemini API è un'operazione di lunga durata. La documentazione ufficiale descrive gli stessi quattro passaggi per ogni SDK:

  1. Invia. In Python, chiama client.models.generate_videos con il modello veo-3.1-fast-generate-preview e il tuo prompt. Via REST, invia un POST a models/veo-3.1-fast-generate-preview:predictLongRunning. Imposta durationSeconds, resolution e aspectRatio in modo esplicito invece di affidarti ai valori predefiniti, così il costo per chiamata resta prevedibile.
  2. Ricevi un'operazione. La risposta è un riferimento all'operazione, non un video.
  3. Interroga. Rileggi l'operazione finché non risulta done.
  4. Scarica. Recupera il file generato e scrivilo nel tuo storage entro la finestra di 2 giorni.

Interrogare senza sprecare richieste

La latenza minima documentata è di 11 secondi, quindi fai il primo controllo intorno ai 10-15 secondi e poi interroga a intervallo fisso con un timeout rigido oltre il picco dei 6 minuti. Registra il nome dell'operazione insieme al prompt, così un job scaduto può essere ripreso invece di essere reinviato e pagato due volte.

La stessa chiamata tramite un gateway

  • fal.ai (Python): fal_client.subscribe('fal-ai/veo3.1/fast', arguments={...}) gestisce la coda al posto tuo. I parametri documentati sono aspect_ratio, duration (4s, 6s o 8s, predefinito 8s), resolution, generate_audio (predefinito true), negative_prompt, seed, auto_fix e safety_tolerance da 1 a 6.
  • Vercel AI SDK: experimental_generateVideo({ model, prompt }) con il modello impostato su google/veo-3.1-fast-generate-001, secondo la pagina del modello di Vercel.

Un dettaglio dei gateway con un costo reale: se prevedi di sovrapporre una voce fuori campo separata alle immagini, disattivare generate_audio su fal fa risparmiare $0.05 al secondo, cioè $0.40 per clip da 8 secondi. Su un lotto di 20 clip sono $8.00. La traccia vocale diventa allora una voce di spesa a sé, e il dettaglio dei costi della voce fuori campo mostra come stimarla.

Chiamarlo da un agente invece che da uno script

Lanciare la generazione da un agente toglie il ciclo di polling dal tuo codice. In Claude Code o Cursor, un server MCP espone la generazione video come strumento: l'agente scrive i prompt, chiama lo strumento, attende il job e salva il file, e tu controlli il risultato e il costo. Generare video con IA da Claude Code tramite MCP percorre questa configurazione dall'inizio alla fine.

Con un server MCP ospitato la connessione richiede un solo comando. Per Aitachyon è:

claude mcp add --transport http aitachyon https://aitachyon.com/api/mcp --header "Authorization: Bearer ait_..."

La guida rapida ad API e MCP copre la stessa chiave usata via HTTP semplice. Ogni file generato torna con un riferimento stabile (scn_ per una scena) che il codice può recuperare in seguito con GET /api/generations/{ref}, evitando il problema della scadenza a 2 giorni che nasce dal salvare l'URL temporaneo di un fornitore.

Un brief da incollare nell'agente

Gli agenti spendono soldi con la velocità che permetti loro. Metti i vincoli nel brief, non nella tua testa:

  • Compito: generare un clip Veo 3.1 Fast per ogni hook elencato in hooks.md.
  • Formato: 8 secondi, 9:16, 720p. Non cambiare risoluzione né durata senza chiedere.
  • Output: salvare ogni file come renders/[hook-id].mp4 e aggiungere modello, durata, risoluzione, prompt e costo a renders/costs.csv.
  • Budget: fermarsi e riferire se il totale corrente supera $20.
  • Escalation: chiedere prima di qualsiasi render in 1080p o 4K, e prima di riprovare più di una volta un job fallito.
  • Revisione: a lavoro finito, elencare i tre clip i cui primi due secondi corrispondono meglio al testo dell'hook.

Dodici hook con questo brief costano $9.60 al prezzo di listino 720p di Google o da $18.24 a $0.19/s, quindi un tetto di $20 regge in entrambi i casi. Per una pipeline più completa con script, voce e montaggio in un'unica esecuzione, vedi una configurazione funzionante per automatizzare la produzione video con gli agenti.

Scrivere prompt adatti a un clip da 8 secondi

Otto secondi contengono un'idea sola. La maggior parte dei render falliti nasce da prompt che descrivono l'intero arco di una scena. Una struttura adatta ai limiti:

  1. Soggetto: chi o cosa, con uno o due dettagli visivi concreti.
  2. Azione singola: un movimento che può concludersi nel clip.
  3. Camera: inquadratura e un solo movimento di macchina.
  4. Luce e ambientazione: ora del giorno, luogo, superficie.
  5. Suono: poiché l'audio è generato nella stessa passata, indica cosa deve sentirsi, oppure indica il silenzio.

Prima: "A woman discovers our skincare product, tries it, loves it, and shows the results to her friends at a party."

Dopo: "Close-up, vertical frame. A woman in her thirties presses a pump bottle of face serum into her palm in a bright bathroom at morning light. Slow push-in on her hands. Sound: the soft click of the pump and a quiet room tone, no music."

Il primo prompt chiede quattro scene in otto secondi; il secondo chiede una sola inquadratura. Quando ti serve continuità tra le inquadrature, usa i controlli che Google ha introdotto con la 3.1: fino a tre immagini di riferimento per un prodotto o un personaggio coerente, e la generazione da primo e ultimo fotogramma per fissare dove un clip inizia e finisce. Le immagini di riferimento richiedono la durata di 8 secondi, quindi calcolale al prezzo degli 8 secondi. Su fal, fissare il seed permette di cambiare una parola del prompt e confrontare cose confrontabili.

Quando scegliere Veo 3.1 Fast rispetto ad altri modelli video

La scelta di solito è un problema di vincoli. Usando il listino di Aitachyon alla data di stesura, le tariffe al secondo degli altri modelli video sono: Hailuo 02 a $0.085/s, Kling v3 a $0.16/s senza audio e $0.32/s con audio nativo, Wan 2.7 a $0.19/s e Seedance 2.5 da $0.20/s in 480p e $0.44/s in 720p. Veo 3.1 Fast è indicato da $0.19/s sullo stesso listino.

  • Costo più basso per secondo di bozza: Hailuo 02 su quel listino, oppure Veo 3.1 Lite a $0.05/s se acquisti direttamente da Google.
  • Audio nello stesso render: Veo 3.1 Fast include l'audio nel prezzo di Google; Kling v3 raddoppia il prezzo per la modalità con audio.
  • Uscita 4K: Veo 3.1 Fast o Standard. Lite non genera 4K.
  • Clip più lunghi di 8 secondi in una sola chiamata: Veo non può, quindi concatena clip Veo con l'estensione di scena oppure prova un altro modello.

Per un confronto diretto delle due alternative più richieste, leggi il confronto tra Kling v3 e Seedance 2.5. La maggior parte dei team ottiene i risultati migliori tenendo due modelli in rotazione e mandando ogni inquadratura al più economico che rispetti il suo vincolo.

Checklist prima di un lotto Veo 3.1 Fast

  1. Conferma la quota Veo del tuo progetto in AI Studio.
  2. Fissa il codice del modello nella configurazione e imposta durationSeconds, resolution e aspectRatio a ogni chiamata.
  3. Fai le bozze in 720p. Porta a 1080p o 4K solo i vincitori.
  4. Decidi se ti serve l'audio generato; su fal cambia il prezzo di un altro 50%.
  5. Moltiplica il costo del lotto per il tasso di scarto atteso e fissa un tetto di budget rigido.
  6. Controlla le regole di personGeneration per la regione in cui operi.
  7. Copia ogni file nel tuo storage al termine, prima della cancellazione dopo 2 giorni.
  8. Registra prompt, seed, modello, risoluzione, durata e costo per clip, così i vincitori si possono riprodurre.

FAQ

Quanto costa al secondo l'API Veo 3.1 Fast?

Sulla Gemini API di Google, alla data di stesura, $0.10 al secondo in 720p, $0.12 in 1080p e $0.30 in 4K, audio incluso, quindi un clip da 8 secondi in 720p costa $0.80. I gateway applicano prezzi diversi.

Qual è il nome del modello Veo 3.1 Fast nella Gemini API?

veo-3.1-fast-generate-preview. Vercel AI Gateway usa google/veo-3.1-fast-generate-001 e fal usa fal-ai/veo3.1/fast.

Quanto può durare un video Veo 3.1 Fast?

Ogni chiamata restituisce 4, 6 o 8 secondi, e 1080p, 4K e immagini di riferimento richiedono 8. I video più lunghi si costruiscono concatenando clip o con l'estensione di scena.

Quali sono i limiti di frequenza di Veo 3.1 Fast?

Google non elenca Veo nelle sue tabelle pubblicate dei limiti di frequenza. I limiti del tuo progetto sono mostrati in AI Studio all'indirizzo aistudio.google.com/rate-limit, ed è il numero attorno a cui pianificare la concorrenza.

Veo 3.1 Fast genera audio e si può rimuovere la filigrana?

Veo 3.1 genera audio nativo, e il prezzo al secondo di Google lo include. Ogni output porta una filigrana SynthID, e la documentazione non descrive alcuna opzione per disattivarla.

Sources

  1. Google AI for Developers: Gemini Developer API pricing
  2. Google AI for Developers: Generate videos with Veo 3.1 in Gemini API
  3. Google AI for Developers: Video generation with Veo
  4. Google AI for Developers: Gemini API rate limits
  5. Google Developers Blog: Introducing Veo 3.1 and new creative capabilities in the Gemini API (October 15, 2025)
  6. fal.ai: Veo 3.1 Fast
  7. Vercel: Veo 3.1 Fast Generate on AI Gateway
  8. Leonardo.Ai: Generate with Veo3.1, Veo3.1 Fast using text prompts
  9. BenchLM.ai: Veo 3.1 API pricing

Se Veo 3.1 Fast è solo uno dei modelli della tua pipeline, Aitachyon lo mette dietro la stessa chiave di Kling, Seedance, Hailuo, dei modelli di immagini e di ElevenLabs, richiamabile dallo studio, dall'API HTTP o da Claude Code tramite MCP. Ogni job è dettagliato con il suo modello e il suo costo, i render falliti vengono rimborsati al centesimo e il saldo prepagato non scade. La tariffa al secondo è più alta del prezzo diretto di Google: se chiami solo Veo, rivolgerti direttamente a Google è l'opzione più economica.

Articoli correlati

Strumenti gratuiti da provare

Smetti di descrivere il tuo brand. Incolla il tuo URL.

Aitachyon legge tutto il tuo brand dal tuo sito e crea video, immagini, caroselli, post e banner, fedeli al brand, per ogni formato e ogni feed.