API do Veo 3.1 Fast: preço, limites e como chamá-la
Preço por segundo da API do Veo 3.1 Fast, duração dos clipes, resoluções, latência e cotas segundo o Google, e como chamá-la por código ou Claude Code.
API do Veo 3.1 Fast: preço, limites e como chamá-la
Um clipe de 8 segundos do Veo 3.1 Fast em 720p custa $0.80 na API do próprio Google. O mesmo clipe em 4K custa $2.40. Os dois números vêm da página de preços da Gemini Developer API, e moldam a maior parte das decisões seguintes: em que resolução você faz os rascunhos, quantas variações pode se dar ao luxo de descartar e se chama o Google diretamente ou passa por um gateway.
A seguir: quanto custa um segundo de Veo 3.1 Fast em cada lugar onde ele pode ser comprado, os limites rígidos da documentação do Google e a sequência de chamadas a partir de um script ou de um agente como o Claude Code. Todos os preços são de setembro de 2026, data da redação.
O que é o Veo 3.1 Fast e onde ele se encaixa na família
O Google anunciou o Veo 3.1 e o Veo 3.1 Fast em 15 de outubro de 2025, em prévia paga na Gemini API, no AI Studio e no Vertex AI, segundo o anúncio no Google Developers Blog. A mesma versão trouxe orientação por imagens de referência (até três), extensão de cena para vídeos mais longos e geração a partir de um primeiro e de um último quadro. No lançamento, o Google cobrou pelo Veo 3.1 o mesmo preço do Veo 3.
A visão geral de vídeo da Gemini API descreve o Veo 3.1 como um modelo que gera vídeo com áudio nativo, e lista extensão de vídeo, geração por quadros específicos e direção a partir de imagens entre as entradas aceitas. Há três níveis, cada um com seu código de modelo na documentação para desenvolvedores do Veo 3.1:
- veo-3.1-generate-preview: Standard, o nível mais caro.
- veo-3.1-fast-generate-preview: Fast, o tema deste guia.
- veo-3.1-lite-generate-preview: Lite, o mais barato, sem saída em 4K.
A ficha do gateway da Vercel resume bem o propósito do nível Fast: ele é otimizado para fluxos de trabalho em que volume e velocidade de iteração importam tanto quanto a qualidade final.
Uma regra de decisão para os três níveis
- Use o Lite para rascunhos descartáveis em que você só precisa avaliar composição e movimento e nunca precisa de 4K.
- Use o Fast como padrão para tudo que pode ir ao ar: hooks, B-roll, planos de produto, shorts.
- Use o Standard apenas para um plano que você já validou com o Fast e quer renderizar de novo, porque ele custa quatro vezes mais por segundo em 720p.
Preço do Veo 3.1 Fast por segundo e por clipe
O Google cobra o Veo por segundo de saída. A página de preços da Gemini API lista estas tarifas na data da redação, com áudio incluído:
- Veo 3.1 Fast: $0.10/s em 720p, $0.12/s em 1080p, $0.30/s em 4K.
- Veo 3.1 Standard: $0.40/s em 720p e 1080p, $0.60/s em 4K.
- Veo 3.1 Lite: $0.05/s em 720p, $0.08/s em 1080p, 4K sem suporte.
A mesma página afirma: "You will only be charged if your video is successfully generated." Jobs filtrados ou com falha não aparecem na fatura.
Convertido em clipes (o Veo renderiza 4, 6 ou 8 segundos, e 1080p e 4K só com 8), o preço de tabela do Google resulta em:
- Fast, 720p: $0.40 por 4 s, $0.60 por 6 s, $0.80 por 8 s.
- Fast, 1080p (só 8 s): $0.96.
- Fast, 4K (só 8 s): $2.40.
- Standard, 720p, 8 s: $3.20. Standard, 4K, 8 s: $4.80.
- Lite, 720p, 8 s: $0.40. Lite, 1080p, 8 s: $0.64.
O rastreador de preços da BenchLM observa que em 720p o Veo 3.1 Fast fica no mesmo nível do Sora 2 standard ou abaixo, a $0.10/s, o que o coloca na faixa baixa do mercado para um modelo que produz áudio na mesma passada.
Os gateways cobram o mesmo modelo de forma diferente
O Google não é o único lugar onde comprar, e nem todos os gateways copiam a tabela do Google:
- O fal.ai separa o áudio: $0.10/s sem áudio e $0.15/s com áudio em 720p ou 1080p, e $0.30/s ou $0.35/s em 4K. O parâmetro generate_audio vem como true por padrão, então uma chamada padrão de 8 segundos custa $1.20, e desligar o áudio a leva de volta a $0.80.
- O Leonardo.Ai cobra em créditos de API próprios: 546 créditos por 4 s, 819 por 6 s e 1,092 por 8 s, o que escala de forma linear com a duração.
- O Vercel AI Gateway o expõe com o ID de modelo google/veo-3.1-fast-generate-001.
- A Aitachyon lista o Veo 3.1 Fast a partir de $0.19/s na data da redação, cobrado de um saldo pré-pago. Fica acima do preço de tabela direto do Google.
Para comparar lado a lado a tarifa por segundo de cada grande modelo de vídeo, veja o detalhamento de preços de APIs de vídeo modelo por modelo.
Quanto custa um lote realista
Lote 1: 20 variações de hook. Vinte clipes de 8 segundos em 720p somam 160 segundos de saída.
- Google direto: 160 x $0.10 = $16.00.
- fal com áudio: 160 x $0.15 = $24.00.
- Aitachyon, a partir de: 160 x $0.19 = $30.40.
Depois, renderize de novo os três vencedores em 1080p no Google: 3 x $0.96 = $2.88. Fazer os vinte rascunhos em 1080p custaria $19.20, uma diferença pequena. Em 4K ela é grande: vinte rascunhos em 4K custam $48.00, o triplo do lote em 720p.
Lote 2: uma semana de shorts. Três shorts por dia, cada um montado com três clipes de 8 segundos, dão 63 clipes ou 504 segundos por semana.
- Google direto em 720p: $50.40. Em 1080p: $60.48. Em 4K: $151.20.
- Aitachyon, a partir de $0.19/s: $95.76.
Esses totais pressupõem que todo clipe seja aproveitável de primeira. Se você aproveita um a cada dois, dobre-os. O volume de hooks é onde a conta sobe mais rápido, e uma biblioteca de fórmulas de hook testadas reduz o número de renders às cegas que você paga.
Os limites rígidos da documentação do Google
Estas restrições vêm da página do Veo 3.1 na documentação da Gemini API, salvo indicação em contrário:
- Duração: durationSeconds aceita 4, 6 ou 8. Oito segundos são obrigatórios para resoluções mais altas e para imagens de referência.
- Resolução: 720p (padrão), 1080p ou 4k. 1080p e 4k só funcionam com 8 segundos.
- Proporção: 16:9 (padrão) ou 9:16. Nenhuma outra.
- Latência: no mínimo 11 segundos e até 6 minutos nos horários de pico.
- Retenção: os vídeos gerados ficam nos servidores do Google por 2 dias e depois são removidos.
- Marca d'água: todos os vídeos recebem marca d'água SynthID.
- Regras regionais: na UE, no Reino Unido, na Suíça e no MENA, allow_adult é o único valor permitido de personGeneration.
- Limites de taxa: a página de limites de taxa do Gemini não lista o Veo em suas tabelas publicadas. Os limites por projeto aparecem no AI Studio, em aistudio.google.com/rate-limit.
- Taxa de quadros: a ficha da Vercel indica 24 fps tanto para texto para vídeo quanto para imagem para vídeo.
- Tamanhos exatos: o Leonardo documenta apenas 1280x720, 720x1280, 1920x1080 e 1080x1920 na sua integração.
O que esses limites significam num pipeline real
- Oito segundos são a unidade de trabalho. Qualquer coisa mais longa é montada com vários clipes ou construída com extensão de cena. Escreva os roteiros como uma sequência de tempos de 8 segundos desde o início.
- Não existe clipe curto e barato em 1080p. Um render de 4 segundos em 1080p não existe, então um plano em 1080p sempre custa pelo menos $0.96 na tabela do Google. Se você só precisa de 4 segundos, faça o rascunho em 720p e corte.
- O vertical é nativo. O 9:16 é uma opção de primeira classe, então você não precisa recortar um render horizontal para Shorts, Reels ou TikTok. O enquadramento continua importando, e as regras para produzir vídeo 9:16 valem tanto para material gerado quanto para material filmado.
- Projete para trabalho assíncrono. Um intervalo de 11 segundos a 6 minutos descarta uma requisição síncrona que mantenha uma conexão HTTP aberta. Enfileire os jobs, consulte o estado e deixe o resto do pipeline continuar.
- Baixe imediatamente. Depois de 2 dias o arquivo some. Um pipeline que guarda a URL do Google em vez do arquivo quebra dois dias depois.
- Conte com a marca d'água. O SynthID marca toda saída como gerada por IA, então redija seus avisos de acordo.
- Verifique a geração de pessoas por mercado. Se sua equipe ou seus usuários estão na UE, no Reino Unido, na Suíça ou no MENA, teste um prompt com pessoas a partir dessa região antes de prometer um recurso que dependa disso.
Como chamar o Veo 3.1 Fast por código
O fluxo da Gemini API é uma operação de longa duração. A documentação oficial descreve os mesmos quatro passos para todos os SDKs:
- Enviar. Em Python, chame client.models.generate_videos com o modelo veo-3.1-fast-generate-preview e seu prompt. Por REST, envie um POST para models/veo-3.1-fast-generate-preview:predictLongRunning. Defina durationSeconds, resolution e aspectRatio explicitamente em vez de confiar nos padrões, para que o custo por chamada seja previsível.
- Receber uma operação. A resposta é um identificador de operação, não um vídeo.
- Consultar. Busque a operação de novo até que ela informe done.
- Baixar. Obtenha o arquivo gerado e grave-o no seu próprio armazenamento dentro da janela de 2 dias.
Consultar sem desperdiçar requisições
O piso de latência documentado é de 11 segundos, então faça a primeira verificação por volta de 10 a 15 segundos e depois consulte em intervalo fixo, com um timeout rígido acima do pico de 6 minutos. Registre o nome da operação junto com o prompt, para que um job expirado possa ser retomado em vez de reenviado e cobrado duas vezes.
A mesma chamada por um gateway
- fal.ai (Python): fal_client.subscribe('fal-ai/veo3.1/fast', arguments={...}) cuida da fila para você. Os parâmetros documentados são aspect_ratio, duration (4s, 6s ou 8s, padrão 8s), resolution, generate_audio (padrão true), negative_prompt, seed, auto_fix e safety_tolerance de 1 a 6.
- Vercel AI SDK: experimental_generateVideo({ model, prompt }) com o modelo definido como google/veo-3.1-fast-generate-001, conforme a página do modelo na Vercel.
Um detalhe de gateway com custo real: se você pretende colocar uma locução separada sobre as imagens, desligar generate_audio no fal economiza $0.05 por segundo, ou $0.40 por clipe de 8 segundos. Num lote de 20 clipes, são $8.00. A faixa de voz passa então a ser um item de custo próprio, e o detalhamento do custo da locução mostra como precificá-la.
Chamando por um agente em vez de um script
Rodar a geração a partir de um agente tira o laço de consulta do seu código. No Claude Code ou no Cursor, um servidor MCP expõe a geração de vídeo como uma ferramenta: o agente escreve os prompts, chama a ferramenta, espera o job e salva o arquivo, e você revisa o resultado e o custo. Gerar vídeo com IA no Claude Code via MCP percorre essa configuração de ponta a ponta.
Com um servidor MCP hospedado, a conexão é um único comando. Para a Aitachyon, ele é:
claude mcp add --transport http aitachyon https://aitachyon.com/api/mcp --header "Authorization: Bearer ait_..."
O guia rápido de API e MCP cobre a mesma chave usada por HTTP simples. Cada arquivo gerado volta com uma referência estável (scn_ para uma cena) que o código pode buscar depois com GET /api/generations/{ref}, o que evita o problema da expiração de 2 dias ao guardar a URL temporária de um provedor.
Um briefing para colar no agente
Agentes gastam dinheiro tão rápido quanto você deixar. Coloque as restrições no briefing, não na sua cabeça:
- Tarefa: gerar um clipe do Veo 3.1 Fast para cada hook listado em hooks.md.
- Formato: 8 segundos, 9:16, 720p. Não mudar resolução nem duração sem perguntar.
- Saída: salvar cada arquivo como renders/[hook-id].mp4 e acrescentar modelo, duração, resolução, prompt e custo a renders/costs.csv.
- Orçamento: parar e avisar se o total acumulado passar de $20.
- Escalonamento: perguntar antes de qualquer render em 1080p ou 4K, e antes de tentar de novo um job com falha mais de uma vez.
- Revisão: ao terminar, listar os três clipes cujos dois primeiros segundos melhor combinam com o texto do hook.
Doze hooks com esse briefing custam $9.60 no preço de tabela 720p do Google ou a partir de $18.24 a $0.19/s, então um teto de $20 se sustenta nos dois casos. Para um pipeline mais completo, com roteiro, voz e montagem numa única execução, veja uma configuração funcional para automatizar a produção de vídeo com agentes.
Escrevendo prompts que cabem em um clipe de 8 segundos
Oito segundos comportam uma ideia. A maioria dos renders que falham vem de prompts que descrevem o arco inteiro de uma cena. Uma estrutura que respeita os limites:
- Sujeito: quem ou o quê, com um ou dois detalhes visuais concretos.
- Ação única: um movimento que consiga terminar dentro do clipe.
- Câmera: o enquadramento e um único movimento de câmera.
- Luz e cenário: hora do dia, local, superfície.
- Som: como o áudio é gerado na mesma passada, diga o que deve ser ouvido, ou diga silêncio.
Antes: "A woman discovers our skincare product, tries it, loves it, and shows the results to her friends at a party."
Depois: "Close-up, vertical frame. A woman in her thirties presses a pump bottle of face serum into her palm in a bright bathroom at morning light. Slow push-in on her hands. Sound: the soft click of the pump and a quiet room tone, no music."
O primeiro prompt pede quatro cenas em oito segundos; o segundo pede um único plano. Quando você precisa de continuidade entre planos, use os controles que o Google lançou com a 3.1: até três imagens de referência para um produto ou personagem consistente, e a geração com primeiro e último quadro para fixar onde um clipe começa e termina. As imagens de referência exigem a duração de 8 segundos, então orce-as pelo preço de 8 segundos. No fal, fixar o seed permite trocar uma palavra do prompt e comparar coisas comparáveis.
Quando escolher o Veo 3.1 Fast em vez de outros modelos de vídeo
A escolha costuma ser um problema de restrições. Usando a tabela da própria Aitachyon na data da redação, as tarifas por segundo dos outros modelos de vídeo são: Hailuo 02 a $0.085/s, Kling v3 a $0.16/s sem áudio e $0.32/s com áudio nativo, Wan 2.7 a $0.19/s, e Seedance 2.5 a partir de $0.20/s em 480p e $0.44/s em 720p. O Veo 3.1 Fast aparece a partir de $0.19/s na mesma tabela.
- Menor custo por segundo de rascunho: Hailuo 02 nessa tabela, ou Veo 3.1 Lite a $0.05/s se você comprar direto do Google.
- Áudio no mesmo render: o Veo 3.1 Fast inclui o áudio no preço do Google; o Kling v3 cobra o dobro pelo modo com áudio.
- Saída em 4K: Veo 3.1 Fast ou Standard. O Lite não renderiza 4K.
- Clipes com mais de 8 segundos em uma só chamada: o Veo não faz, então encadeie clipes do Veo com extensão de cena ou teste outro modelo.
Para um comparativo direto das duas alternativas mais pedidas, leia a comparação entre Kling v3 e Seedance 2.5. A maioria das equipes se dá melhor mantendo dois modelos em rotação e enviando cada plano para o mais barato que atenda à sua restrição.
Checklist antes de um lote do Veo 3.1 Fast
- Confirme a cota de Veo do seu projeto no AI Studio.
- Fixe o código do modelo na configuração e defina durationSeconds, resolution e aspectRatio em toda chamada.
- Faça os rascunhos em 720p. Promova só os vencedores para 1080p ou 4K.
- Decida se você precisa de áudio gerado; no fal, ele muda o preço em mais 50%.
- Multiplique o custo do lote pela sua taxa de rejeição esperada e defina um teto de orçamento rígido.
- Confira as regras de personGeneration da região em que você atua.
- Copie cada arquivo para o seu próprio armazenamento ao terminar, antes da exclusão em 2 dias.
- Registre prompt, seed, modelo, resolução, duração e custo por clipe, para poder reproduzir os vencedores.
FAQ
Quanto custa por segundo a API do Veo 3.1 Fast?
Na Gemini API do Google, na data da redação, $0.10 por segundo em 720p, $0.12 em 1080p e $0.30 em 4K, com áudio incluído, então um clipe de 8 segundos em 720p custa $0.80. Os gateways cobram de forma diferente.
Qual é o nome do modelo Veo 3.1 Fast na Gemini API?
veo-3.1-fast-generate-preview. O Vercel AI Gateway usa google/veo-3.1-fast-generate-001 e o fal usa fal-ai/veo3.1/fast.
Qual a duração máxima de um vídeo do Veo 3.1 Fast?
Cada chamada retorna 4, 6 ou 8 segundos, e 1080p, 4K e imagens de referência exigem 8. Vídeos mais longos são feitos encadeando clipes ou com extensão de cena.
Quais são os limites de taxa do Veo 3.1 Fast?
O Google não lista o Veo em suas tabelas publicadas de limites de taxa. Os limites do seu projeto aparecem no AI Studio, em aistudio.google.com/rate-limit, e é em torno desse número que se planeja a concorrência.
O Veo 3.1 Fast gera áudio, e dá para remover a marca d'água?
O Veo 3.1 gera áudio nativo, e o preço por segundo do Google o inclui. Toda saída leva uma marca d'água SynthID, e a documentação não descreve nenhuma opção para desativá-la.
Sources
- Google AI for Developers: Gemini Developer API pricing
- Google AI for Developers: Generate videos with Veo 3.1 in Gemini API
- Google AI for Developers: Video generation with Veo
- Google AI for Developers: Gemini API rate limits
- Google Developers Blog: Introducing Veo 3.1 and new creative capabilities in the Gemini API (October 15, 2025)
- fal.ai: Veo 3.1 Fast
- Vercel: Veo 3.1 Fast Generate on AI Gateway
- Leonardo.Ai: Generate with Veo3.1, Veo3.1 Fast using text prompts
- BenchLM.ai: Veo 3.1 API pricing
Se o Veo 3.1 Fast é apenas um dos modelos do seu pipeline, a Aitachyon o coloca atrás da mesma chave do Kling, Seedance, Hailuo, dos modelos de imagem e do ElevenLabs, acessível pelo estúdio, pela API HTTP ou pelo Claude Code via MCP. Cada job é detalhado com seu modelo e seu custo, renders com falha são reembolsados ao centavo e o saldo pré-pago não expira. A tarifa por segundo é maior que o preço direto do Google: se você só chama o Veo, ir direto ao Google é a opção mais barata.
Artigos relacionados
Preços da API do Seedance 2.5: quanto custa de verdade um clipe
Preços da API do Seedance 2.5 por segundo em 480p, 720p e 1080p, custos reais de clipes de 5, 10 e 30 s e de lotes, e onde ter acesso sem assinatura.
GuiasPreços das APIs de geração de vídeo com IA em 2026, modelo a modelo
Como as APIs de vídeo com IA cobram (por segundo, clipe, créditos), o que move o preço, tarifas por modelo e orçamentos de lote com as repetições.
GuiasPreços da API da ElevenLabs: quanto custa de verdade uma locução (2026)
Preços da API da ElevenLabs por 1.000 caracteres e por modelo, quanto custa uma locução de 30 ou 60 segundos e como gerar em lote via código sem erros 429.
GuiasAnúncios em vídeo imobiliários que geram visitas
Como agentes e incorporadores transformam reels de imóveis, ângulos de bairro e CTAs precisos em visitas confirmadas — specs, lógica de funil e roteiro de filmagem reutilizável.
GuiasAnúncios em vídeo para academias e estúdios fitness: o guia 2026
Como academias, estúdios e treinadores criam anúncios em vídeo que enchem aulas — enquadramento de transformação, oferta de experiência paga, segmentação local e cadência de renovação criativa.
GuiasAnúncios em vídeo para a Black Friday: um plano de produção de duas semanas
Um calendário criativo BFCM dia a dia para que seus vídeos de oferta sejam testados e validados antes de os CPMs do Meta subirem até 16% — com especificações verificadas e checklist.
Ferramentas grátis para experimentar
Free AI image generator
Describe what you want and get a high-quality AI image in seconds. A free AI image generator, no account needed to preview, keep your first image when you sign up.
Experimentar grátisFree toolFree AI product photo generator
Generate clean, studio-style product photos for your store and listings in seconds. Crisp lighting and tidy backgrounds, free to try with no account, keep your first shot on signup.
Experimentar grátisFree toolFree background remover
Remove the background from any image in seconds and get a clean, transparent cutout. A free background remover, no account needed to preview, keep your first cutout when you sign up.
Experimentar grátisPare de descrever a sua marca. Cole o seu URL.
A Aitachyon lê toda a sua marca a partir do seu site e cria vídeos, imagens, carrosséis, publicações e banners, fiéis à marca, em cada formato e cada feed.