Precios de las API de generación de vídeo con IA en 2026, modelo por modelo
Cómo facturan las API de vídeo con IA (por segundo, por clip, con créditos), qué mueve el precio, tarifas por modelo y presupuestos de lotes con reintentos.
Precios de las API de generación de vídeo con IA en 2026, modelo por modelo
Diez segundos de vídeo con IA pueden costar setenta y cinco céntimos o cuatro dólares, y casi toda esa diferencia viene del nombre del modelo en la factura. El análisis de HackerNoon de julio de 2026 sitúa un clip de 10 segundos en Kling 3.0 en unos 0,75 $ y la misma duración en Veo 3.1 Standard en unos 4,00 $. En el conjunto del mercado, el estudio de invideo de agosto de 2026 sobre tarifas oficiales encontró precios por segundo de entre 0,02 $ y 0,70 $, una horquilla de unas 35 veces.
Si vas a integrar la generación de vídeo en un producto, en un pipeline de cliente o en un agente, el precio de lista por segundo es solo el primer dato. La unidad de facturación, el nivel de resolución, si el audio va incluido y cuántos intentos quemas por plano aprovechable determinan lo que pagas de verdad. Esta guía repasa cada uno de esos factores y después ofrece una lista de tarifas por modelo y tres presupuestos de lote calculados que puedes adaptar.
Las tres formas en que te facturan las API de vídeo
Casi todos los proveedores usan una de tres unidades. Saber cuál te toca indica cómo hacer la previsión y dónde se esconden las sorpresas.
Por segundo de salida
Es el modelo dominante. Pagas una tarifa multiplicada por la duración del clip que pediste. La página de precios de la API de Gemini de Google lista Veo 3.1 así, y Replicate factura sus modelos Wan 2.1 de imagen a vídeo por segundo de vídeo generado (0,09 $/s en 480p, 0,25 $/s en 720p). La previsión es sencilla: segundos por tarifa. El problema es que cada cambio de nivel (resolución, audio, una variante «Pro») es otra tarifa, así que el mismo guion puede costar muy distinto según un solo parámetro.
Por clip o por unidad
Algunos modelos cobran un precio fijo por vídeo generado, sin importar la duración. fal.ai señala que sus modelos de vídeo se facturan por unidad de salida, por segundo o por vídeo según el modelo, y lista Ovi a 0,2 $ por vídeo. El precio por clip favorece los clips largos y penaliza los cortes breves. Replicate factura la mayoría de sus demás modelos por tiempo de ejecución en el hardware subyacente, algo más difícil de prever antes de lanzar una muestra.
Créditos
Los créditos son una capa de moneda sobre una de las unidades anteriores. La API de Runway es la versión más limpia: un crédito cuesta 0,01 $ y cada modelo consume un número fijo de créditos por segundo (gen4.5 usa 12 créditos/s, es decir, 0,12 $/s). Si estás sopesando una suscripción frente a la facturación por consumo, la comparativa entre créditos y pago por llamada repasa cuándo sale más barata cada una.
Una regla práctica: convierte siempre a dólares por segundo de salida aprovechable antes de comparar nada. Un precio en créditos, un precio por vídeo y un precio por tiempo de ejecución no son comparables hasta que lo haces.
Qué mueve realmente el precio
La guía de precios 2026 de Coverr agrupa los factores en resolución y audio, elección del modelo, estructura de facturación y costes de infraestructura. Las fuentes primarias muestran cuánto pesa cada palanca.
Nivel del modelo
Dentro de una misma familia, el nivel es la palanca más grande. En la API de Gemini, Veo 3.1 Standard cuesta 0,40 $/s en 720p y 1080p, Veo 3.1 Fast cuesta 0,10 $/s en 720p y Veo 3.1 Lite cuesta 0,05 $/s en 720p. Son 8 veces de diferencia bajo un mismo nombre de modelo. Runway muestra el mismo patrón con gen4.5 a 12 créditos/s frente a gen4_turbo a 5 créditos/s.
Resolución
Los saltos de resolución rara vez son lineales. Veo 3.1 Fast en la API de Gemini pasa de 0,10 $/s en 720p a 0,12 $/s en 1080p y luego a 0,30 $/s en 4K. El wan3 de Runway va de 5 a 10 y a 20 créditos/s en 480p, 720p y 1080p, con un doble en cada escalón. Para la mayor parte del trabajo social y de producto, la pregunta útil es si los píxeles extra sobreviven a la compresión de la plataforma.
Audio
El audio nativo a veces va incluido y a veces se factura como un nivel aparte. Google indica que el precio de Veo incluye vídeo con audio por defecto. Runway lista sus entradas de Veo 3.1 con audio (40 créditos/s para veo3.1, 15 créditos/s para veo3.1_fast). En otros sitios las versiones silenciosa y con audio tienen tarifas distintas, así que comprueba cuál estás llamando. Si de todos modos vas a poner una locución y música encima del clip, pagar por audio generado es dinero que se tira en el montaje.
Extras y referencias
Runway indica que algunos modelos suman cargos por referencia sobre la tarifa por segundo. Las imágenes de referencia, las referencias de personaje y las extensiones pueden llevar cada una su propia línea. Lee la página del modelo, no solo la tarifa de cabecera.
Renders fallidos
Google afirma que solo se cobra si el vídeo se genera con éxito. No todos los proveedores lo documentan, y en un lote de cientos de trabajos la diferencia entre «los fallos son gratis» y «los fallos se facturan» se nota con claridad en la factura.
Tarifas del mercado en el momento de escribir
Los precios cambian a menudo, así que trata cada cifra de abajo como fechada en su fuente. Las páginas primarias van marcadas como tales. Cuando una cifra solo existe en una fuente secundaria, se etiqueta así.
Tarifas de los fabricantes y las plataformas (fuentes primarias)
- Veo 3.1 en la API de Gemini: Standard 0,40 $/s (720p y 1080p), 0,60 $/s en 4K. Fast 0,10 $/s en 720p, 0,12 $/s en 1080p, 0,30 $/s en 4K. Lite 0,05 $/s en 720p, 0,08 $/s en 1080p, sin 4K. Fuente: Google AI for Developers.
- API de Runway: gen4.5 0,12 $/s, gen4_turbo 0,05 $/s, seedance2 0,36 $/s en 480p/720p y 0,40 $/s en 1080p, seedance2_fast 0,29 $/s, seedance2_mini 0,16 $/s, veo3.1_fast con audio 0,15 $/s, veo3.1 con audio 0,40 $/s. Fuente: Runway.
- fal.ai: Wan 2.5 0,05 $/s, Kling 2.5 Turbo Pro 0,07 $/s, Veo 3 0,40 $/s, Ovi 0,2 $ por vídeo. Fuente: fal.ai.
- Replicate: wan-2.1-i2v-480p 0,09 $/s, wan-2.1-i2v-720p 0,25 $/s de salida. Fuente: Replicate.
Tarifas de fuentes secundarias (verifícalas antes de presupuestar)
- API de Sora 2: invideo y HackerNoon la sitúan en 0,10 $/s en el nivel base y hasta 0,70 $/s para Sora 2 Pro. Los precios propios de OpenAI no se confirmaron para este artículo, así que tómalos como orientativos.
- Kling 3.0: unos 0,075 $/s según HackerNoon. invideo cifra Kling 3.0 Turbo en unos 0,11 $/s, solo en 720p.
- Seedance 2.x directo: se factura por millón de tokens, lo que invideo aproxima a unos 0,14 $/s.
- Grok Video: 0,05 $/s para la 1.0 y 0,08 $/s para la 1.5, según invideo.
- Acceso a Runway: Coverr informa de que el acceso a la API de Runway exige un plan Max de 76 $ o más al mes. Es una afirmación de segunda mano; comprueba las condiciones vigentes de Runway.
Dos advertencias. Los números de versión difieren entre plataformas (fal lista Wan 2.5 y Kling 2.5 Turbo Pro, Replicate lista Wan 2.1), y las versiones más nuevas se tarifican distinto. Además, el mismo modelo puede costar importes distintos según dónde se aloje. Veo 3.1 Fast con audio cuesta 0,10 $/s en 720p en la API de Gemini y 15 créditos/s (0,15 $/s) en Runway.
La lista de tarifas de un agregador: una clave, muchos modelos
A modo de comparación, esta es la parrilla por llamada de Aitachyon en el momento de escribir. Cada entrada enlaza con la página de precios del propio modelo, y la parrilla completa, legible por máquina, se publica en /api/pricing para que un script la lea en lugar de que una persona copie cifras.
Vídeo
- Seedance 2.5 (ByteDance): desde 0,20 $/s en 480p, 0,44 $/s en 720p.
- Kling v3 (Kuaishou): 0,16 $/s sin audio, 0,32 $/s con audio nativo.
- Veo 3.1 Fast (Google): desde 0,19 $/s.
- Wan 2.7 (Alibaba): 0,19 $/s.
- Hailuo 02 (MiniMax): 0,085 $/s.
Imágenes y voz (para las imágenes fijas y la narración que rodean al vídeo)
- Seedream 4.0: 0,057 $ por imagen.
- FLUX.2 [pro]: de 0,057 $ a 0,086 $ por imagen.
- Nano Banana: 0,13 $ por imagen.
- gpt-image-2: de 0,10 $ a 0,40 $ por imagen.
- Locución de ElevenLabs: de 0,043 $ a 0,086 $ por cada 450 caracteres.
Leído junto a las fuentes primarias, el equilibrio es claro. Llamar a Veo 3.1 Fast directamente en la API de Gemini sale más barato por segundo que hacerlo a través de un agregador. Lo que vende un agregador es todo lo demás: una clave y un saldo únicos entre proveedores, una línea de factura por trabajo y la posibilidad de enviar cada plano a un modelo distinto sin abrir cinco cuentas. La comparativa de Coverr con 100 clips de ocho segundos al mes sitúa Veo 3.1 directo en unos 160 $ a 320 $ y agregadores como fal.ai y Replicate entre 40 $ y 200 $, y buena parte de esa diferencia viene de derivar volumen a modelos más baratos. Para profundizar en dos de estos modelos, consulta Kling v3 frente a Seedance 2.5 y el análisis de la API de Veo 3.1 Fast.
Coste por clip aprovechable: la fórmula que importa
La cifra de una página de precios es el coste de un intento. La cifra que debes presupuestar es el coste de un clip que te quedas. HackerNoon informa de que el trabajo profesional suele requerir de tres a cinco pasadas por plano principal, y recomienda limitar las regeneraciones a tres intentos antes de replantear el enfoque. Eso deja el coste real de un plano principal entre tres y cinco veces el precio de lista.
Usa esta fórmula en cada presupuesto:
- Coste del intento = tarifa por segundo x segundos pedidos (o el precio fijo por clip).
- Extras = cargos por referencia, audio o escalado de esa llamada, si los hay.
- Intentos por clip válido = tu media medida. Empieza con 3 para planos principales, como sugiere HackerNoon, y sustitúyelo por tu propia cifra tras el primer lote.
- Coste de renders fallidos = cero si el proveedor reembolsa o no factura los fallos; si no, suma la tasa de fallos.
- Coste por clip aprovechable = (coste del intento + extras) x intentos por clip válido + coste de renders fallidos.
Un ejemplo calculado: un clip de Kling v3 sin audio de 10 segundos a 0,16 $/s cuesta 1,60 $ por intento. Con tres intentos, el clip válido cuesta 4,80 $. Con cinco, 8,00 $. El mismo plano en Hailuo 02 a 0,085 $/s cuesta 0,85 $ por intento y 2,55 $ con tres intentos. Cuando manda el número de intentos, un modelo más barato con el que se itera rápido suele ganar a uno más caro que hay que relanzar menos veces, y la única forma de saberlo es registrar los intentos por clip válido en cada modelo.
Para reducir el coste del intento, prueba los prompts con la duración más corta que permita el modelo, fija la composición y renderiza la duración completa una sola vez.
Tres presupuestos de lote calculados
Usan las tarifas de Aitachyon listadas arriba, en el momento de escribir. Los supuestos de reintento están a la vista para que puedas cambiarlos por los tuyos.
Lote 1: 20 ganchos de vídeo para un test creativo
Veinte planos de apertura de 5 segundos, cada uno probado como primer golpe de un vídeo de pago en redes. Los ganchos son cortos y de poco riesgo, así que supón 2 intentos por clip válido.
- Hailuo 02: 20 x 5 s x 0,085 $ = 8,50 $ por pasada, 17,00 $ con 2 intentos.
- Kling v3 sin audio: 20 x 5 s x 0,16 $ = 16,00 $ por pasada, 32,00 $ con 2 intentos.
- Seedance 2.5 en 720p: 20 x 5 s x 0,44 $ = 44,00 $ por pasada, 88,00 $ con 2 intentos.
La elección del modelo cambia el coste del lote en unas 5 veces para el mismo brief. En un test de ganchos, donde lo que importa es aprender qué apertura capta la atención, el modelo barato suele ser la decisión correcta. Las ideas de gancho pesan más, y estas plantillas de ganchos te dan veinte prompts para empezar.
Lote 2: 50 imágenes de producto
Cincuenta imágenes fijas para renovar un catálogo o para creatividades estáticas, un intento cada una más un 50 % de margen de repetición (75 generaciones en total).
- Seedream 4.0: 75 x 0,057 $ = 4,28 $.
- FLUX.2 [pro]: 75 x 0,057 $ a 0,086 $ = 4,28 $ a 6,45 $.
- Nano Banana: 75 x 0,13 $ = 9,75 $.
- gpt-image-2: 75 x 0,10 $ a 0,40 $ = 7,50 $ a 30,00 $.
Las imágenes fijas cuestan un orden de magnitud menos que el vídeo. Si después animas algunas de esas 50, anima solo las ganadoras. Cinco imágenes elegidas y convertidas en clips de 5 segundos de Kling v3 sin audio, con tres intentos cada una, suman 5 x 5 x 0,16 $ x 3 = 12,00 $.
Lote 3: una semana de shorts
Siete shorts, cada uno formado por cuatro clips de 5 segundos (20 segundos de vídeo), un guion de locución de hasta 900 caracteres y una imagen de portada. Supón 2 intentos por clip.
- Vídeo en Kling v3 sin audio: 7 x 20 s x 0,16 $ x 2 = 44,80 $.
- Locución: 900 caracteres son dos unidades de 450, así que 0,086 $ a 0,172 $ por short, 0,60 $ a 1,20 $ la semana.
- Portadas en Seedream 4.0: 7 x 0,057 $ = 0,40 $.
- Total de la semana: unos 45,80 $ a 46,40 $.
Cambia Kling sin audio por Kling con audio nativo (0,32 $/s) y la línea de vídeo se duplica hasta 89,60 $. Por eso combinar vídeo sin audio con una locución aparte suele ser la pila más barata cuando la narración lleva el mensaje. El desglose del coste de las locuciones de ElevenLabs profundiza en los precios de narración.
Reglas de enrutado: qué modelo para qué plano
Con precio por llamada, elegir modelo es una decisión plano a plano y no una suscripción a la que te comprometes. Estas reglas se apoyan solo en las diferencias de precio y de especificaciones documentadas arriba.
- Exploración y tests de ganchos: usa el modelo más barato que dé una composición aceptable. Hailuo 02 a 0,085 $/s es el extremo bajo de esta parrilla.
- Contenido narrado: usa vídeo sin audio y añade una locución aparte. Kling v3 sin audio a 0,16 $/s más ElevenLabs cuesta menos que Kling con audio a 0,32 $/s por los mismos segundos.
- Planos que necesitan sonido nativo sincronizado (diálogo, ruido de ambiente): paga el nivel de audio y presupuéstalo al doble de la tarifa sin audio cuando el modelo tenga una.
- Resolución: empieza en el nivel más bajo que sobreviva a la compresión de tu destino. Seedance 2.5 cuesta 0,20 $/s en 480p y 0,44 $/s en 720p; sube solo para un clip que vayas a conservar.
- Planos principales: gasta en el modelo premium solo cuando el prompt esté cerrado en uno barato, y limita los intentos a tres, como recomienda HackerNoon.
- Primero las imágenes fijas: si una imagen sirve, cuesta céntimos. Cuándo una imagen estática gana al vídeo explica dónde se cumple.
Automatizar la generación sin perder el control del gasto
Los presupuestos de lote se mantienen honestos cuando la generación corre desde código, porque el código registra cada llamada y una interfaz web invita a repeticiones que nadie cuenta. Los desarrolladores y los equipos pequeños que producen a volumen lanzan la generación desde un script, o desde un agente como Claude Code o Cursor a través de un servidor MCP: entra un prompt o un archivo de trabajos, salen archivos con el coste de cada llamada.
Una lista de comprobación previa para cualquier lote automatizado
- Fija el modelo y el nivel de forma explícita en la llamada. No confíes nunca en una resolución o un ajuste de audio por defecto.
- Lee la parrilla de precios por programa antes de la ejecución y calcula el techo del lote: trabajos x segundos x tarifa x intentos esperados.
- Fija en el código un tope estricto de intentos por plano (tres es un valor sensato para planos principales).
- Usa una clave de API dedicada por proyecto o por cliente para poder separar el gasto.
- Confirma cómo se facturan los renders fallidos antes de lanzar cientos de trabajos.
- Guarda una referencia estable de cada salida y el coste de la llamada que la produjo, para calcular después el coste por clip válido.
- Revisa los intentos por clip válido de cada modelo tras cada lote y actualiza tus reglas de enrutado.
Los agentes lo hacen más rápido y también más arriesgado: un agente repetirá un plano diez veces sin protestar si nada lo detiene. Las alertas de gasto por clave y una clave revocable son las barandillas. Para una configuración de agente que funciona, consulta generar vídeo desde Claude Code con un servidor MCP y, para el inicio rápido de la API y del MCP, la documentación para desarrolladores.
FAQ
¿Cuánto cuesta por segundo una API de generación de vídeo con IA?
Las tarifas oficiales en el momento de escribir van de unos 0,02 $ a 0,70 $ por segundo, según el estudio de invideo de agosto de 2026. En la propia API de Google, Veo 3.1 va de 0,05 $/s (Lite, 720p) a 0,60 $/s (Standard, 4K).
¿Sale más barato usar una API de vídeo directamente o a través de un agregador?
Para un único modelo a volumen, ir directo puede ser más barato por segundo, como con Veo 3.1 Fast en la API de Gemini. Los agregadores ganan cuando envías planos distintos a modelos distintos, ya que los modelos más baratos sobre un saldo compartido bajan la media. El ejemplo de Coverr con 100 clips de ocho segundos al mes sitúa Veo 3.1 directo en 160 $ a 320 $ frente a 40 $ a 200 $ en agregadores.
¿Se pagan las generaciones de vídeo con IA que fallan?
Depende del proveedor. Google afirma que Veo solo se cobra cuando el vídeo se genera con éxito. Revisa las condiciones de cada proveedor, porque en lotes grandes la facturación de trabajos fallidos se acumula.
¿Cuántos intentos debo presupuestar por clip de vídeo con IA?
HackerNoon informa de tres a cinco pasadas por plano principal en trabajo profesional, y sugiere limitar a tres antes de cambiar de enfoque. Para clips de poco riesgo, como los tests de ganchos, mide tu propia tasa tras el primer lote y presupuesta a partir de ella.
Fuentes
- Google AI for Developers: Gemini Developer API pricing
- Runway: API pricing
- fal.ai: Pricing
- Replicate: Pricing
- invideo: AI Video Model Pricing (Aug 2026), Official Per-Second Rates, Normalized
- HackerNoon: The same 10 seconds of AI video can cost $0.75 or $4
- Coverr: AI video generation API pricing 2026
Si quieres ejecutar los lotes de arriba sin abrir una cuenta por proveedor, Aitachyon reúne estos modelos de vídeo, imagen y voz tras un saldo prepago que nunca caduca, utilizable desde el estudio web, una API HTTP sencilla o un servidor MCP alojado. Cada trabajo se detalla con su modelo y su coste, los renders fallidos se reembolsan automáticamente y cada clave tiene su propia alerta de gasto y una revocación con un clic. Los precios están en la página de cada modelo.
Artículos relacionados
Precios de la API de Seedance 2.5: lo que cuesta de verdad un clip
Precios de la API de Seedance 2.5 por segundo en 480p, 720p y 1080p, costes reales de clips de 5, 10 y 30 s y de lotes, y dónde acceder sin suscripción.
GuíasAPI de Veo 3.1 Fast: precio, límites y cómo llamarla
Precio por segundo de la API de Veo 3.1 Fast, duraciones, resoluciones, latencia y cuotas según Google, y cómo llamarla desde código o desde Claude Code.
GuíasPrecios de la API de ElevenLabs: cuánto cuesta realmente una locución (2026)
Precio de la API de ElevenLabs por 1000 caracteres y modelo, coste de una locución de 30 o 60 s y cómo generarlas en lote desde código sin errores 429.
GuíasAnuncios de video inmobiliario que generan visitas
Cómo agentes y promotores convierten reels de propiedades, ángulos de barrio y CTAs precisos en visitas confirmadas — specs, lógica de embudo y guion de rodaje reutilizable.
GuíasAnuncios de vídeo para gimnasios y estudios de fitness: guía 2026
Cómo gimnasios, estudios y entrenadores crean anuncios de vídeo que llenan clases: encuadres de transformación, ofertas de prueba de pago, segmentación local y cadencia de renovación creativa.
GuíasAnuncios de vídeo para el Black Friday: un plan de producción de dos semanas
Un calendario creativo BFCM día a día para que tus vídeos de oferta estén probados y validados antes de que los CPM de Meta suban hasta un 16 % — con specs verificadas y checklist.
Herramientas gratis para probar
Free AI image generator
Describe what you want and get a high-quality AI image in seconds. A free AI image generator, no account needed to preview, keep your first image when you sign up.
Probar gratisFree toolFree AI product photo generator
Generate clean, studio-style product photos for your store and listings in seconds. Crisp lighting and tidy backgrounds, free to try with no account, keep your first shot on signup.
Probar gratisFree toolFree background remover
Remove the background from any image in seconds and get a clean, transparent cutout. A free background remover, no account needed to preview, keep your first cutout when you sign up.
Probar gratisDeja de describir tu marca. Pega tu URL.
Aitachyon lee toda tu marca desde tu sitio web y crea vídeos, imágenes, carruseles, publicaciones y banners, fieles a tu marca, en cada formato y cada feed.