Skip to content
Ratgeber30. September 2026· 10 min Lesezeit

Preise für KI-Video-APIs 2026, Modell für Modell

Wie KI-Video-APIs abrechnen (pro Sekunde, Clip, Credits), was den Preis treibt, Tarife je Modell und durchgerechnete Batch-Budgets mit Wiederholungen.

video apipricingveoklingseedance
Ratgeber

Preise für KI-Video-APIs 2026, Modell für Modell

Zehn Sekunden KI-Video können fünfundsiebzig Cent oder vier Dollar kosten, und der Großteil dieses Unterschieds steckt im Modellnamen auf der Rechnung. Die HackerNoon-Analyse vom Juli 2026 beziffert einen 10-Sekunden-Clip mit Kling 3.0 auf etwa 0,75 $ und dieselbe Länge mit Veo 3.1 Standard auf etwa 4,00 $. Über den gesamten Markt hinweg fand die invideo-Erhebung offizieller Tarife vom August 2026 Sekundenpreise zwischen 0,02 $ und 0,70 $, eine Spanne von rund dem 35-Fachen.

Wer Videogenerierung in ein Produkt, eine Kunden-Pipeline oder einen Agenten einbaut, für den ist der Listenpreis pro Sekunde nur die erste Größe. Die Abrechnungseinheit, die Auflösungsstufe, ob Audio im Preis steckt und wie viele Versuche pro brauchbarer Einstellung verbraucht werden, bestimmen, was tatsächlich anfällt. Dieser Leitfaden geht jeden dieser Punkte durch und liefert dann eine Tarifliste je Modell sowie drei durchgerechnete Batch-Budgets zum Anpassen.

Die drei Arten, wie Video-APIs abrechnen

Fast alle Anbieter nutzen eine von drei Einheiten. Wer weiß, welche für ihn gilt, weiß auch, wie man plant und wo die Überraschungen lauern.

Pro Sekunde Ausgabe

Das ist das vorherrschende Modell. Man zahlt einen Satz mal die Länge des angeforderten Clips. Googles Preisseite der Gemini API führt Veo 3.1 so auf, und Replicate rechnet seine Wan-2.1-Modelle für Bild-zu-Video pro Sekunde erzeugtem Video ab (0,09 $/s bei 480p, 0,25 $/s bei 720p). Die Prognose ist einfach: Sekunden mal Satz. Der Haken: Jeder Stufenwechsel (Auflösung, Audio, eine „Pro"-Variante) ist ein anderer Satz, sodass dasselbe Skript je nach einem einzigen Parameter sehr unterschiedlich kosten kann.

Pro Clip oder pro Einheit

Manche Modelle berechnen einen Pauschalpreis pro generiertem Video, unabhängig von der Länge. fal.ai weist darauf hin, dass Videomodelle je nach Modell pro Sekunde oder pro Video nach Ausgabeeinheit abgerechnet werden, und listet Ovi mit 0,2 $ pro Video. Der Preis pro Clip begünstigt lange Clips und benachteiligt kurze Schnitte. Replicate rechnet die meisten seiner übrigen Modelle nach Laufzeit auf der zugrunde liegenden Hardware ab, was sich vor einem Testlauf schwerer vorhersagen lässt.

Credits

Credits sind eine Währungsschicht über einer der obigen Einheiten. Die API-Preise von Runway sind die saubere Variante: Ein Credit kostet 0,01 $, und jedes Modell verbraucht eine feste Zahl Credits pro Sekunde (gen4.5 braucht 12 Credits/s, also 0,12 $/s). Wer ein Abo gegen nutzungsbasierte Abrechnung abwägt, findet im Vergleich von Credits und Bezahlung pro Aufruf, wann welche Variante günstiger ausfällt.

Eine praktische Regel: Immer zuerst in Dollar pro Sekunde brauchbarer Ausgabe umrechnen, bevor irgendetwas verglichen wird. Ein Credit-Preis, ein Preis pro Video und ein Laufzeitpreis sind erst danach vergleichbar.

Was den Preis tatsächlich bewegt

Der Preisleitfaden 2026 von Coverr gruppiert die Treiber in Auflösung und Audio, Modellwahl, Abrechnungsstruktur und Infrastrukturaufwand. Die Primärquellen zeigen, wie groß jeder Hebel ist.

Modellstufe

Innerhalb einer Modellfamilie ist die Stufe der größte Hebel. In der Gemini API kostet Veo 3.1 Standard 0,40 $/s bei 720p und 1080p, Veo 3.1 Fast 0,10 $/s bei 720p und Veo 3.1 Lite 0,05 $/s bei 720p. Das ist eine Spanne vom 8-Fachen unter einem einzigen Modellnamen. Runway zeigt dasselbe Muster mit gen4.5 bei 12 Credits/s gegenüber gen4_turbo bei 5 Credits/s.

Auflösung

Auflösungsstufen sind selten linear. Veo 3.1 Fast steigt in der Gemini API von 0,10 $/s bei 720p auf 0,12 $/s bei 1080p und dann auf 0,30 $/s bei 4K. Runways wan3 geht über 480p, 720p und 1080p von 5 auf 10 auf 20 Credits/s und verdoppelt sich damit bei jeder Stufe. Für die meiste Social- und Produktarbeit lautet die nützliche Frage, ob die zusätzlichen Pixel die Kompression der Plattform überleben.

Audio

Natives Audio ist mal enthalten und mal eine eigene Preisstufe. Google gibt an, dass der Veo-Preis standardmäßig Video mit Audio umfasst. Runway führt seine Veo-3.1-Einträge mit Audio (40 Credits/s für veo3.1, 15 Credits/s für veo3.1_fast). Anderswo haben stumme und vertonte Versionen unterschiedliche Sätze, prüfen Sie also, welche Sie aufrufen. Wer ohnehin Sprecherstimme und Musik über den Clip legt, wirft Geld für generiertes Audio im Schnitt weg.

Zusatzposten und Referenzen

Runway weist darauf hin, dass manche Modelle zusätzlich zum Sekundensatz Gebühren pro Referenz erheben. Bildreferenzen, Charakterreferenzen und Verlängerungen können jeweils eine eigene Position haben. Lesen Sie die Seite des Modells, nicht nur den Schlagzeilenpreis.

Fehlgeschlagene Renderings

Google gibt an, dass nur berechnet wird, wenn das Video erfolgreich erzeugt wurde. Nicht jeder Anbieter dokumentiert das, und bei einem Batch aus Hunderten Jobs zeigt sich der Unterschied zwischen „Fehlschläge sind kostenlos" und „Fehlschläge werden berechnet" deutlich auf der Rechnung.

Marktpreise zum Zeitpunkt des Schreibens

Preise ändern sich oft, behandeln Sie daher jede Zahl unten als auf ihre Quelle datiert. Primärseiten sind als solche gekennzeichnet. Wo eine Zahl nur in einer Sekundärquelle vorkommt, steht das dabei.

Tarife von Herstellern und Plattformen (Primärquellen)

  • Veo 3.1 in der Gemini API: Standard 0,40 $/s (720p und 1080p), 0,60 $/s bei 4K. Fast 0,10 $/s bei 720p, 0,12 $/s bei 1080p, 0,30 $/s bei 4K. Lite 0,05 $/s bei 720p, 0,08 $/s bei 1080p, kein 4K. Quelle: Google AI for Developers.
  • Runway API: gen4.5 0,12 $/s, gen4_turbo 0,05 $/s, seedance2 0,36 $/s bei 480p/720p und 0,40 $/s bei 1080p, seedance2_fast 0,29 $/s, seedance2_mini 0,16 $/s, veo3.1_fast mit Audio 0,15 $/s, veo3.1 mit Audio 0,40 $/s. Quelle: Runway.
  • fal.ai: Wan 2.5 0,05 $/s, Kling 2.5 Turbo Pro 0,07 $/s, Veo 3 0,40 $/s, Ovi 0,2 $ pro Video. Quelle: fal.ai.
  • Replicate: wan-2.1-i2v-480p 0,09 $/s, wan-2.1-i2v-720p 0,25 $/s Ausgabe. Quelle: Replicate.

Von Sekundärquellen gemeldete Tarife (vor der Budgetierung prüfen)

  • Sora 2 API: laut invideo und HackerNoon 0,10 $/s in der Basisstufe und bis zu 0,70 $/s für Sora 2 Pro. Die eigenen Preise von OpenAI wurden für diesen Artikel nicht bestätigt, nehmen Sie die Zahlen also als Richtwerte.
  • Kling 3.0: laut HackerNoon etwa 0,075 $/s. invideo nennt für Kling 3.0 Turbo etwa 0,11 $/s, nur in 720p.
  • Seedance 2.x direkt: Abrechnung pro Million Tokens, was invideo auf etwa 0,14 $/s umrechnet.
  • Grok Video: laut invideo 0,05 $/s für 1.0 und 0,08 $/s für 1.5.
  • Runway-Zugang: Coverr berichtet, dass der Zugang zur Runway API einen Max-Tarif ab 76 $ pro Monat erfordert. Das ist eine Behauptung aus zweiter Hand; prüfen Sie Runways aktuelle Bedingungen.

Zwei Vorbehalte. Versionsnummern unterscheiden sich je nach Host (fal listet Wan 2.5 und Kling 2.5 Turbo Pro, Replicate listet Wan 2.1), und neuere Versionen werden anders bepreist. Und dasselbe Modell kann bei verschiedenen Hosts unterschiedlich viel kosten. Veo 3.1 Fast mit Audio kostet in der Gemini API 0,10 $/s bei 720p und bei Runway 15 Credits/s (0,15 $/s).

Die Tarifliste eines Aggregators: ein Schlüssel, viele Modelle

Zum Vergleich hier das Preisraster pro Aufruf bei Aitachyon zum Zeitpunkt des Schreibens. Jeder Eintrag verlinkt auf die Preisseite des jeweiligen Modells, und das vollständige maschinenlesbare Raster ist unter /api/pricing veröffentlicht, damit ein Skript es lesen kann, statt dass ein Mensch Zahlen abtippt.

Video

Bilder und Stimme (für die Standbilder und die Sprecherspur rund um das Video)

Im Licht der Primärquellen ist der Zielkonflikt klar. Veo 3.1 Fast direkt in der Gemini API aufzurufen ist pro Sekunde günstiger als über einen Aggregator. Was ein Aggregator verkauft, ist alles andere: einen Schlüssel und ein Guthaben über alle Anbieter hinweg, eine Rechnungszeile pro Job und die Möglichkeit, jede Einstellung an ein anderes Modell zu leiten, ohne fünf Konten zu eröffnen. Coverrs Vergleich von 100 Acht-Sekunden-Clips pro Monat setzt Veo 3.1 direkt bei etwa 160 $ bis 320 $ an und Aggregatoren wie fal.ai und Replicate bei 40 $ bis 200 $; der Großteil der Lücke entsteht dadurch, dass Volumen auf günstigere Modelle gelenkt wird. Für einen genaueren Blick auf zwei dieser Modelle siehe Kling v3 gegen Seedance 2.5 und die Aufschlüsselung der Veo 3.1 Fast API.

Kosten pro brauchbarem Clip: die Formel, auf die es ankommt

Die Zahl auf einer Preisseite sind die Kosten eines Versuchs. Zu budgetieren sind die Kosten eines Clips, den man behält. HackerNoon berichtet, dass professionelle Arbeit häufig drei bis fünf Durchläufe pro Hero-Shot braucht, und empfiehlt, Neugenerierungen auf drei Versuche zu begrenzen, bevor man den Ansatz überdenkt. Damit liegen die realen Kosten eines Hero-Shots beim Drei- bis Fünffachen des Listenpreises.

Verwenden Sie diese Formel für jedes Budget:

  1. Kosten pro Versuch = Satz pro Sekunde x angeforderte Sekunden (oder der Pauschalpreis pro Clip).
  2. Zusatzposten = Gebühren für Referenzen, Audio oder Upscaling bei diesem Aufruf, falls vorhanden.
  3. Versuche pro behaltenem Clip = Ihr gemessener Durchschnitt. Starten Sie mit 3 für Hero-Shots, wie HackerNoon es vorschlägt, und ersetzen Sie den Wert nach dem ersten Batch durch Ihre eigene Zahl.
  4. Kosten fehlgeschlagener Renderings = null, wenn der Anbieter Fehlschläge erstattet oder nicht berechnet, sonst die Fehlerquote aufschlagen.
  5. Kosten pro brauchbarem Clip = (Kosten pro Versuch + Zusatzposten) x Versuche pro behaltenem Clip + Kosten fehlgeschlagener Renderings.

Ein durchgerechnetes Beispiel: Ein stummer 10-Sekunden-Clip mit Kling v3 zu 0,16 $/s kostet 1,60 $ pro Versuch. Bei drei Versuchen kostet der behaltene Clip 4,80 $. Bei fünf sind es 8,00 $. Dieselbe Einstellung mit Hailuo 02 zu 0,085 $/s kostet 0,85 $ pro Versuch und 2,55 $ bei drei Versuchen. Wenn die Zahl der Versuche dominiert, schlägt ein günstigeres Modell, mit dem man schnell iteriert, oft ein teureres, das man seltener neu würfeln muss, und wissen kann man das nur, wenn man die Versuche pro behaltenem Clip je Modell protokolliert.

Um die Kosten pro Versuch zu senken, testen Sie Prompts in der kürzesten vom Modell erlaubten Länge, fixieren die Komposition und rendern die volle Länge dann einmal.

Drei durchgerechnete Batch-Budgets

Sie beruhen auf den oben genannten Aitachyon-Tarifen zum Zeitpunkt des Schreibens. Die Annahmen zu Wiederholungen sind ausgewiesen, damit Sie eigene einsetzen können.

Batch 1: 20 Video-Hooks für einen Kreativtest

Zwanzig Eröffnungsszenen von je 5 Sekunden, jede als erster Beat eines bezahlten Social-Videos getestet. Hooks sind kurz und haben wenig Gewicht, gehen Sie also von 2 Versuchen pro behaltenem Clip aus.

  • Hailuo 02: 20 x 5 s x 0,085 $ = 8,50 $ pro Durchlauf, 17,00 $ bei 2 Versuchen.
  • Kling v3 stumm: 20 x 5 s x 0,16 $ = 16,00 $ pro Durchlauf, 32,00 $ bei 2 Versuchen.
  • Seedance 2.5 in 720p: 20 x 5 s x 0,44 $ = 44,00 $ pro Durchlauf, 88,00 $ bei 2 Versuchen.

Die Modellwahl verändert die Batch-Kosten bei gleichem Briefing um etwa das 5-Fache. Bei einem Hook-Test, dessen Zweck es ist herauszufinden, welche Eröffnung Aufmerksamkeit gewinnt, ist das günstige Modell meist die richtige Wahl. Die Hook-Ideen selbst zählen mehr, und diese Hook-Vorlagen liefern zwanzig Prompts zum Start.

Batch 2: 50 Produktbilder

Fünfzig Standbilder für eine Katalogaktualisierung oder statische Creatives, je ein Versuch plus 50 % Puffer für Wiederholungen (insgesamt 75 Generierungen).

  • Seedream 4.0: 75 x 0,057 $ = 4,28 $.
  • FLUX.2 [pro]: 75 x 0,057 $ bis 0,086 $ = 4,28 $ bis 6,45 $.
  • Nano Banana: 75 x 0,13 $ = 9,75 $.
  • gpt-image-2: 75 x 0,10 $ bis 0,40 $ = 7,50 $ bis 30,00 $.

Standbilder sind eine Größenordnung günstiger als Video. Werden einige dieser 50 Bilder anschließend animiert, animieren Sie nur die Gewinner. Fünf ausgewählte Bilder, zu stummen 5-Sekunden-Clips mit Kling v3 bei je drei Versuchen, kosten zusätzlich 5 x 5 x 0,16 $ x 3 = 12,00 $.

Batch 3: eine Woche Shorts

Sieben Shorts, jeder aus vier 5-Sekunden-Clips (20 Sekunden Video), einem Sprechertext von bis zu 900 Zeichen und einem Titelbild. Angenommen sind 2 Versuche pro Clip.

  • Video mit Kling v3 stumm: 7 x 20 s x 0,16 $ x 2 = 44,80 $.
  • Sprecherstimme: 900 Zeichen sind zwei Einheiten zu 450 Zeichen, also 0,086 $ bis 0,172 $ pro Short, 0,60 $ bis 1,20 $ für die Woche.
  • Titelbilder mit Seedream 4.0: 7 x 0,057 $ = 0,40 $.
  • Wochensumme: etwa 45,80 $ bis 46,40 $.

Tauscht man Kling stumm gegen Kling mit nativem Audio (0,32 $/s), verdoppelt sich die Videozeile auf 89,60 $. Deshalb ist stummes Video plus separate Sprecherstimme meist der günstigere Aufbau, wenn die Erzählung die Botschaft trägt. Die Kostenaufschlüsselung für ElevenLabs-Sprecherstimmen geht bei den Preisen für Vertonung weiter ins Detail.

Routing-Regeln: welches Modell für welche Einstellung

Bei Preisen pro Aufruf ist die Modellwahl eine Entscheidung pro Einstellung und kein Abo, auf das man sich festlegt. Diese Regeln stützen sich nur auf die oben dokumentierten Unterschiede bei Preis und Ausstattung.

  1. Exploration und Hook-Tests: Nehmen Sie das günstigste Modell, das eine akzeptable Komposition liefert. Hailuo 02 zu 0,085 $/s ist das untere Ende dieses Rasters.
  2. Vertonte Inhalte: Nutzen Sie stummes Video und fügen Sie eine separate Sprecherstimme hinzu. Kling v3 stumm zu 0,16 $/s plus ElevenLabs kostet für dieselben Sekunden weniger als Kling mit Audio zu 0,32 $/s.
  3. Einstellungen mit synchronem nativem Ton (Dialog, Originalgeräusche): Zahlen Sie die Audiostufe und budgetieren Sie sie mit dem Doppelten des stummen Satzes, sofern das Modell eine hat.
  4. Auflösung: Beginnen Sie mit der niedrigsten Stufe, die die Kompression Ihres Zielkanals übersteht. Seedance 2.5 kostet 0,20 $/s bei 480p und 0,44 $/s bei 720p; gehen Sie nur für einen Clip höher, den Sie behalten.
  5. Hero-Shots: Geben Sie erst dann für das Premium-Modell aus, wenn der Prompt auf einem günstigen Modell feststeht, und begrenzen Sie die Versuche wie von HackerNoon empfohlen auf drei.
  6. Erst Standbilder: Wenn ein Bild die Aufgabe erfüllt, kostet es Cent. Wann ein statisches Bild ein Video schlägt zeigt, wo das gilt.

Generierung automatisieren, ohne die Ausgaben aus der Hand zu geben

Batch-Budgets bleiben ehrlich, wenn die Generierung aus Code läuft, denn Code protokolliert jeden Aufruf, während eine Weboberfläche zu Wiederholungen einlädt, die niemand zählt. Entwickler und kleine Teams, die in Menge produzieren, steuern die Generierung per Skript oder über einen Agenten wie Claude Code oder Cursor mittels MCP-Server: Ein Prompt oder eine Job-Datei geht hinein, Dateien mit den Kosten pro Aufruf kommen heraus.

Eine Checkliste vor jedem automatisierten Batch

  • Legen Sie Modell und Stufe im Aufruf explizit fest. Verlassen Sie sich nie auf eine Standardauflösung oder Standard-Audioeinstellung.
  • Lesen Sie das Preisraster vor dem Lauf per Programm aus und berechnen Sie die Batch-Obergrenze: Jobs x Sekunden x Satz x erwartete Versuche.
  • Setzen Sie im Code eine harte Obergrenze für Versuche pro Einstellung (drei ist ein vernünftiger Standard für Hero-Shots).
  • Verwenden Sie pro Projekt oder Kunde einen eigenen API-Schlüssel, damit sich die Ausgaben trennen lassen.
  • Klären Sie, wie fehlgeschlagene Renderings abgerechnet werden, bevor Sie Hunderte Jobs starten.
  • Speichern Sie zu jeder Ausgabe eine stabile Referenz und die Kosten des Aufrufs, der sie erzeugt hat, um danach die Kosten pro behaltenem Clip zu berechnen.
  • Prüfen Sie nach jedem Batch die Versuche pro behaltenem Clip je Modell und aktualisieren Sie Ihre Routing-Regeln.

Agenten machen das schneller und zugleich riskanter: Ein Agent würfelt eine Einstellung gern zehnmal neu, wenn ihn nichts bremst. Ausgabenwarnungen pro Schlüssel und ein widerrufbarer Schlüssel sind die Leitplanken. Für ein funktionierendes Agenten-Setup siehe Video aus Claude Code mit einem MCP-Server erzeugen, und für den Schnellstart von API und MCP die Entwicklerdokumentation.

FAQ

Was kostet eine KI-Video-API pro Sekunde?

Die offiziellen Tarife liegen zum Zeitpunkt des Schreibens bei etwa 0,02 $ bis 0,70 $ pro Sekunde, laut der invideo-Erhebung vom August 2026. In Googles eigener API reicht Veo 3.1 von 0,05 $/s (Lite, 720p) bis 0,60 $/s (Standard, 4K).

Ist es günstiger, eine Video-API direkt oder über einen Aggregator zu nutzen?

Für ein einzelnes Modell in großer Menge kann der direkte Weg pro Sekunde günstiger sein, etwa bei Veo 3.1 Fast in der Gemini API. Aggregatoren gewinnen, wenn Sie verschiedene Einstellungen an verschiedene Modelle leiten, da günstigere Modelle auf einem gemeinsamen Guthaben den Durchschnitt senken. Coverrs Beispiel mit 100 Acht-Sekunden-Clips pro Monat setzt Veo 3.1 direkt bei 160 $ bis 320 $ gegen 40 $ bis 200 $ bei Aggregatoren an.

Zahlt man für fehlgeschlagene KI-Videogenerierungen?

Das hängt vom Anbieter ab. Google gibt an, dass Veo nur berechnet wird, wenn das Video erfolgreich erzeugt wurde. Prüfen Sie die Bedingungen jedes Anbieters, denn bei großen Batches summiert sich die Abrechnung fehlgeschlagener Jobs.

Wie viele Versuche sollte ich pro KI-Videoclip einplanen?

HackerNoon berichtet von drei bis fünf Durchläufen pro Hero-Shot in professioneller Arbeit und schlägt vor, bei drei zu deckeln, bevor man den Ansatz ändert. Bei Clips mit wenig Gewicht wie Hook-Tests messen Sie nach dem ersten Batch Ihre eigene Quote und budgetieren daraus.

Quellen

  1. Google AI for Developers: Gemini Developer API pricing
  2. Runway: API pricing
  3. fal.ai: Pricing
  4. Replicate: Pricing
  5. invideo: AI Video Model Pricing (Aug 2026), Official Per-Second Rates, Normalized
  6. HackerNoon: The same 10 seconds of AI video can cost $0.75 or $4
  7. Coverr: AI video generation API pricing 2026

Wenn Sie die obigen Batches ausführen möchten, ohne pro Anbieter ein Konto zu eröffnen: Aitachyon bündelt diese Video-, Bild- und Sprachmodelle hinter einem vorausbezahlten Guthaben, das nie verfällt, nutzbar über das Web-Studio, eine einfache HTTP-API oder einen gehosteten MCP-Server. Jeder Job wird mit Modell und Kosten aufgeschlüsselt, fehlgeschlagene Renderings werden automatisch erstattet, und jeder Schlüssel hat seine eigene Ausgabenwarnung und einen Widerruf per Klick. Die Preise stehen auf der Seite jedes Modells.

Ähnliche Artikel

Kostenlose Tools zum Ausprobieren

Beschreiben Sie Ihre Marke nicht mehr. Fügen Sie Ihre URL ein.

Aitachyon liest Ihre ganze Marke von Ihrer Website und erstellt dann Videos, Bilder, Karussells, Posts und Banner, markengerecht, für jedes Format und jeden Feed.