Skip to content
Tutorials30. September 2026· 9 min Lesezeit

TikTok-Videos mit KI automatisieren: eine tägliche Pipeline, die hält

Aus einer Themenliste täglich Hochformat-Videos per Code oder Agent: Kosten pro Video, Batches, Limits der TikTok-API und Regeln zur KI-Kennzeichnung.

tiktokshortsautomationai video
Tutorials

TikTok-Videos mit KI automatisieren: eine tägliche Pipeline, die hält

Um 6 Uhr morgens liest ein Skript Zeile 14 einer Themendatei, schreibt einen 40-sekündigen Sprechertext, rendert vier Hochformat-Einstellungen und eine Erzählspur, fügt alles zusammen und lädt das Ergebnis mit bereits gesetztem KI-Label bei TikTok hoch. Wenn du den Laptop aufklappst, liegt die Datei in den Entwürfen des Kontos, die Kosten stehen daneben. Nichts davon ist 2026 schwer zu bauen. Ob es funktioniert, entscheiden das Audit der TikTok-API, die Plattformregeln zur Kennzeichnung von KI-Inhalten und die YouTube-Richtlinie zu massenhaft produzierten Videos, die eine tägliche Pipeline unbemerkt in eine nicht monetarisierbare verwandeln kann.

Das ist die Pipeline, die wir selbst bauen würden, mit der Rechnung für jedes Video, den Limits, die den Zeitplan bestimmen, und den Prüfungen, die verhindern, dass das Ergebnis wie Füllmaterial wirkt.

Die Pipeline in sechs Stufen

Halte die sechs Stufen getrennt: Jede scheitert auf eigene Weise und hat ihre eigene Kostenzeile.

  1. Themen-Warteschlange. Eine Zeile pro Video: Thema, Blickwinkel, Quellenmaterial, Plattform.
  2. Skript. Ein Sprachmodell schreibt Hook, Hauptteil und Schluss sowie einen visuellen Prompt pro Beat.
  3. Visuals. Jede Einstellung auf der Liste geht an ein Bild- oder Videomodell. Standbilder für erklärende Passagen, Bewegung für den Hook und die Pointe.
  4. Stimme. Das Skript wird zu einer einzigen Erzähldatei.
  5. Zusammenbau. Die Einstellungen werden auf die Erzählung geschnitten, Untertitel eingebrannt und als Hochformat-MP4 mit ffmpeg oder einem skriptbaren Editor exportiert.
  6. Veröffentlichung. Die Datei geht über die Content Posting API zu TikTok und als Short zu YouTube, an beiden Stellen mit gesetzter KI-Offenlegung.

Bei den Stufen 3 und 4 fließt das Geld. In Stufe 1 entscheidet sich die Qualität. In Stufe 6 greifen die Plattformregeln.

Stufe 1: eine Themendatei, die Vielfalt erzwingt

Der Grund, die Warteschlange sorgfältig zu entwerfen, ist eine YouTube-Richtlinie. Am 15. Juli 2025 benannte YouTube „repetitive Inhalte“ in „nicht authentische Inhalte“ um und schloss repetitive oder massenhaft produzierte Videos von der Monetarisierung aus. Dieselbe Seite nennt als Beispiele KI-generierte Inhalte auf Basis generischer Vorlagen „ohne eigene Einsicht des Creators“ sowie ähnliche Videos mit minimaler Variation. Der Maßstab: Der Inhalt jedes Videos soll sich wesentlich unterscheiden. YouTube stellte außerdem klar, dass es sich nicht um ein Verbot von KI-Video handelt, solange die Videos einen eigenen Mehrwert bieten, etwa Kommentar, Schnitt oder Erzählung.

Eine Pipeline, die in einer festen Vorlage nur ein Substantiv austauscht, fällt bei diesem Maßstab konstruktionsbedingt durch. Die Warteschlange sollte deshalb den Inhalt tragen und die Vorlage nur das Format. Eine Zeile, die wir akzeptieren würden, sieht so aus:

  • Thema: warum Flugzeugsitze schmaler wurden
  • Blickwinkel: der auf der Buchungsseite angegebene Sitzabstand blieb gleich, die Beinfreiheit nicht
  • Quelle: ein Link oder eine selbst geschriebene Notiz, die das Skript verwenden muss
  • Format: Erklärvideo, 45 s, Standbilder plus ein bewegter Hook
  • Plattformen: tiktok, shorts

Die Spalten Blickwinkel und Quelle sind es, die zwei Videos derselben Serie inhaltlich unterscheiden. Wenn du sie für eine Zeile nicht füllen kannst, ist die Zeile nicht bereit, und die Pipeline sollte sie überspringen, statt etwas zu erfinden. Einen ausführlicheren Überblick darüber, was die Richtlinie abdeckt, gibt was die YouTube-Regeln zu KI-Inhalten tatsächlich sagen.

Stufen 2 bis 4: Generierung per Code oder per Agent

Es gibt zwei praktische Wege, die Generierung ohne Web-Oberfläche zu steuern. Der erste ist ein einfaches Skript, das in einer Schleife eine HTTP-API aufruft. Der zweite ist ein Agent wie Claude Code oder Cursor, der die Modelle über einen MCP-Server aufruft: Du beschreibst den Batch in einem Prompt, und der Agent übernimmt die Aufrufe.

Aus einem Skript

Das Skript liest die nächste bereite Zeile, holt sich von einem Sprachmodell ein Skript und eine Shotlist und sendet dann pro Einstellung eine Anfrage mit einem Bearer-Key. Jede Antwort kommt mit einer stabilen Referenz auf die Datei zurück. Bei Aitachyon sehen diese Referenzen aus wie img_, scn_ oder vo_ gefolgt von einer ID, und jede lässt sich später mit GET /api/generations/{ref} abrufen. Speicherst du die Referenzen neben der Themenzeile, hast du einen Prüfpfad: welches Modell welche Einstellung erzeugt hat und was sie gekostet hat.

Aus einem Agenten

Mit einem gehosteten MCP-Server bekommt der Agent die Modelle als Werkzeuge. Claude Code lässt sich mit einem Befehl verbinden:

claude mcp add --transport http aitachyon https://aitachyon.com/api/mcp --header "Authorization: Bearer ait_..."

Ein brauchbarer Tages-Prompt liest sich dann wie ein Briefing: „Nimm die nächsten drei bereiten Zeilen aus topics.csv. Schreibe für jede ein 40-Sekunden-Skript, rendere einen 5-sekündigen bewegten Hook und vier Standbilder in 9:16, erzeuge die Erzählung und schreibe Referenzen und Kosten in die Zeile zurück.“ Der Agent übernimmt die Schleife. Du prüfst die Entwürfe. Die Einrichtung samt der Fehlerfälle, auf die wir gestoßen sind, steht in unserer Anleitung zum Erzeugen von Video aus Claude Code über MCP, der Schnellstart auf der Entwicklerseite.

Was ein Video kostet, mit Rechnung

Hier drei Rezepte für ein Hochformat-Video von etwa 30 bis 45 Sekunden, bepreist mit den Aufrufpreisen von Aitachyon zum Zeitpunkt des Schreibens. Zusammenbau und Untertitel laufen angenommen lokal und kostenlos. Die Erzählung wird pro 450 Zeichen abgerechnet; wir nehmen ein Skript an, das zwei Einheiten braucht.

Rezept A: Standbilder und Stimme

  • 6 Bilder mit Seedream 4.0 zu je 0,057 $: 0,342 $
  • Erzählung mit ElevenLabs, 2 Einheiten zum Höchstsatz von 0,086 $: 0,172 $
  • Summe: etwa 0,51 $ pro Video

Rezept B: Standbilder plus zwei bewegte Einstellungen

  • 4 Bilder mit Seedream 4.0: 0,228 $
  • 12 Sekunden Video mit Hailuo 02 zu 0,085 $/s: 1,02 $
  • Erzählung, 2 Einheiten: 0,172 $
  • Summe: etwa 1,42 $ pro Video

Rezept C: alles in Bewegung

  • 20 Sekunden stummes Video mit Kling v3 zu 0,16 $/s: 3,20 $
  • Erzählung, 2 Einheiten: 0,172 $
  • Summe: etwa 3,37 $ pro Video

Batches

Eine Woche täglicher Videos nach Rezept B sind 7 x 1,42 $, etwa 9,94 $. Dreißig Tage nach Rezept A kosten etwa 15,30 $. Zwanzig alternative bewegte Hooks von je 5 Sekunden mit Hailuo 02, um Einstiege an einem starken Video zu testen, sind 100 Sekunden x 0,085 $, also 8,50 $. Dieselbe fertige Datei kann zu TikTok und zu Shorts gehen, die zweite Plattform verursacht also keine zusätzlichen Generierungskosten.

Zwei Korrekturen vor der Budgetplanung. Erstens wirst du einige Ergebnisse verwerfen, weil Bildaufbau oder Bewegung nicht stimmen, und diese kosten trotzdem Geld; plane einen Puffer für Neuversuche ein, der sich an dem orientiert, was du in der ersten Woche tatsächlich siehst. Zweitens wird ein Render, der komplett fehlschlägt, bei Aitachyon automatisch erstattet, technische Fehler gehören also nicht in diesen Puffer. Die vollständige Aufschlüsselung steht in was ein Faceless-Kanal pro Video kostet.

Ein Modell pro Einstellung wählen

Eine tägliche Pipeline braucht nicht ein Modell, sondern eine Regel, welches Modell welche Einstellung bekommt, damit die teuren nur dort laufen, wo sie sich lohnen. Das sind die Abwägungen in der öffentlichen Preistabelle zum Zeitpunkt des Schreibens, mit der Seite jedes Modells in der Modellliste:

  • Hailuo 02 zu 0,085 $/s ist die günstigste Bewegung der Liste. Nutze es für B-Roll und Hooks, bei denen feine Details weniger zählen als Bewegung.
  • Kling v3 kostet 0,16 $/s stumm und 0,32 $/s mit nativem Audio. Zahle für Audio nur bei Einstellungen, in denen synchroner Ton den Moment trägt; erzählgeführte Videos brauchen das selten.
  • Seedance 2.5 beginnt bei 0,20 $/s in 480p und 0,44 $/s in 720p. Die Auflösungsstufe verdoppelt den Preis ungefähr, entscheide also pro Einstellung, ob ein Zuschauer am Smartphone den Unterschied sieht.
  • Veo 3.1 Fast ab 0,19 $/s und Wan 2.7 zu 0,19 $/s liegen im selben Bereich und sollten auf deinen eigenen Prompts gegeneinander getestet werden.
  • Seedream 4.0 zu 0,057 $ pro Bild und FLUX.2 [pro] zu 0,057 bis 0,086 $ sind die Standard-Standbilder. Nano Banana zu 0,13 $ und gpt-image-2 zu 0,10 bis 0,40 $ sind für Einstellungen, bei denen die günstigeren Modelle die Vorgabe verfehlen.

Eine Entscheidungsregel, die sich in der Praxis bewährt: Starte jede Einstellung mit dem günstigsten Modell, das sie plausibel leisten kann, und stufe einen Einstellungstyp erst nach zwei Fehlschlägen auf ein teureres Modell hoch. Für einen direkten Vergleich der beiden meistgefragten Videomodelle siehe Kling v3 gegen Seedance 2.5.

Per API auf TikTok posten: die Limits, die deinen Zeitplan bestimmen

Die Content Posting API von TikTok hat einen Direct-Post-Endpunkt, der auf das Konto eines Creators veröffentlicht. Seine Einschränkungen bestimmen, wie deine Veröffentlichungsstufe aussieht.

Zuerst das Audit

Solange dein API-Client das Audit von TikTok nicht bestanden hat, ist alles, was er postet, auf private Sichtbarkeit beschränkt. Die Richtlinien zum Teilen ergänzen, dass ein nicht auditierter Client höchstens 5 Nutzer haben darf, die innerhalb von 24 Stunden posten, und dass Konten zum Zeitpunkt des Postens privat sein müssen, mit dem Inhalt auf SELF_ONLY. Danach macht der Inhaber das Konto öffentlich und stellt jeden Beitrag von Hand auf Alle um. Plane die ersten Wochen um private Entwürfe herum und beantrage das Audit parallel.

Raten- und Mengenlimits

  • Jedes Nutzer-Zugriffstoken ist auf 6 Anfragen pro Minute begrenzt. Ein täglicher Batch sollte seine Uploads in eine Warteschlange stellen, statt sie alle gleichzeitig abzufeuern.
  • Die von TikTok ausgegebene upload_url ist eine Stunde gültig. Erst rendern und zusammenbauen, dann die Upload-URL anfordern, niemals umgekehrt.
  • Für auditierte Clients liegt das Tageslimit pro Creator typischerweise bei etwa 15 Beiträgen, geteilt über alle API-Clients, die auf dieses Konto posten. Die Obergrenze variiert je nach Creator, lies also den Wert, den die API zurückgibt, statt ihn fest einzucodieren.
  • Akzeptierte Formate sind MP4, QuickTime und WebM, und die Beschreibung darf bis zu 2.200 UTF-16-Runen lang sein.

Was deine App nicht tun darf

Die Richtlinien zum Teilen verlangen, dass Nutzer ausdrücklich zustimmen, bevor Inhalte an TikTok gesendet werden, dass voreingestellte Titel und Hashtags vor dem Posten vom Nutzer bearbeitbar bleiben und dass die App dem Inhalt weder ihren Markennamen noch ihr Logo oder ein Wasserzeichen überlagert. Für deine eigenen Kanäle heißt das: ein Prüfschritt zwischen Render und Post.

KI-Labels auf TikTok und YouTube, im Code gesetzt

TikTok verlangt seit der Aktualisierung seiner Community-Richtlinien im März 2023 die Kennzeichnung realistischer KI-generierter Inhalte und führte am 19. September 2023 das Label „Creator labeled as AI-generated“ für vollständig KI-generierte oder wesentlich KI-bearbeitete Inhalte ein. Inhalte, die das Label tragen sollten und es nicht tun, riskieren die Entfernung. Im Mai 2024 berichtete TikTok, dass über 37 Millionen Creator das Kennzeichnungstool genutzt hatten und dass es begonnen hatte, Inhalte anderer Plattformen automatisch zu kennzeichnen, wenn die Datei C2PA Content Credentials enthält.

Für eine Pipeline steckt das nützliche Detail in der API. Der Direct-Post-Endpunkt nimmt einen booleschen Wert is_aigc entgegen, und wenn er true ist, erhält das Video das Label „Creator labeled as AI-generated“. Setze ihn aus der Pipeline, pro Video, je nachdem, was das Video enthält. Damit entfällt die typische Fehlerquelle: dass jemand jeden Morgen daran denken muss, ein Kästchen anzuhaken.

Das Label ist eine Untergrenze. TikTok gibt an, schädlich irreführende KI-Inhalte unabhängig von der Kennzeichnung zu verbieten, und seine seit dem 13. September 2025 geltenden Richtlinien wiederholen, dass auch gekennzeichnete Inhalte schädlich sein können. Derselbe Bericht nennt, dass über 85 % der Verstöße von automatisierten Systemen erkannt werden.

Die Regel von YouTube ist enger gefasst. Creator müssen offenlegen, wenn realistische Inhalte von Zuschauern mit einer echten Person, einem echten Ort, einer echten Szene oder einem echten Ereignis verwechselt werden könnten. KI für Skripte, Ideen oder Untertitel zu nutzen oder klar unrealistische oder animierte Inhalte zu erstellen, erfordert keine Offenlegung. YouTube kann das Label selbst hinzufügen, zeigt es bei sensiblen Themen wie Gesundheit, Nachrichten, Wahlen und Finanzen auffälliger an und kündigt an, Maßnahmen gegen Creator zu prüfen, die wiederholt nicht offenlegen.

Eine Entscheidungsregel für die Kennzeichnung

  1. Enthält das Video eine realistische Person, einen Ort, eine Szene oder ein Ereignis, die von KI erzeugt oder wesentlich verändert wurden? Setze is_aigc auf TikTok auf true und hake auf YouTube die Offenlegung für veränderte oder synthetische Inhalte an.
  2. Ist es stilisiert, animiert oder erkennbar unwirklich? Das TikTok-Tool deckt auch vollständig KI-generierte Inhalte ab, kennzeichne es dort also. YouTube verlangt es nicht.
  3. Geht es um Gesundheit, Nachrichten, Wahlen oder Finanzen? Kennzeichne überall und füge vor dem Posten eine menschliche Prüfung hinzu.
  4. Im Zweifel kennzeichnen. Ein fehlendes Label riskiert die Entfernung.

Eine tägliche Pipeline aus der Massenproduktions-Schublade halten

Automatisierung macht Volumen billig, und genau dagegen richtet sich die Richtlinie zu nicht authentischen Inhalten. Die Lösung ist, die Produktion zu automatisieren und das Urteil zu behalten. Das ist die Checkliste vor der Veröffentlichung, die wir bei jedem Video abarbeiten würden, durch eine Person oder durch einen zweiten Modelldurchlauf mit menschlicher Stichprobe:

  1. Das Video stellt eine Behauptung auf oder vermittelt etwas, das die fünf vorherigen Videos der Serie nicht behandelt haben.
  2. Das Skript nutzt das Quellenmaterial der Zeile, und jeder Fakt darin lässt sich auf diese Quelle zurückführen.
  3. Der Hook ist für dieses Thema geschrieben. Ein wiederverwendetes Hook-Muster ist in Ordnung; ein wiederverwendeter Hook-Satz ist ein Warnsignal.
  4. Mindestens eine Einstellung wurde speziell für dieses Video gewählt, statt aus einem festen Prompt-Vorrat zu stammen.
  5. Die Erzählung bringt Kommentar oder eine Sichtweise ein, also die Art von Mehrwert, die YouTube genannt hat.
  6. Untertitel werden gegen das Audio geprüft. Automatische Untertitel verrutschen bei Namen und Zahlen.
  7. Das KI-Label ist nach der obigen Regel gesetzt.
  8. Bei Shorts über einer Minute trägt das Audio keine aktiven Content-ID-Ansprüche, da solche Shorts nicht abspielbar, nicht empfohlen und nicht monetarisierbar sind.

Shorts dürfen inzwischen bis zu drei Minuten im quadratischen oder vertikalen Format lang sein, und die meisten Songs der Shorts-Audiomediathek erlauben bis zu 90 Sekunden in einem dreiminütigen Short. Die Generierungskosten wachsen mit der Länge, ein 90-sekündiges Video nach Rezept B kostet also etwa das Dreifache der 30-Sekunden-Version. Lass das Thema die Länge bestimmen.

Fehlerbehandlung und Ausgabenkontrolle

Eine unbeaufsichtigte Pipeline braucht drei Schutzmaßnahmen, und alle drei sind günstig umzusetzen.

  • Idempotente Zeilen. Markiere eine Zeile vor dem ersten Aufruf als „rendert“ und speichere jede Referenz, sobald sie zurückkommt. Ein Absturz setzt dann bei der zuletzt fertigen Einstellung fort, statt das ganze Video erneut zu bezahlen.
  • Ein Key pro Pipeline. Gib jedem automatisierten Job seinen eigenen API-Key. Bei Aitachyon hat jeder Key seine eigenen Ausgaben, einen Alarm bei ungewöhnlich schnellem Verbrauch und Sperrung mit einem Klick, sodass eine Schleife, die endlos wiederholt, als Alarm auf einem Key auftaucht und nicht als geleertes Guthaben.
  • Erstattungen, denen du nicht hinterherlaufen musst. Fehlgeschlagene Renders werden automatisch und auf den Cent genau erstattet, und jeder Job ist mit Modell und Kosten aufgeführt. Wenn du sie mit den Referenzen in deinen Zeilen abgleichst, erhältst du einen Kostenbericht pro Video.

Ratenlimits gehören in dieselbe Schicht: Stelle TikTok-Uploads so in die Warteschlange, dass es unter 6 pro Minute und Token bleibt. Wie du hunderte Clips gleichzeitig erzeugst, ohne die Limits der Anbieter zu reißen, steht in unseren Notizen zur KI-Videogenerierung im großen Stil.

FAQ

Kann ich KI-Videos automatisch auf TikTok posten?

Ja, über den Direct-Post-Endpunkt der Content Posting API. Solange dein Client das Audit von TikTok nicht bestanden hat, sind Beiträge auf private Sichtbarkeit beschränkt, und höchstens 5 Nutzer können innerhalb von 24 Stunden über den Client posten. Nach dem Audit liegt das Limit pro Creator typischerweise bei etwa 15 Beiträgen pro Tag über alle API-Clients hinweg.

Muss ich KI-generierte Videos auf TikTok kennzeichnen?

TikTok verlangt Labels auf realistischen KI-generierten Inhalten und kann nicht gekennzeichnete Inhalte entfernen, die eines tragen sollten. Über die API setzt du is_aigc auf true, was das Label „Creator labeled as AI-generated“ hinzufügt. Dateien mit C2PA Content Credentials können automatisch gekennzeichnet werden.

Lassen sich KI-generierte Shorts auf YouTube monetarisieren?

Ja, solange sie nicht massenhaft produziert werden. Seit dem 15. Juli 2025 behandelt YouTube KI-Inhalte auf Vorlagenbasis mit minimaler Variation als nicht authentisch und nicht monetarisierbar. Jedes Video braucht einen wesentlich unterschiedlichen Inhalt und einen eigenen Mehrwert wie Kommentar oder Erzählung.

Was kostet ein KI-TikTok-Video?

Zu den Aufrufpreisen von Aitachyon zum Zeitpunkt des Schreibens kostet ein Video aus Standbildern und Stimme etwa 0,51 $, eines mit 12 Sekunden Hailuo-02-Bewegung etwa 1,42 $ und ein vollständig animiertes mit 20 Sekunden Kling v3 etwa 3,37 $. Rechne einen Puffer für verworfene Ergebnisse dazu. Zur Stimme im Detail siehe unsere Aufschlüsselung der ElevenLabs-Sprecherkosten.

Quellen

  1. TikTok for Developers: Content Posting API, Direct-Post-Referenz
  2. TikTok for Developers: Content Sharing Guidelines
  3. TikTok for Developers: tägliche Post-Limits bei Direct Post
  4. TikTok Newsroom: Partnering with our industry to advance AI transparency and literacy (Mai 2024)
  5. Social Media Today: TikTok officially launches new in-stream labels for AI-generated content (September 2023)
  6. MediaPost: TikTok takes clearer stance against AI misinformation (August 2025)
  7. YouTube-Hilfe: Richtlinien zur Monetarisierung im YouTube-Partnerprogramm, nicht authentische Inhalte
  8. Gulf News: YouTube updates monetisation rules, inauthentic content ban takes effect July 15 (Juli 2025)
  9. YouTube-Hilfe: Dreiminütige YouTube Shorts verstehen
  10. Google: How we're helping creators disclose altered or synthetic content

Wenn du diese Pipeline ohne fünf Modell-Abos betreiben willst: Aitachyon bündelt die oben genannten Video-, Bild- und Stimmmodelle hinter einem Key, aufrufbar aus einem Skript oder aus Claude Code über MCP, abgerechnet pro Aufruf von einem Guthaben, das nie verfällt, mit jedem Job nach Modell und Kosten aufgeschlüsselt.

Ähnliche Artikel

Kostenlose Tools zum Ausprobieren

Beschreiben Sie Ihre Marke nicht mehr. Fügen Sie Ihre URL ein.

Aitachyon liest Ihre ganze Marke von Ihrer Website und erstellt dann Videos, Bilder, Karussells, Posts und Banner, markengerecht, für jedes Format und jeden Feed.