Jonas Keil
KI-Kompass →
Jonas Keil
KI-Kompass →
← Alle Artikel
Jonas Keil Jonas Keil 4 Min. Lesezeit

Blocking für KI-Videos: Warum eine Blender-Vorlage hilft

Beim Blocking für KI-Videos legst du vorher fest, was in deinem Clip passiert, bevor überhaupt ein Videomodell rechnet. Statt einen Prompt zu schreiben, auf Generieren zu drücken und zu hoffen, baust du dir eine simple 3D-Vorlage in Blender. Die gibt Kamerafahrt, Bewegung und Proportionen vor, und die KI malt das fertige Bild darüber. Klingt nach mehr Aufwand, spart aber Versuche und damit Geld. In diesem Artikel erkläre ich, was hinter der Idee steckt und warum sie so gut funktioniert.

Das Problem mit reinen Prompts

Jeder, der schon mal ein KI-Bild oder KI-Video erstellt hat, kennt das. Du hast eine genaue Vorstellung im Kopf, und das Ergebnis sieht völlig anders aus. Das liegt weniger am Modell als an der Sprache. Eine Kamerafahrt, die um ein Objekt kreist, dann durch einen Wasserfall geht und am Ende auf ein Gesicht zoomt, lässt sich in Worten kaum präzise beschreiben. Das Modell muss raten, und jedes Mal rät es ein bisschen anders.

Also generierst du wieder und wieder. Jeder Versuch kostet Credits und Zeit, und das Ergebnis bleibt Glückssache.

Was Blocking im Film bedeutet

Den Begriff gibt es nicht erst seit KI. Im Film heißt Blocking der Schritt vor dem eigentlichen Dreh, in dem festgelegt wird, was wann passiert, wohin sich die Figuren und Objekte bewegen und wie die Kamera die Szene einfängt. Niemand dreht eine aufwendige Szene, ohne das vorher durchgespielt zu haben.

Genau diesen Schritt holst du dir für KI-Videos zurück. Du bist sozusagen der Regisseur: Du legst die Szene fest, und das Videomodell setzt sie um.

Wie das mit Blender und einem KI-Agenten aussieht

Blender ist eine kostenlose Open-Source-Grafiksoftware, mit der du Dinge modellieren und animieren kannst. Normalerweise braucht man für so ein Programm eine lange Einarbeitung. Hier nicht, denn die Vorlage baut ein KI-Agent für dich. ChatGPT oder Claude bedienen Blender über den sogenannten Blender MCP Server, eine Schnittstelle, über die der Agent direkt in Blender Objekte anlegen, Kameras setzen und Animationen erstellen kann. Was ein Agent grundsätzlich ist, steht in Was ist ein KI-Agent?.

Der Ablauf sieht dann so aus: Du beschreibst dem Agenten die Szene. Er baut sie in Blender, du schaust sie dir an und lässt nachbessern, bis Kamera und Bewegung stimmen. Dann exportiert er die Animation als MP4. Dieses Video lädst du zusammen mit Referenzbildern deiner Figuren in ein Videomodell wie Seedance 2.5, und das erstellt daraus den fertigen Clip. Die einzelnen Klicks dafür findest du in der Anleitung zu Seedance 2.5 mit Blender.

Die Arbeitsteilung: wer macht was?

Der wichtigste Punkt beim Blocking ist eine klare Aufgabenteilung, und die habe ich selbst erst nach ein paar Fehlversuchen verstanden.

Arbeitsteilung: Blender legt Kamerafahrt, Bewegung, Proportionen und Umgebung fest, das Videomodell liefert Aussehen, Textur, natürliche Bewegung und StilBlender-Vorlage legt festKamerafahrt und SchnitteBewegungsbahn der ObjekteProportionenUmgebung (optional)Videomodell liefertAussehen der FigurenTexturen und Lichtnatürliche Bewegung im DetailStil (realistisch, Lego, Comic)

In Blender steuerst du Kamerafahrt, Bewegungen und Proportionen. Die Form der Objekte gibst du dort nicht vor. Die kommt aus deinen Referenzbildern.

Bei meinem Drachen-Clip habe ich das auf die harte Tour gelernt. Im ersten Versuch hatte ChatGPT einen detaillierten Drachen in Blender modelliert. Die Kamerafahrt wurde im Video perfekt übernommen, aber der Drache bewegte sich steif und sah kaum noch aus wie mein Referenzdrache. Das Modell hatte versucht, den Blender-Drachen eins zu eins darzustellen, samt seiner hölzernen Animation. Erst als ich den Drachen durch eine einfache Box ersetzt hatte, wurde es gut: gleiche Flugbahn, aber natürliche Flügelschläge.

Klingt erst mal paradox. Warum dann überhaupt Blender, wenn der Drache nur eine Box ist? Weil die Box genau das transportiert, was ein Prompt nicht kann: wo das Ding startet, wie schnell es fliegt, wann es durch den Wasserfall bricht und wo die Kamera dabei steht. Alles andere kann das Videomodell sowieso besser.

Wann sich mehr Detail in der Vorlage lohnt

Ganz so streng ist die Box-Regel nicht. Bei einer Autofahrt habe ich das Auto bewusst modellieren lassen, weil einzelne Shots sehr speziell waren, zum Beispiel ein Zoom auf das Rad. Mit einem Block wäre das nicht darstellbar gewesen.

Und bei der Umgebung lohnt sich Detail fast immer. Für dieselbe Autofahrt hat ChatGPT eine ganze Landschaft in Blender gebaut, mit Straße, Laternen, Geländer, Bergen und einer Stadt. Der Vorteil: Das Modell muss nicht mehr raten, was im Hintergrund passiert, und die Ergebnisse werden deutlich konsistenter.

Was du davon hast

Der erste Vorteil ist Kontrolle. Das Video tut, was du dir vorgestellt hast, statt was das Modell sich ausdenkt. Bei mir sind sowohl die Drachen-Szene als auch die 30-sekündige Autofahrt genau den vorbereiteten Bewegungen gefolgt.

Der zweite Vorteil fällt erst später auf: Eine Vorlage lässt sich mehrfach verwenden. Aus derselben Blender-Animation habe ich drei Versionen der Autofahrt erstellt, darunter eine im Lego-Stil und eine als Comic. Die Bewegung bleibt gleich, nur der Look wechselt.

Und drittens sparst du dir viele Fehlversuche, weil du Probleme schon in Blender siehst und behebst, bevor du teure Videogenerierungen startest.

Für wen das etwas ist

Wenn du nur ab und zu einen kurzen Clip für Social Media brauchst, reicht oft ein guter Prompt. Sobald du aber eine konkrete Szene mit einer bestimmten Kamerafahrt umsetzen willst, oder mehrere Varianten desselben Clips brauchst, ist Blocking der deutlich verlässlichere Weg. Programmierkenntnisse oder Blender-Erfahrung brauchst du dafür nicht, das übernimmt der Agent. Praktische Lehren aus meinen Versuchen habe ich in den Seedance 2.5 Tipps zusammengefasst.

Jonas Keil
Jonas Keil Ich zeige dir, wie du KI wirklich für dich nutzt. Jede Woche neu auf YouTube, Schritt für Schritt lernst du alle Essentials im KI-Kompass.