GOOGLE · FLOW

Die Zeit steht still. Nur die Kamera fliegt.

Ein ChatGPT-Bild friert das Chaos auf dem Höhepunkt ein, und Google Flow verwandelt es in einen Bullet-Time-Orbit, bei dem sich nichts bewegt außer der Kamera. Wie in „Matrix“, nur ohne 100 Kameras.

Free (eingeschränkt) · Google AI Plus (4,99 €/Monat) · Google AI Pro (21,99 €/Monat) · Google AI Ultra (ab 99,99 €/Monat)

Was Bullet-Time besonders macht.

Vier Bausteine, die aus einem einzigen Standbild einen Kameraflug durch eine erstarrte Welt machen.

01 · EINGEFRORENE MILLISEKUNDE

Der perfekte Moment, angehalten.

Der Bild-Prompt baut die Szene auf ihrem exakten Höhepunkt: fliegende Objekte, gespannte Posen, gestreckte Käsefäden, alles als EIN eingefrorenes Standbild („completely frozen in time“), nicht als Bewegung.

02 · NUR DIE KAMERA

Nichts bewegt sich, außer der Kamera.

Der Video-Prompt sperrt jede Objektbewegung mit dem Kernsatz „The only motion is the camera“ und schickt die Kamera auf einen langsamen 110–120°-Orbit um die erstarrte Szene.

03 · DREI SCHÄRFE-EBENEN

Drei Ebenen erzeugen die 3D-Wirkung.

Vordergrund weich, Mitte gestochen scharf, Hintergrund ruhig: Erst die Parallaxe zwischen den drei Tiefen-Ebenen macht den Orbit zum Flug durch eine Skulptur, ohne Staffelung wirkt er flach.

04 · NEGATIV-LISTE

Die Negativ-Liste hält alles stabil.

„No blinking, no breathing, no morphing …“: Die lange Verbotsliste am Ende beider Prompts ist kein Deko-Text, sie verhindert, dass das Modell die eingefrorene Szene doch animiert.

Wie Bullet-Time wirklich arbeitet.

01 · Zwei Prompts, zwei Jobs

Das Bild baut, das Video dreht.

Der Bild-Prompt (ChatGPT) definiert Szene, Physik und Anatomie. Der Video-Prompt (Flow, „Frames to Video“) übernimmt das Bild als exaktes Startframe und regelt ausschließlich die Kamera, er darf nichts umbauen, ersetzen oder hinzufügen.

02 · Kettenreaktion mit einer Ursache

Chaos braucht Logik.

Alle Flugbahnen müssen von einem Auslöser ausstrahlen: der Sprung der Ratte, die Pizzaschaufel am Regal, der offene Koffer. Ohne gemeinsame Ursache wirkt die Szene wie zufällig verteilte Deko statt wie eingefrorene Physik.

03 · Orbit-Regie in Zahlen

Grad, Richtung, Startpunkt.

Der Video-Prompt legt die Kamerafahrt exakt fest: 110–120° Orbit, gegen den Uhrzeigersinn, Start nahe der Original-Perspektive, Fokusfahrt vom Nebendarsteller zum Gesicht. Vage Kamerawünsche („cinematic camera“) produzieren Zufall.

04 · Sichtachsen schützen

Gesichter bleiben frei.

Beide Prompts reservieren freie Sichtfenster: Gesicht, Tier und Hauptobjekt dürfen von keiner Mehlwolke und keinem fliegenden Objekt verdeckt werden. So behält der Orbit in jeder Phase ein lesbares Zentrum.

Wer Bullet-Time wirklich nutzt.

01 · Gastro & Food

Food-Kampagne mit Wow-Moment

Ein Restaurant friert seinen Küchen-Moment ein: schwebende Zutaten, gestreckter Mozzarella, fliegendes Mehl, und die Kamera fliegt hindurch. High-Speed-Food-Look für Social Ads, ohne Phantom-Kamera und Food-Stylist.

02 · Reise & Tourismus

Action-Content ohne Risiko

Skydive über der Traumküste, mitten im Sprung eingefroren, der Koffer platzt in der Luft auf, als Reel-Opener für Reiseanbieter und Airlines, ohne Helikopter, Stunt-Team und Versicherungsfall.

03 · Produkt-Marketing

Exploded-Product-Shot

Sneaker, Parfum oder Werkzeugkoffer zerlegen ihre Bestandteile schwebend in die Luft, die Kamera umkreist die eingefrorene Explosion, der klassische Premium-Produktfilm-Look aus einem einzigen Standbild.

04 · Content-Creator

Der Scroll-Stopper

Eingefrorene Zeit plus fliegende Kamera ist ein Pattern-Break im Feed: Das Auge erwartet Bewegung im Motiv, bekommt aber Bewegung um das Motiv. Die ersten zwei Sekunden entscheiden, und Bullet-Time gewinnt sie.

Dein Bullet-Time-Prompt-Paar zum Kopieren.

Tills Vorlage in zwei Teilen: Teil 1 erzeugt das eingefrorene Standbild in ChatGPT, Teil 2 lässt in Google Flow nur die Kamera fliegen. Die [PLATZHALTER] mit deiner eigenen Szene füllen.

bullet-time-prompts.txt
══ PART 1 · IMAGE PROMPT (ChatGPT) ══

Photorealistic cinematic fashion-editorial photograph capturing [YOUR SCENE, e.g. an enormous pizzeria kitchen disaster / an extraordinary skydiving scene] at its exact peak, completely frozen in time.

[MAIN CHARACTERS: exactly one/two …, describe who they are, their airborne or mid-action pose, clothing, safety gear and an exaggerated but believable facial expression. Example: exactly one stylish adult pizza chef, suspended in a dynamic sideways lunge with both feet above the floor, reaching toward a stolen pizza slice.]

[THE TRIGGER: one single cause the whole frozen chain reaction radiates from, e.g. a rat stealing a slice, a suitcase bursting open after the jump, a struck shelf.]

Fill the frame with a dense but compositionally controlled abundance of suspended elements: [LIST 8–12 FLYING OBJECTS with individual orientations: food, tools, clothing, droplets, a liquid ribbon escaping a bottle, a powder cloud with visible texture]. Every object is frozen at a different orientation and depth. Their trajectories must radiate naturally from the trigger, one connected chain reaction, not an unrelated decorative object cloud.

Create three dramatic layers of depth: [1–2 large objects] pass close to the lens in soft focus. [THE MAIN CHARACTERS AND HERO OBJECT] are tack-sharp in the midground. [SHELVES / LANDSCAPE / BACKGROUND OBJECTS] fill the space farther behind. Maintain clear visual openings so all faces and the hero object remain fully visible, no object or cloud may obscure them.

The setting is [DESCRIBE LOCATION, COLOURS, MATERIALS, LIGHT SOURCES]. Use [warm/bright] light with crisp highlights, natural skin texture, realistic material and liquid details, rich but believable colour.

Vertical 3:4 composition. Dynamic wide framing from a slightly low three-quarter camera angle. All main characters and the majority of the frozen explosion must fit inside the frame, with strong diagonal movement through the composition.

Shot on a real high-speed cinema camera, believable imperfections, physically realistic details, premium campaign look, sophisticated visual comedy and crisp cinematic realism.

[COUNTING BLOCK: exactly N people/animals, exactly two arms and two hands each, anatomically correct proportions.] No injuries, no blood, no broken glass, no extra limbs, no merged fingers, no distorted faces, no readable text, no logos, no captions, no border and no watermark.


══ PART 2 · VIDEO PROMPT (Google Flow · Frames to Video) ══

Use the source image as the exact visual reference and opening frame. Preserve the identities, faces, anatomy, expressions, clothing, poses and the precise position of every suspended object. Preserve the environment and lighting. Do not redesign, replace, remove or introduce anything.

The entire video exists inside one completely stopped millisecond of [YOUR SCENE].

Every character remains perfectly frozen in their exact pose. [NAME EACH CHARACTER AND OBJECT GROUP and state that it does not move: hands, hair, fabric, fur, droplets, powder clouds, liquid ribbons.] Nothing falls, spins, drifts, spreads, pours or breaks further.

The only motion is the camera.

Perform one slow, smooth, continuous [110/120]-degree counterclockwise bullet-time orbit around [THE CENTRAL ACTION]. Begin near the original source-image viewpoint with a few foreground objects close to the lens, glide through the open spaces between the suspended elements, then curve around the main characters, gradually revealing the full three-dimensional scale of the frozen scene.

Create powerful natural parallax between the close foreground objects, the tack-sharp main characters and the distant background. The camera should feel as though it is travelling through a real sculpture made of frozen [food / people / objects]. Maintain primary focus first on [OBJECT A], then transition gently toward [THE MAIN FACE]. Preserve the vertical 3:4 composition.

No blinking, no breathing, no facial movement, no hair movement, no fabric movement, no falling objects, no flowing liquid, no dispersing powder, no camera shake, no sudden zoom, no speed ramp, no scene transition, no morphing, no additional people, no duplicated objects, no extra limbs, no face deformation, no flickering, no ghosting, no warping and no lighting changes. Smooth stable bullet-time camera motion, stable anatomy, sharp details and 4K cinematic quality.
Wichtig: Erst Teil 1 in ChatGPT ausführen und das Standbild prüfen (Hände, Gesichter, freie Sichtachsen), dann das fertige Bild in Google Flow unter „Frames to Video“ als erstes Frame hochladen und NUR Teil 2 als Video-Prompt einfügen. Beide Teile gleichzeitig in ein Tool zu geben funktioniert nicht.

In 5 Schritten startklar.

01

Szene & Höhepunkt festlegen

Einen Moment mit maximaler Spannung wählen: eine Aktion, ein Auslöser, viele fliegende Einzelobjekte. Je klarer die Kettenreaktion (wer stößt was an?), desto glaubwürdiger wirkt der Freeze.

02

Standbild in ChatGPT generieren

Teil 1 des Prompts mit der eigenen Szene füllen und in ChatGPT ausführen (Hochformat 3:4). Ergebnis prüfen: Hände und Gliedmaßen korrekt? Gesicht und Hauptobjekt frei sichtbar? Sonst re-generieren, bevor es weitergeht.

03

Bild in Google Flow hochladen

In Google Flow „Frames to Video“ wählen und das ChatGPT-Bild als erstes Frame hochladen. Seitenverhältnis 9:16, Modell Veo 3.1 Fast oder Gemini Omni Flash (für 10 Sekunden + Audio).

04

Video-Prompt einfügen

Teil 2 mit der eigenen Szene füllen: Orbit-Winkel (110–120°) und Richtung festlegen, Fokusfahrt benennen (erst Objekt, dann Gesicht), die Negativ-Liste unverändert lassen, sie ist der Stabilisator.

05

Generieren, prüfen, nachschärfen

Clip generieren und Bild für Bild prüfen: Bewegt sich etwas doch (Blinzeln, tropfender Käse, flatternder Stoff)? Dann genau dieses Verbot explizit in die Negativ-Liste aufnehmen und neu generieren.

Frier deinen Moment ein, und lass die Kamera fliegen.

Zwei Prompts, ein eingefrorener Augenblick, zehn Sekunden Bullet-Time, probier den Workflow mit deiner eigenen Szene aus.

Mehr Tipps auf @till.schae

Häufige Fragen.

Woher kommt der Name „Bullet Time“, und warum brauche ich dafür keine 100 Kameras?
Der Begriff stammt aus „Matrix“ (1999): Dort standen über 100 Kameras im Kreis um die Szene und wurden nacheinander ausgelöst, so entstand der Eindruck, die Zeit stehe still, während die Kamera weiterfliegt. Im KI-Workflow ersetzt ein einziges eingefrorenes Standbild plus eine virtuelle Kamerafahrt aus Google Flow das komplette Kamera-Rig.
Warum brauche ich zwei getrennte Prompts, einen fürs Bild und einen fürs Video?
Weil beide völlig unterschiedliche Jobs haben. Der Bild-Prompt baut die eingefrorene Szene: Physik der Kettenreaktion, Anatomie, drei Tiefen-Ebenen, freie Sichtachsen. Der Video-Prompt übernimmt dieses Bild als exaktes Startframe und regelt ausschließlich die Kamera. Ein einzelner Video-Prompt ohne Referenzbild liefert selten eine stabil eingefrorene Szene, das Modell fängt fast immer an, die Objekte zu animieren.
Wie verhindere ich, dass sich Figuren im Video doch bewegen?
Mit drei Hebeln im Video-Prompt: Erstens die Rahmensetzung („The entire video exists inside one completely stopped millisecond“), zweitens der Kernsatz „The only motion is the camera“, drittens eine ausführliche Negativ-Liste am Ende (no blinking, no breathing, no fabric movement, no morphing …). Die scheinbare Redundanz ist Absicht, jede weggelassene Verbotszeile ist eine Einladung ans Modell, genau dort doch Bewegung zu erzeugen.
Welches Flow-Modell, welche Länge und welche Auflösung?
Mit Veo 3.1 Fast oder Gemini Omni Flash entstehen bis zu 10-Sekunden-Clips in 9:16 (Standard-Preview 720×1280, Upscale auf 1080p/4K je nach Modell möglich), inklusive nativ generiertem Audio. Veo 3.1 Lite/Quality sind auf 8 Sekunden begrenzt. Für einen vollen 110–120°-Orbit lohnt sich die 10-Sekunden-Variante.
Was kostet der Workflow, und geht das auch kostenlos?
Google AI Pro (21,99 €/Monat, 1.000 Flow-Credits) reicht für regelmäßige Generierungen mit Modellzugang zu Veo 3.1. Google AI Ultra (ab 99,99 €/Monat, 10.000 Credits, höhere Stufe 219,99 €/Monat mit 25.000 Credits) entfernt zusätzlich das sichtbare „Veo“-Logo. Der kostenlose Zugang funktioniert im Ansatz, liefert aber niedrigere Qualität und ein sichtbares Wasserzeichen. Das Standbild aus ChatGPT ist bereits im kostenlosen ChatGPT-Zugang möglich.
Funktioniert Bullet-Time mit jedem Motiv?
Am besten funktionieren Szenen mit einem klaren Höhepunkt und vielen schwebenden Einzelobjekten: eine Küchen-Kettenreaktion, ein Sprung, eine Produkt-Explosion. Reine Landschaften oder statische Porträts profitieren kaum, der Effekt lebt von der Parallaxe zwischen Vordergrund, scharfer Mitte und Hintergrund. Ohne Tiefenstaffelung wirkt der Orbit flach.