Der perfekte Moment, angehalten.
Der Bild-Prompt baut die Szene auf ihrem exakten Höhepunkt: fliegende Objekte, gespannte Posen, gestreckte Käsefäden, alles als EIN eingefrorenes Standbild („completely frozen in time“), nicht als Bewegung.
Ein ChatGPT-Bild friert das Chaos auf dem Höhepunkt ein, und Google Flow verwandelt es in einen Bullet-Time-Orbit, bei dem sich nichts bewegt außer der Kamera. Wie in „Matrix“, nur ohne 100 Kameras.
Vier Bausteine, die aus einem einzigen Standbild einen Kameraflug durch eine erstarrte Welt machen.
Der Bild-Prompt baut die Szene auf ihrem exakten Höhepunkt: fliegende Objekte, gespannte Posen, gestreckte Käsefäden, alles als EIN eingefrorenes Standbild („completely frozen in time“), nicht als Bewegung.
Der Video-Prompt sperrt jede Objektbewegung mit dem Kernsatz „The only motion is the camera“ und schickt die Kamera auf einen langsamen 110–120°-Orbit um die erstarrte Szene.
Vordergrund weich, Mitte gestochen scharf, Hintergrund ruhig: Erst die Parallaxe zwischen den drei Tiefen-Ebenen macht den Orbit zum Flug durch eine Skulptur, ohne Staffelung wirkt er flach.
„No blinking, no breathing, no morphing …“: Die lange Verbotsliste am Ende beider Prompts ist kein Deko-Text, sie verhindert, dass das Modell die eingefrorene Szene doch animiert.
Das Bild baut, das Video dreht.
Der Bild-Prompt (ChatGPT) definiert Szene, Physik und Anatomie. Der Video-Prompt (Flow, „Frames to Video“) übernimmt das Bild als exaktes Startframe und regelt ausschließlich die Kamera, er darf nichts umbauen, ersetzen oder hinzufügen.
Chaos braucht Logik.
Alle Flugbahnen müssen von einem Auslöser ausstrahlen: der Sprung der Ratte, die Pizzaschaufel am Regal, der offene Koffer. Ohne gemeinsame Ursache wirkt die Szene wie zufällig verteilte Deko statt wie eingefrorene Physik.
Grad, Richtung, Startpunkt.
Der Video-Prompt legt die Kamerafahrt exakt fest: 110–120° Orbit, gegen den Uhrzeigersinn, Start nahe der Original-Perspektive, Fokusfahrt vom Nebendarsteller zum Gesicht. Vage Kamerawünsche („cinematic camera“) produzieren Zufall.
Gesichter bleiben frei.
Beide Prompts reservieren freie Sichtfenster: Gesicht, Tier und Hauptobjekt dürfen von keiner Mehlwolke und keinem fliegenden Objekt verdeckt werden. So behält der Orbit in jeder Phase ein lesbares Zentrum.
01 · Gastro & Food
Ein Restaurant friert seinen Küchen-Moment ein: schwebende Zutaten, gestreckter Mozzarella, fliegendes Mehl, und die Kamera fliegt hindurch. High-Speed-Food-Look für Social Ads, ohne Phantom-Kamera und Food-Stylist.
02 · Reise & Tourismus
Skydive über der Traumküste, mitten im Sprung eingefroren, der Koffer platzt in der Luft auf, als Reel-Opener für Reiseanbieter und Airlines, ohne Helikopter, Stunt-Team und Versicherungsfall.
03 · Produkt-Marketing
Sneaker, Parfum oder Werkzeugkoffer zerlegen ihre Bestandteile schwebend in die Luft, die Kamera umkreist die eingefrorene Explosion, der klassische Premium-Produktfilm-Look aus einem einzigen Standbild.
04 · Content-Creator
Eingefrorene Zeit plus fliegende Kamera ist ein Pattern-Break im Feed: Das Auge erwartet Bewegung im Motiv, bekommt aber Bewegung um das Motiv. Die ersten zwei Sekunden entscheiden, und Bullet-Time gewinnt sie.
Tills Vorlage in zwei Teilen: Teil 1 erzeugt das eingefrorene Standbild in ChatGPT, Teil 2 lässt in Google Flow nur die Kamera fliegen. Die [PLATZHALTER] mit deiner eigenen Szene füllen.
══ PART 1 · IMAGE PROMPT (ChatGPT) ══ Photorealistic cinematic fashion-editorial photograph capturing [YOUR SCENE, e.g. an enormous pizzeria kitchen disaster / an extraordinary skydiving scene] at its exact peak, completely frozen in time. [MAIN CHARACTERS: exactly one/two …, describe who they are, their airborne or mid-action pose, clothing, safety gear and an exaggerated but believable facial expression. Example: exactly one stylish adult pizza chef, suspended in a dynamic sideways lunge with both feet above the floor, reaching toward a stolen pizza slice.] [THE TRIGGER: one single cause the whole frozen chain reaction radiates from, e.g. a rat stealing a slice, a suitcase bursting open after the jump, a struck shelf.] Fill the frame with a dense but compositionally controlled abundance of suspended elements: [LIST 8–12 FLYING OBJECTS with individual orientations: food, tools, clothing, droplets, a liquid ribbon escaping a bottle, a powder cloud with visible texture]. Every object is frozen at a different orientation and depth. Their trajectories must radiate naturally from the trigger, one connected chain reaction, not an unrelated decorative object cloud. Create three dramatic layers of depth: [1–2 large objects] pass close to the lens in soft focus. [THE MAIN CHARACTERS AND HERO OBJECT] are tack-sharp in the midground. [SHELVES / LANDSCAPE / BACKGROUND OBJECTS] fill the space farther behind. Maintain clear visual openings so all faces and the hero object remain fully visible, no object or cloud may obscure them. The setting is [DESCRIBE LOCATION, COLOURS, MATERIALS, LIGHT SOURCES]. Use [warm/bright] light with crisp highlights, natural skin texture, realistic material and liquid details, rich but believable colour. Vertical 3:4 composition. Dynamic wide framing from a slightly low three-quarter camera angle. All main characters and the majority of the frozen explosion must fit inside the frame, with strong diagonal movement through the composition. Shot on a real high-speed cinema camera, believable imperfections, physically realistic details, premium campaign look, sophisticated visual comedy and crisp cinematic realism. [COUNTING BLOCK: exactly N people/animals, exactly two arms and two hands each, anatomically correct proportions.] No injuries, no blood, no broken glass, no extra limbs, no merged fingers, no distorted faces, no readable text, no logos, no captions, no border and no watermark. ══ PART 2 · VIDEO PROMPT (Google Flow · Frames to Video) ══ Use the source image as the exact visual reference and opening frame. Preserve the identities, faces, anatomy, expressions, clothing, poses and the precise position of every suspended object. Preserve the environment and lighting. Do not redesign, replace, remove or introduce anything. The entire video exists inside one completely stopped millisecond of [YOUR SCENE]. Every character remains perfectly frozen in their exact pose. [NAME EACH CHARACTER AND OBJECT GROUP and state that it does not move: hands, hair, fabric, fur, droplets, powder clouds, liquid ribbons.] Nothing falls, spins, drifts, spreads, pours or breaks further. The only motion is the camera. Perform one slow, smooth, continuous [110/120]-degree counterclockwise bullet-time orbit around [THE CENTRAL ACTION]. Begin near the original source-image viewpoint with a few foreground objects close to the lens, glide through the open spaces between the suspended elements, then curve around the main characters, gradually revealing the full three-dimensional scale of the frozen scene. Create powerful natural parallax between the close foreground objects, the tack-sharp main characters and the distant background. The camera should feel as though it is travelling through a real sculpture made of frozen [food / people / objects]. Maintain primary focus first on [OBJECT A], then transition gently toward [THE MAIN FACE]. Preserve the vertical 3:4 composition. No blinking, no breathing, no facial movement, no hair movement, no fabric movement, no falling objects, no flowing liquid, no dispersing powder, no camera shake, no sudden zoom, no speed ramp, no scene transition, no morphing, no additional people, no duplicated objects, no extra limbs, no face deformation, no flickering, no ghosting, no warping and no lighting changes. Smooth stable bullet-time camera motion, stable anatomy, sharp details and 4K cinematic quality.
Szene & Höhepunkt festlegen
Einen Moment mit maximaler Spannung wählen: eine Aktion, ein Auslöser, viele fliegende Einzelobjekte. Je klarer die Kettenreaktion (wer stößt was an?), desto glaubwürdiger wirkt der Freeze.
Standbild in ChatGPT generieren
Teil 1 des Prompts mit der eigenen Szene füllen und in ChatGPT ausführen (Hochformat 3:4). Ergebnis prüfen: Hände und Gliedmaßen korrekt? Gesicht und Hauptobjekt frei sichtbar? Sonst re-generieren, bevor es weitergeht.
Bild in Google Flow hochladen
In Google Flow „Frames to Video“ wählen und das ChatGPT-Bild als erstes Frame hochladen. Seitenverhältnis 9:16, Modell Veo 3.1 Fast oder Gemini Omni Flash (für 10 Sekunden + Audio).
Video-Prompt einfügen
Teil 2 mit der eigenen Szene füllen: Orbit-Winkel (110–120°) und Richtung festlegen, Fokusfahrt benennen (erst Objekt, dann Gesicht), die Negativ-Liste unverändert lassen, sie ist der Stabilisator.
Generieren, prüfen, nachschärfen
Clip generieren und Bild für Bild prüfen: Bewegt sich etwas doch (Blinzeln, tropfender Käse, flatternder Stoff)? Dann genau dieses Verbot explizit in die Negativ-Liste aufnehmen und neu generieren.
Zwei Prompts, ein eingefrorener Augenblick, zehn Sekunden Bullet-Time, probier den Workflow mit deiner eigenen Szene aus.