OPENAI · 3D-DIORAMA

Deine Stadt wächst aus der Landkarte. In 3D.

Ein ChatGPT-Prompt baut ein hyperreales Miniatur-Diorama deiner Stadt: Wahrzeichen als Centerpiece, exakt auf der Karte platziert. Google Flow verwandelt das Standbild in einen Kino-Drohnenflug. Zwei Prompts, ein premium 3D-Reveal.

ChatGPT (Bild) + Google Flow / Veo (Video) · funktioniert auch mit anderen Image-to-Video-Tools

Was das 3D-Diorama besonders macht.

Vier Mechaniken, die aus einem simplen Prompt ein premium bewegtes 3D-Visual machen.

01 · KARTE ALS BÜHNE

Geografisch korrekt platziert.

Die Basis ist eine echte Landkarte aus der Vogelperspektive. Genau an der realen Position der Stadt wächst das Miniatur-Diorama heraus, Fluss, Parks und Architektur gehen nahtlos in die Kartenoberfläche über.

02 · ALLES AUSTAUSCHBAR

Ein Prompt, jede Stadt.

Alles in eckigen Klammern ist ein Platzhalter. Tausch Stadt, Wahrzeichen und Material aus, der Rest bleibt gleich. Aus dem Elbphilharmonie-Diorama wird in Sekunden Paris, New York oder deine Heimatstadt.

03 · ZWEI-STUFEN-PIPELINE

Bild rein, Kino raus.

Stufe 1: ChatGPT rendert das Diorama als scharfes 1:1-Standbild. Stufe 2: Google Flow nimmt genau diesen Frame und fügt echte 3D-Tiefe, Parallaxe und Kamerabewegung hinzu, ohne dass sich die Szene verändert.

04 · DROHNEN-ORBIT

Sanfter Orbit, kein Ruckeln.

Die Kamera startet leicht erhöht und umkreist das Wahrzeichen im Uhrzeigersinn, mit dezentem Vorwärts-Dolly für Tiefe. Golden-Hour-Licht, Wasser-Ripples, Wind in den Bäumen: Premium-Drohnen-Feeling in 5 Sekunden.

Wie das Diorama wirklich entsteht.

01 · Karte + Position

Reale Geografie als Anker.

Der Prompt zwingt das Modell, zuerst eine korrekte Landkarte der Region zu bauen und das Diorama exakt an der realen Position der Stadt zu setzen. Deshalb wirken Fluss, Küste und Umgebung stimmig statt beliebig.

02 · Platzhalter = Variablen

Eckige Klammern sind der Trick.

[COUNTRY], [CITY], [MONUMENT] und das Material sind austauschbare Slots. Du behandelst den Prompt wie eine Vorlage: Werte tauschen, Struktur behalten. So produzierst du eine ganze Serie im identischen Look.

03 · Frame → Video

Google Flow erbt die Komposition.

Flow (Veo) bekommt das fertige Standbild als Startframe. Der zweite Prompt sagt explizit „no scene change, no morphing", die Details bleiben, es kommt nur echte 3D-Tiefe, Parallaxe und Kamerabewegung dazu.

04 · Der Kino-Look

Licht-Tokens machen den Unterschied.

Beide Prompts sind vollgepackt mit gezielten Stichworten: „soft studio lighting", „macro photography", „golden-hour", „volumetric light rays", „shallow depth of field". Genau diese Begriffe kippen das Ergebnis von KI-Render zu Premium-Foto.

Wer das 3D-Diorama wirklich nutzt.

01 · Tourismus

Städte-Reels, die scrollen stoppen

Destinations-Marketing und Reiseblogger bauen aus jedem Ziel ein 5-Sekunden-3D-Reveal. Eine Serie „10 Städte, ein Look" ist mit dem Vorlagen-Prompt an einem Nachmittag fertig.

02 · Immobilien

Lage-Hero für das Exposé

Makler und Städteentwickler zeigen die Lage als edles Miniatur-Diorama statt als flachen Google-Maps-Screenshot. Der Drohnenflug ums Quartier wirkt sofort hochwertig.

03 · Social Content

Hook-Visual ohne Kamera-Team

Für Reels, Shorts und TikTok ist das aufsteigende Diorama der perfekte 2-Sekunden-Hook. Kein Dreh, kein Drohnen-Führerschein, keine Reise, nur zwei Prompts.

04 · Personal & Geschenke

Die eigene Heimatstadt als Kino

Hochzeit, Umzug, Firmenjubiläum: Die Heimatstadt mit ihrem Wahrzeichen als 3D-Diorama ist ein persönliches Intro für Einladungen, Präsentationen oder ein Geschenk-Video.

Deine zwei Prompts zum Kopieren.

Zuerst der ChatGPT-Prompt für das 3D-Bild, dann der Google-Flow-Prompt für die Animation. Ersetz die Platzhalter in [eckigen Klammern] durch deine Stadt, dein Wahrzeichen und dein Material, der Rest bleibt exakt so.

1ChatGPT · erzeugt das 3D-Bild
chatgpt-diorama.txt
A realistic, highly detailed geographic map viewed from above, accurately representing the region where [COUNTRY NAME] is located. Rising from the map is a miniature 3D diorama of [CITY NAME], precisely positioned at its real geographic location. The diorama features the [MONUMENT NAME] as the main centerpiece, along with surrounding specific landscape details (e.g. river name, architecture style, parks) and city elements seamlessly emerging from the map surface. Ultra-realistic materials, fine textures, [SPECIFIC MATERIAL DETAIL, e.g. marble / steel / stone], and depth of field.

Soft studio lighting with subtle shadows, cinematic composition, premium macro photography style, Square 1:1 format, high detail realistic scale, hyper-detailed photorealistic, 8k quality.
2Google Flow · animiert das Bild zum Video
google-flow-drone.txt
Convert the uploaded frame into an ultra-realistic cinematic 3D drone video. Preserve the original composition and details while adding true 3D depth and parallax. The camera begins slightly elevated and angled, then performs a smooth clockwise orbital rotation around the [MONUMENT NAME, e.g. Eiffel Tower], creating a premium drone-cinema feel. Subtle forward dolly while rotating to enhance scale and depth. [MONUMENT NAME] remains the focal point throughout, with realistic perspective shift on domes, minarets, gardens, and surrounding rivers. Add gentle water ripples, soft wind movement in trees, and natural atmospheric depth. Golden-hour cinematic lighting with realistic shadows, global illumination, volumetric light rays, and mild haze.

Smooth stabilized drone motion, no jitter, no scene change, no morphing. Film-grade color science, high dynamic range, shallow depth of field, ultra-sharp details. Duration 5 seconds, 24fps, epic cinematic reveal.

In 4 Schritten zum Reveal.

01

Platzhalter füllen

Kopier den ChatGPT-Prompt und ersetz [COUNTRY], [CITY], [MONUMENT] und das Material durch deine Wahl. Bekannte Wahrzeichen liefern die stärksten Ergebnisse.

02

Bild in ChatGPT rendern

Prompt in ChatGPT einfügen, Bild generieren lassen. Passt etwas nicht? Kurz nachschärfen („mehr Fokus auf das Wahrzeichen", „Fluss deutlicher"). Dann in voller Auflösung speichern.

03

In Google Flow hochladen

Öffne Google Flow (labs.google/flow), leg das gespeicherte Bild als Startframe hinein und füg den zweiten Prompt ein, das Wahrzeichen im Prompt an deins anpassen.

04

Rendern & exportieren

Flow rendert den 5-Sekunden-Drohnenflug. Ergebnis prüfen, bei Bedarf einen zweiten Take ziehen, dann als MP4 exportieren, fertig für Reel, Website oder Präsentation.

Zwei Prompts, und deine Stadt fliegt.

Kein Motion-Design, kein Drohnen-Team, keine Reise. Nimm die beiden Prompts oben, setz deine Stadt und dein Wahrzeichen ein, in unter 10 Minuten hast du einen Kino-3D-Reveal, den man für eine echte Drohnenaufnahme hält.

Mehr Tipps auf @till.schae

Häufige Fragen.

Welchen ChatGPT-Plan brauche ich für das 3D-Diorama?
Die Bildgenerierung läuft über den in ChatGPT integrierten Image-Generator (GPT Image). Im kostenlosen Plan sind einzelne Bilder pro Tag möglich, für zuverlässige Ergebnisse in 1:1 und hoher Detailtiefe ist ChatGPT Plus (ca. 23 €/Monat) empfehlenswert. Derselbe Prompt funktioniert auch in jedem anderen starken Bildmodell.
Was ist Google Flow und brauche ich es zwingend?
Google Flow ist Googles Video-Tool auf Basis des Veo-Modells (Teil von Google AI Pro/Ultra). Es wandelt ein Standbild in ein bewegtes 3D-Video mit echter Kamera-Parallaxe um. Zwingend ist es nicht: Das ChatGPT-Diorama funktioniert allein als hochwertiges Standbild. Erst für den Kino-Drohnenflug kommt Flow dazu, oder ein vergleichbares Image-to-Video-Tool wie Higgsfield oder Runway.
Kann ich jede Stadt und jedes Wahrzeichen einsetzen?
Ja, genau das ist der Trick. Alle Angaben in eckigen Klammern sind Platzhalter: [COUNTRY NAME], [CITY NAME], [MONUMENT NAME] und das Material. Tausch Hamburg/Elbphilharmonie gegen Paris/Eiffelturm, New York/Freiheitsstatue oder deine Heimatstadt, der Rest des Prompts bleibt gleich. Bekannte Wahrzeichen liefern die überzeugendsten Ergebnisse, weil das Modell die Architektur kennt.
Wie lange dauert der komplette Workflow?
Realistisch 5–10 Minuten: 1–2 Minuten für das ChatGPT-Bild inklusive einer Korrekturrunde, dann Bild herunterladen, in Google Flow hochladen und mit dem zweiten Prompt animieren. Das Video-Rendering dauert je nach Auslastung ein bis wenige Minuten. Kein Motion-Design, kein After Effects.