GOOGLE · FLOW MINIATUR-SHOWROOM

Dein Laden fährt aus dem Boden. Auf der echten Karte.

ChatGPT rendert deinen Store als fotorealistisches Miniatur-Modell. Google Flow lässt ihn an deiner echten Adresse aus dem Asphalt fahren: Transformer-Mechanik, Drohnenkamera, 9:16.

ChatGPT Plus (ca. 23 €/Monat) für das Modell · Google AI Pro (ca. 21,99 €/Monat) für Flow

Fotorealistisches Miniatur-Modell eines Fast-Food-Restaurants mit Glasfassade, beleuchtetem Innenraum und leuchtendem Dach-Logo
ChatGPT · Modell
Google Flow · Reveal
Fotorealistisches Miniatur-Modell eines Autohaus-Showrooms mit Glasfront, Fahrzeugen im Innenraum und beleuchtetem Schriftzug
ChatGPT · Modell

Echte Outputs aus dieser Anleitung, kein Mockup, kein Rendering von Hand.

Was diesen Miniatur-Reveal besonders macht.

Vier Mechaniken, die aus zwei Standard-Tools ein Reel machen, bei dem Leute stehenbleiben.

01 · ZWEI-TOOL-KETTE

Jedes Tool macht nur das, was es kann.

ChatGPT ist stark im Standbild: scharfe Logos, saubere Typo, korrekte Materialien. Flow ist stark in Bewegung. Wer beides von einem Tool verlangt, bekommt verschmierte Schriftzüge, die Kette liefert beides sauber.

02 · KARTE ALS BÜHNE

Deine echte Adresse, nicht Stock-Kulisse.

Der Google-Earth-Screenshot ist die visuelle Referenz. Straßen, Nachbargebäude, Bäume und Lichtstimmung bleiben erhalten, nur am Pin passiert etwas. Genau das macht den Clip glaubwürdig statt generisch.

03 · TRANSFORMER-AUFBAU

Reihenfolge schlägt Spektakel.

Der Prompt schreibt die Bauabfolge fest vor: erst Vibration, dann Spalten, Grundgerüst, Glaswände, Innenraum, Dach, Logo. Ohne diese Kette erfindet das Modell schwebende Teile, mit ihr wirkt jede Bewegung mechanisch begründet.

04 · 9:16 VON ANFANG AN

Kein nachträgliches Beschneiden.

Format, Länge und Framerate stehen im Prompt. Das Gebäude landet mittig im Hochformat, nichts Wichtiges liegt am Rand, der Clip geht ohne Crop direkt in Reels, Shorts und TikTok.

Wie die Kette wirklich arbeitet.

01 · Referenz schlägt Beschreibung

Zwei Bilder rein, ein Video raus.

Flow bekommt den Karten-Screenshot als Umgebung und das ChatGPT-Modell als Objekt. Beides als Bild, nicht als Text. Alles, was du hochlädst, muss das Modell nicht mehr erraten, und genau das Erratene geht sonst schief.

02 · Kamera als eigener Block

Start, Fahrt, Endbild, alles festgeschrieben.

Der Prompt hat einen eigenen KAMERA-Abschnitt: Startperspektive = Screenshot, dann langsame Annäherung, leichter Orbit während des Aufbaus, Ende in erhöhter Drohnensicht. Ohne diesen Block schneidet Flow mitten in der Animation.

03 · Negative Prompt als Bremse

Die Fehler stehen im Prompt, und zwar vorher.

Hand im Bild, Smartphone-Rahmen, schwebendes Gebäude, schmelzende Formen, Cartoon-Look: Das sind die immer gleichen Ausrutscher. Wer sie vorher ausschließt, spart sich drei Generierungen und die dazugehörigen Credits.

04 · Der Pin muss weg

Das Ende entscheidet über den Effekt.

Am Schluss verschwindet der Karten-Pin und der Boden schließt sich um das Gebäude. Ohne diese zwei Sätze bleibt ein Screenshot mit Animation drauf. Mit ihnen sieht es aus, als stünde der Laden wirklich dort.

Vier Fälle, in denen dieser Clip wirklich etwas bringt.

01 · Lokales Geschäft

Neueröffnung ankündigen

Der neue Standort fährt an genau der Adresse aus dem Boden, an der er nächsten Monat eröffnet. Ortsmarke, Straßenzug und Nachbarschaft sind echt, die Leute erkennen ihre eigene Ecke wieder.

02 · Makler & Bauträger

Bauprojekt vor dem ersten Spatenstich

Statt einer Visualisierung auf weißem Grund entsteht das Gebäude in seiner realen Umgebung. Als Teaser für Investoren, Anwohner-Info oder den Social-Kanal deutlich anschaulicher als ein Renderbild.

03 · Agentur & Freelancer

Pitch, den keiner wegklickt

Beim Neukunden-Pitch den Laden des Kunden an seiner eigenen Adresse aufbauen lassen. Zwei Prompts Aufwand, aber der Effekt im Termin ist ein anderer als der einer Folie mit Bulletpoints.

04 · Franchise & Filialen

Eine Serie statt eines Einzelclips

Das Miniatur-Modell bleibt gleich, nur der Karten-Screenshot wechselt. So entsteht aus einem gebauten Modell eine ganze Reihe standortbezogener Clips, pro Filiale einer, im selben Look.

Deine zwei Prompts zum Kopieren.

Prompt 1 läuft in ChatGPT und erzeugt das Miniatur-Modell. Prompt 2 läuft in Google Flow, zusammen mit dem Karten-Screenshot und dem Bild aus Prompt 1. Nur die eckigen Klammern austauschen, der Rest bleibt wie er ist.

miniatur-showroom.txt
════════════════════════════════════════
PROMPT 1: ChatGPT (Bildgenerierung)
Erzeugt das Miniatur-Modell. Ergebnis als PNG speichern.
════════════════════════════════════════

An ultra-realistic miniature [MARKENNAME] showroom balanced on a human palm, designed with transparent glass walls. Inside, tiny lifelike figures are enjoying [PRODUKTE]. On the rooftop, a glowing 3D logo shines brightly, while the front facade displays the brand name in a bold, recognizable typeface. Outside the showroom, a miniature delivery person is standing with a branded delivery bag strapped to their back, ready to deliver orders. The showroom's interior is styled like a cozy retail outlet, with miniature products and branding details on display. Lighting is cinematic with warm tones, crisp details, and natural shadows. Captured in professional product photography style, the scene conveys a vibrant, iconic, and instantly recognizable atmosphere. 1080x1080 dimension.


════════════════════════════════════════
PROMPT 2: Google Flow (Video)
Vorher hochladen: 1. Google-Earth-Screenshot  2. Bild aus Prompt 1
════════════════════════════════════════

Verwende den hochgeladenen Screenshot der Google-Earth-Karte als exakte visuelle Referenz. Erhalte die Landschaft, Straßen, Gebäude, Vegetation, Perspektive, Beleuchtung und den markierten Standort möglichst originalgetreu.

Am Standort des sichtbaren Pins beginnt sich der Boden leicht zu öffnen. Genau dort fährt das zuvor gezeigte miniature [MARKENNAME]-Gebäude aus dem Boden heraus. Das Gebäude soll ohne menschliche Hand, ohne Sockel und ohne sichtbaren Bildschirm direkt in die reale Umgebung der Karte integriert sein.

Das Gebäude baut sich während des Herausfahrens spektakulär im Stil einer hochwertigen Transformer-Animation zusammen. Einzelne Bauteile, Glasfassaden, Wände, Dachsegmente, Fensterrahmen, Inneneinrichtung, Leuchtschilder und das [MARKENNAME]-Logo entfalten sich mechanisch, drehen sich, gleiten ineinander und verriegeln sich präzise. Jedes Bauteil soll einer logisch nachvollziehbaren Bewegung folgen. Keine Teile dürfen unkontrolliert schweben oder sich überschneiden.

Die Animation beginnt mit einem kurzen Vibrieren des Bodens am Pin. Anschließend öffnen sich schmale mechanische Spalten. Metallische Strukturen fahren nach oben und bilden das Grundgerüst. Danach klappen die Glaswände aus, die Innenräume setzen sich zusammen, Tische, Theke und Beleuchtung erscheinen. Zum Schluss entfaltet sich das Dach und das große [MARKENNAME]-Logo fährt heraus und beginnt hell zu leuchten.

Nachdem das Gebäude vollständig aufgebaut ist, verschwindet der Karten-Pin. Der Boden schließt sich sauber um das Gebäude, sodass es aussieht, als würde das fertige [MARKENNAME]-Gebäude tatsächlich an diesem Standort stehen.

KAMERA:

Beginne mit exakt der Perspektive des Google-Earth-Screenshots. Führe anschließend eine langsame, kontrollierte Kamerafahrt auf den Pin aus. Während des Aufbaus bewegt sich die Kamera leicht orbital um das Gebäude und senkt sich etwas ab, um die mechanischen Details sichtbar zu machen. Am Ende hält die Kamera in einer hochwertigen, leicht erhöhten Drohnenperspektive auf das vollständig aufgebaute Gebäude.

STIL UND QUALITÄT:

Ultra-realistisch, filmreif und physikalisch glaubwürdig. Hochwertige Transformer-Mechanik, präzise bewegliche Bauteile, realistische Materialien, Glasreflexionen, Metalloberflächen, Lichtemissionen, Staubpartikel, dezente Bodenvibrationen und natürliche Schatten. Das Gebäude muss perspektivisch korrekt und glaubwürdig in die reale Umgebung integriert sein.

Die ursprüngliche Karte darf sich außerhalb des markierten Bereichs nicht verändern. Keine neuen Straßen, Gebäude oder Landschaftselemente hinzufügen. Das fertige Gebäude muss exakt am Pin positioniert sein.

FORMAT:

Cinematic video, 4K, 9:16, 8–12 Sekunden, flüssige Bewegungen, 24 oder 30 FPS, hochwertige Motion-Design-Qualität.

NEGATIVE PROMPT:

Keine Hand, kein Smartphone, kein Bildschirmrahmen, kein schwebendes Gebäude, keine deformierten Bauteile, keine schmelzenden Formen, keine unlogischen Bewegungen, keine zusätzlichen Logos, keine falsche Beschriftung, keine Menschen im Vordergrund, keine Kamerasprünge, keine Schnitte, keine Änderung der ursprünglichen Umgebung, kein Cartoon-Stil, keine Spielzeugoptik, keine unrealistischen Größenverhältnisse.

In 4 Schritten startklar.

01

Modell in ChatGPT bauen

Prompt 1 einsetzen, Markennamen und Produkte eintragen. Prüf das Ergebnis auf lesbaren Schriftzug und sauberes Logo, beides muss stimmen, bevor du weitergehst.

02

Standort in Google Earth suchen

Adresse eingeben, in die 3D-Ansicht wechseln und so kippen, dass man Umgebung und Pin sieht. Schrägansicht von oben funktioniert am besten, reine Draufsicht gibt Flow zu wenig Tiefe.

03

Screenshot sauber zuschneiden

Statusleiste, Suchfeld und Bedien-Buttons wegschneiden. Alles, was nach App-UI aussieht, baut Flow sonst mit ins Video ein, der häufigste vermeidbare Fehler.

04

Beides in Flow hochladen

Auf labs.google/flow ein neues Projekt anlegen, Karten-Screenshot und Modell-Bild als Referenzen hinzufügen, Prompt 2 einsetzen und generieren. Rechne mit drei bis fünf Versuchen.

Schritt 02: Adresse suchen, in 3D kippen, bis Umgebung und Pin zusammen im Bild sind.
Zugeschnittener Google-Earth-Screenshot in 3D-Schrägansicht mit einem roten Standort-Pin auf einem Gebäude, ohne App-Bedienelemente
Schritt 03: So sieht die fertige Referenz aus: Pin sichtbar, App-Bedienelemente weg.

Zwei Prompts, ein Abend, und dein Standort fährt aus dem Boden.

Du brauchst kein 3D-Programm und keinen Motion-Designer. Ein Bild aus ChatGPT, ein Screenshot aus Google Earth, ein Prompt in Flow, und du hast einen Clip, den in deiner Stadt sonst niemand hat.

Häufige Fragen.

Warum zwei Tools, kann Flow das Bild nicht selbst erzeugen?
Kann es, aber schlechter. Ein Video-Modell muss Bewegung, Perspektive und Markendetails gleichzeitig erfinden, dabei verrutschen Logos und Schriftzüge fast immer. Wenn ChatGPT das Miniatur-Modell vorher als scharfes Standbild liefert, hat Flow eine feste visuelle Vorlage und muss nur noch die Bewegung dazuerfinden. Genau diese Arbeitsteilung macht den Unterschied zwischen brauchbar und Wegwerf-Clip.
Welchen Google-Plan brauche ich für Flow?
Flow läuft unter labs.google/flow und ist an Google AI Pro beziehungsweise AI Ultra gekoppelt. Der Pro-Plan (ca. 21,99 €/Monat) enthält ein monatliches Kontingent an Video-Generierungen, Ultra deutlich mehr plus die höheren Qualitätsstufen. Jeder Versuch kostet Credits, deshalb lohnt es sich, das Standbild vorher in ChatGPT sauber zu haben.
Wie viele Versuche brauche ich realistisch?
Plane drei bis fünf Generierungen ein. Typische Fehlläufe: Das Gebäude schwebt, statt aus dem Boden zu fahren, die Kamera springt, oder die Umgebung außerhalb des Pins verändert sich mit. Der Negative Prompt fängt die meisten davon ab. Wenn zwei Läufe hintereinander denselben Fehler zeigen, liegt es fast immer am Referenzbild, nicht am Prompt.
Darf ich damit fremde Marken animieren?
Für eigene Marken und Kunden mit Freigabe: ja. Fremde Logos, Schriftzüge und Markenarchitektur sind geschützt, als Lernbeispiel oder privater Test unproblematisch, als Werbung für dich oder als Post ohne Kennzeichnung nicht. Nutze in Kundenprojekten die Marke, für die du auch beauftragt bist, und kennzeichne KI-generierte Inhalte.