Realistic Woman in Raincoat Video Prompt
A direct text prompt for creating realistic rainy scene videos with specific movement characteristics in Grok Imagine.
1,587 prompts
A direct text prompt for creating realistic rainy scene videos with specific movement characteristics in Grok Imagine.
A descriptive prompt capturing an emotional narrative moment where two people look at each other after rolling up a scroll.
A vivid and dramatic narrative describing the confrontation between Odysseus and the Cyclops Polyphemus in Greek mythology.
An immersive surreal video prompt transitioning from a human pupil close-up to an ultramodern Martian cityscape with classical music.
A grand cinematic space battle visualization blending traditional Japanese Shogi piece elements.
A transition prompt that converts a dusty orange Mars habitat scene into a deep indigo night scene with silvery moonlight.
A detailed cinematic prompt describing a black Tesla driving smoothly through a modern city during the blue hour of dusk.
A video generation prompt featuring self-healing AI bio-organic human growth implants.
A dynamic video prompt designed to transform biblical texts and sacred descriptions into visual representations.
An animation sequence depicting a blonde character's journey toward a magical vortex with storm elements.
A dramatic sci-fi visual depicting personnel on a command bridge overlooking a galaxy-scale tactical chessboard war.
A video motion prompt featuring smooth zooming and vertical rotation of a cluster of ruffled flowers.
A highly detailed cinematic prompt where a woman in a robe enters a room, walks to a sofa, and rests while looking out the window.
A conversational video prompt depicting a scene where a man asks a girl for the time.
A video prompt featuring purple, white, and gold Galactic Federation uniforms with gold emblems.
A clear wide-angle landscape animation capturing detailed scenery of the Martian surface.
A detailed sci-fi video prompt combining futuristic running movie themes with specific actors.
Transform a futuristic cityscape into a scene with premium ecological aesthetics by adding lush vegetation like trees and grass.
A heartwarming video prompt describing a mother singing a lullaby to her baby girl and kissing her.
A cinematic sci-fi video prompt showing a ship on a mission to rescue a starship floating on the ocean.
A dramatic video clip depicting a narrative scene where a character burns religious and spiritual texts.
An intimate close-up portrait video focusing on subtle emotional changes combined with high-technical structural constraints.
A detailed prompt for creating a cinematic stop-motion video of a stone statue awakening on a rocky coast.
A complex sci-fi cinematic video continuation prompt tracking a woman walking through an alien space camp on Mars.
Zuletzt geprüft am 17. August 2026 · Redaktionelle Auswertung aktueller Topview-Beispiele und öffentlicher Prompting-Leitfäden
Kurzantwort
Ein guter Video-Prompt für Grok Imagine kann knapp sein: Benennen Sie das Motiv, geben Sie ihm eine klar erkennbare Handlung und erklären Sie, wie die Kamera diese Handlung beobachtet. Ergänzen Sie Umgebung, Licht, visuelle Gestaltung, Dialog, Ton oder Einschränkungen nur, wenn jedes Detail eine konkrete Produktionsentscheidung klärt. In einem bildbasierten Workflow dient der Ausgangsframe als visueller Anker; beschreiben Sie, was sich bewegen soll, was erkennbar bleiben muss und wo die Handlung endet. Ordnen Sie bei komplexeren Clips zwei oder drei kurze Beats chronologisch an, statt unverbundene Ereignisse in einen Satz zu packen. Natürliche Sprache genügt; konkrete Verben wie „dreht sich“, „fängt“, „verfolgt“ oder „fährt zurück“ sind besser steuerbar als Begriffe wie „episch“ oder „dynamisch“. Wenn der gewählte Topview-Modus Audio oder Dialog erzeugen kann, geben Sie Sprecher, exakten Wortlaut, Sprechweise, Atmosphäre und Geräuschhinweise getrennt an. Schließen Sie mit wenigen beobachtbaren Realismusregeln ab und prüfen Sie das Ergebnis auf Motivdrift, Bewegung, Bildausschnitt, Physik, Sprache und Schlussframe. Eine klare Formulierung verbessert die Steuerbarkeit, garantiert aber nicht bei jeder Generierung dieselbe Identität, Lippensynchronität, denselben Ton oder physikalisch perfekte Bewegung.
[Ausgabekontext] + [Anker für Motiv oder Quellbild] + [Hauptaktion oder kurze Beats] + [Aufnahme und Kamera] + [Umgebung, Licht und Stil] + [Dialog und Ton, sofern verfügbar] + [Kontinuitäts- und Realismusbeschränkungen]
Nennen Sie das beabsichtigte Format, die Ausrichtung und den Zweck des Clips, wenn diese Auswirkungen auf die Komposition oder das Tempo haben. Behalten Sie Auflösung und Dauer in den Produkteinstellungen bei, wenn der ausgewählte Workflow diese Steuerelemente verfügbar macht.
Definieren Sie die Person, das Produkt, das Tier, das Fahrzeug oder die Umgebung, denen die Zuschauer folgen sollen. Sagen Sie in einem bildgesteuerten Workflow, welche sichtbaren Details erkennbar bleiben sollen, ohne jedes Pixel neu zu beschreiben.
Verwenden Sie ein konkretes Bewegungsverb und eine klare Richtung, Geschwindigkeit oder einen klaren Endzustand. Ordnen Sie für eine Sequenz eine kleine Anzahl von Aktionen in der Reihenfolge an, in der sie ausgeführt werden sollen.
Wählen Sie eine Aufnahmegröße, einen Blickwinkel und eine motivierte Kamerabewegung. Erklären Sie, was der Umzug offenbart, anstatt filmische Begriffe zu stapeln.
Fügen Sie Wetter, Atmosphäre, Lichtrichtung, Farbpalette und eine kohärente Erfassungssprache hinzu, die die Aktion unterstützt.
Wenn im ausgewählten Topview-Modus Audio verfügbar ist, trennen Sie die genaue Sprache von Umgebung, Effekten und Musik und verbinden Sie dann wichtige Geräusche mit sichtbaren Ereignissen.
Nennen Sie die wenigen Details, Bildschirmrichtungen, Objektzustände oder physischen Ergebnisse, die die Idee sichtbar zerstören würden, wenn sie sich ändern würden.
Beginnen Sie mit der kleinsten Anweisung, die die Idee kommuniziert, und fügen Sie dann Kontrolle nur dort hinzu, wo Mehrdeutigkeit das Ergebnis verändern könnte. Die meisten Clips benötigen nicht jede Ebene.
| Ziel | Prompt-Muster | Beispielformulierung |
|---|---|---|
| Erfassen Sie die Kernidee | [Betreff] + [eine sichtbare Aktion] | Ein Rotfuchs trabt über eine verschneite Landstraße. |
| Antrag klären | [Betreff] + [Aktionsrichtung, Tempo und Endzustand] | Ein Rotfuchs trabt von Bild links nach Bild rechts, wird bei den Reifenspuren langsamer und bleibt stehen, um zu lauschen. |
| Lenken Sie den Betrachter | [Aktion] + [Aufnahmegröße] + [Verhalten einer Kamera] | Der mittelschwere Schuss mit niedriger seitlicher Bewegung folgt dem Fuchs in seinem Tempo und beruhigt sich dann, wenn der Fuchs anhält. |
| Schaffen Sie eine kohärente Welt | [Umgebung] + [Licht] + [eine visuelle Behandlung] + [physische Atmosphäre] | Ruhige Landstraße zur blauen Stunde, kaltes Gegenlicht auf dem Fell, naturalistische Dokumentartextur, lockerer Schnee, der sich im Wind bewegt. |
| Schützen Sie das Ergebnis | [wichtiger Ton, falls verfügbar] + [zwei oder drei beobachtbare Einschränkungen] | Für einen audioaktivierten Modus: sanfte Pfotenschritte und Winterwind. Nur ein Fuchs, stabile Beinzahl, kein plötzlicher Schnitt oder Kamerarollen. |
Animieren Sie den Fahrradkurier filmisch und realistisch mit dramatischen Kamerabewegungen, tollem Sound und jeder Menge Action.
Kurze bildbasierte Straßenszene im Format 9:16 mit dem hochgeladenen Frame als visuellem Anker. Derselbe Fahrradkurier, die gelbe Regenjacke, der schwarze Helm, die Transporttasche und das rote Fahrrad bleiben erkennbar. Eine durchgehende Aufnahme auf Straßenniveau. Beginnen Sie mit einem fixierten mittelweiten Bildausschnitt, während der Kurier über die linke Schulter blickt. Anschließend rollt das Fahrrad in kontrolliertem Tempo von rechts nach links, während die Kamera eine sanfte seitliche Verfolgung beginnt. Ein Lieferbeleg rutscht aus der Transporttasche; der Kurier bremst einmal, setzt den linken Fuß auf den nassen Asphalt, beugt sich hinunter und hebt ihn auf. Die Szene endet mit vollständig angehaltenem Fahrrad und dem Beleg sichtbar in der zuvor leeren rechten Hand. Bewölkter Nachmittag, weiche Schaufensterreflexionen, leichter Regen, natürliche Reifenspritzer, glaubwürdiges Gewicht und Bremsmoment. Für einen audiogestützten Modus: leiser Verkehr, Regen auf Stoff, einmaliges Bremsenquietschen, keine Musik und kein Dialog. Bewegungsrichtung im Bild und Fahrradproportionen beibehalten. Keine Schnitte, keine Rollbewegung der Kamera, keine zusätzliche Person, keine doppelten Räder, kein schwebender Beleg und kein Kleidungswechsel.
Die schwache Prompt benennt eine Stimmung, identifiziert jedoch kein lesbares Ereignis, keinen Kamerapfad, keinen Tonhinweis oder keinen Endzustand. Die stärkere Version verwandelt die Idee in einen überprüfbaren Handlungsbogen, gibt dem Quellbild eine begrenzte Rolle, behält eine Bildschirmrichtung bei, verwendet eine einzige motivierte Tracking-Bewegung, beschreibt Kontakt und Impuls und definiert, welche Geräusche nur in einem Audio-aktivierten Modus gelten. Seine Einschränkungen zielen auf Fehler ab, die diese bestimmte Aufnahme zerstören würden, anstatt perfekten Realismus zu versprechen oder eine generische Negativliste hinzuzufügen.
Fügen Sie eine konkrete Aktion, deren Richtung oder Tempo und einen klaren Endzustand hinzu. Konzentrieren Sie sich in einem bildgesteuerten Workflow auf das, was sich nach dem Startbild ändert.
Wählen Sie eine erkennbare Schussgröße und -bewegung – etwa einen langsamen Vorstoß, einen verriegelten niedrigen Winkel oder eine Seitenführung – und sagen Sie, was sie offenbaren soll.
Behalten Sie einen primären Aktionsbogen bei. Wenn die Idee mehrere Orte oder größere Aktionen erfordert, teilen Sie sie in einzelne Generationen oder eine kleine Anzahl chronologischer Schritte auf.
Verwenden Sie pro Schlag ein Hauptkameraverhalten. Reservieren Sie eine Schwenk-, Rückzugs- oder Winkeländerung für den Moment, in dem dadurch neue Informationen hinzugefügt werden.
Geben Sie Gewicht, Kontakt, Impuls, Materialreaktion oder Umweltinteraktion an und überprüfen Sie dann die Ausgabe auf genau den Fehler, der Sie interessiert.
Eine gute Prompt identifiziert das Motiv, eine lesbare Aktion, wie die Kamera sie beobachtet und die beabsichtigte Umgebung oder das Ziel. Fügen Sie Sound und Einschränkungen nur dann hinzu, wenn sie für den gewählten Modus und das gewählte Konzept von Bedeutung sind. Klare Produktionsentscheidungen sind nützlicher als eine lange Reihe von Qualitätsadjektiven.
Ja. Viele aktuelle Topview-Beispiele verwenden nur einen Betreff und eine Aktion. Eine prägnante Aufforderung ist angebracht, wenn die Idee einfach ist oder ein Quellbild bereits die Komposition vorgibt. Fügen Sie Details hinzu, wenn Sie Richtung, Timing, Kamera, Atmosphäre, Ton, Kontinuität oder den Endzustand steuern müssen.
Es gibt keine nützliche universelle Wortzählung. Verwenden Sie ein oder zwei Sätze für eine einfache Bewegung und einen kurzen, geordneten Satz für eine komplexere Aktion. Entfernen Sie wiederholte Adjektive, widersprüchliche Stile und Anweisungen, die nichts daran ändern, was sich bewegen, erscheinen, klingen oder stabil bleiben soll.
Text-to-Video benötigt eine ausreichende Beschreibung, um das Thema und die Szene festzulegen. Image-to-Video kann das Startbild als visuellen Anker verwenden, daher sollte sich die Prompt auf Bewegung, Kamera, Atmosphäre, Ton und die Details konzentrieren, die erkennbar bleiben sollen. Die verfügbaren Eingänge hängen vom ausgewählten Topview-Modus ab.
So ist dieser Leitfaden entstanden
Dieser Leitfaden ist eine redaktionelle Zusammenfassung einer Momentaufnahme von 1.188 Grok Imagine-Datensätzen in der Topview-Prompt-Bibliothek, die am 17. August 2026 überprüft wurde; Jeder Datensatz in diesem Schnappschuss wurde als Videogenerierung klassifiziert. Ungefähr sieben von zehn nicht leeren Prompts verwendeten 40 Wörter oder weniger, während längere Beispiele Kamera- oder Aufnahmerichtung, geordnete Beats, Dialog oder Ton, Erhaltungssprache und szenenspezifische Realismusbeschränkungen hinzufügten, wenn das Konzept mehr Kontrolle erforderte. Die Struktur wurde außerdem mit offiziellem xAI-Material verglichen, das bildgesteuerte Bewegung, Kamera, Tempo, Atmosphäre, Physik, Sounddesign und aktuelle Video 1.5-Audiofunktionen beschreibt, sowie mit öffentlichen Grok Imagine-Anleitungen zu Prompt-Länge, Bewegungsverben, Kameravokabular, Anwendungsbeispielen, Fehlern und FAQs. Alle oben genannten Formeln und Beispiele wurden von Grund auf für Topview geschrieben. Das offizielle 1.5-Material wurde zur Validierung des allgemeinen Vokabulars verwendet und nicht zur Behauptung, dass jeder Topview Grok Imagine-Modus dieselben Eingaben oder dasselbe Verhalten bereitstellt. Diese Empfehlungen sind Ausgangspunkte und keine Garantie dafür, dass ein Prompt unabhängig getestet wurde oder bei jedem Durchlauf die gleiche Identität, den gleichen Dialog, den gleichen Ton oder die gleiche Bewegung wiedergibt.
Die aktuellen Topview-Beispiele reichen von einzeiligen Handlungen bis zu detaillierten Aufnahmeplänen. Verwenden Sie das einfachste Muster, mit dem das beabsichtigte Ereignis noch klar lesbar bleibt.
| Ziel | Prompt-Muster | Beispielformulierung |
|---|---|---|
| Animieren Sie ein Quellbild | Verankern Sie das bestehende Thema → beschreiben Sie, was sich zu bewegen beginnt → definieren Sie einen zurückhaltenden Endzustand | Ausgehend von dem mitgelieferten Porträt hebt sie den Blick zum Fenster, atmet einmal ruhig ein und endet mit einem leichten Lächeln. Halten Sie den Rahmen und die Garderobe erkennbar. |
| Führen Sie eine einzelne Aktion durch | Ausgangslage → eine Aktion mit Richtung und Gewicht → klarer Abschluss | Der Radfahrer steigt von rechts ein, bremst auf der nassen Fahrbahn mit glaubwürdigem Schwung, stellt einen Fuß auf und kommt neben dem Kiosk völlig zum Stehen. |
| Zeigen Sie eine Transformation | Stabile Ausgangsform → sichtbarer Transformationsmechanismus → fertige Form und Halt | Der Papiervogel entfaltet sich entlang seiner Falten zu einer kleinen mechanischen Schwalbe; Die Messinggelenke rasten ein, die Flügel öffnen sich einmal und die fertige Form hält auf dem Tisch. |
| Bauen Sie einen kurzen Erzählbogen auf | Etablieren → Auslösen → Reaktion oder Auszahlung, mit einem Hauptereignis pro Schlag | Beginnen Sie weit auf der leeren Plattform. Ein Koffer rollt von selbst ins Blickfeld. Der wartende Schaffner bemerkt es, tritt einen Schritt zurück und die Kamera beendet seine Reaktion. |
| Leiten Sie eine Produktpräsentation | Produktanker → kontrollierte Materialbewegung → lesbarer Heldenzustand | Ein Kondenswasserband läuft an der unveränderten Flasche entlang, während sich der Drehteller um eine Vierteldrehung dreht. Das Etikett endet mit Blick auf die Kamera in einem sauber zentrierten Hero-Rahmen. |
Wählen Sie die Kamerasprache danach, welche Information die Aufnahme zeigen muss. Eine klare Kamerabewegung lässt sich meist leichter bewerten als mehrere gleichzeitige Bewegungen.
| Ziel | Prompt-Muster | Beispielformulierung |
|---|---|---|
| Emotionen offenbaren | Stabile mittlere Einstellung → langsames Einschieben → Stopp vor einer intimen Nahaufnahme | Mittlere Aufnahme auf Augenhöhe; Langsames Einschieben, während die Läuferin die Ankündigung hört, endet mit ihrer zurückhaltenden Reaktion. |
| Folgen Sie der Bewegung | Seitliche oder rückwärtige Kamerafahrt mit Motivgeschwindigkeit und gleichbleibender Bildschirmausrichtung | Die hüfthohe seitliche Kamerafahrt folgt dem Skateboarder, der sich von links nach rechts bewegt; Halten Sie das Gesicht im oberen linken Drittel. |
| Form oder Maßstab anzeigen | Nahe Details oder niedriger Winkel → kontrollierte Umlaufbahn oder Rückzug → breiterer Kontext | Beginnen Sie damit, dass sich das Rover-Rad in den roten Staub drückt, und ziehen Sie es dann langsam zurück, um das Fahrzeug allein unter der Wand des Canyons freizulegen. |
| Schaffen Sie fundierten Realismus | Verriegelte oder leicht handgehaltene Kamera + spezifische Unvollkommenheit + Bewegungseinschränkung | Gesperrte Straßenkamera mit leichter Wiederherstellung des Autofokus, während der Bus den Vordergrund überquert; Kein Zoom und kein Verwackeln der Kamera, nachdem sich der Fokus stabilisiert hat. |
| Räumliche Kontinuität schützen | Geben Sie Eingang, Fahrtrichtung, Augenlinie und endgültige Bildschirmposition an | Der Becher kommt von links herein, wird einmal in der Bildmitte gefangen und tritt dann ganz nach rechts wieder aus; Die Hand endet leer. |
Verwenden Sie physische Details, die man sehen oder hören kann. Audioanweisungen sind nur dann relevant, wenn der ausgewählte Modus sie unterstützt und jede Ausgabe noch überprüft werden muss.
| Ziel | Prompt-Muster | Beispielformulierung |
|---|---|---|
| Atmosphäre sichtbar machen | [Wetter oder Partikel] + [wie sie auf Motiv und Licht reagieren] | Feiner Regen rinnt durch die Schaufensterbeleuchtung, spritzt unter jeder Stufe und perlt auf der Jacke, ohne zu Nebel zu werden. |
| Sorgen Sie für eine kohärente Beleuchtung | [Hauptlichtquelle] + [Richtung] + [Oberflächenreaktion] + [Kontinuitätsregel] | Warmes Fensterlicht bleibt von der Kamera links und erzeugt einen stabilen Rand auf dem Glas und sanfte Reflexionen über die Metallkappe. |
| Schreiben Sie einen kurzen Dialog | [benannter Sprecher] sagt „[genaue Zeile]“ in [Lieferung]; [Hörer- oder Kameraverhalten] | Im Audiomodus sagt Nia leise und ohne zu lächeln: „Lass das Licht an.“ Der Zuhörer bleibt in einer verriegelten Zweiereinstellung stumm. |
| Synchronisieren Sie Ton und Aktion | [sichtbares Ereignis] landet mit [spezifischem Effekt]; [Ambiente- oder Musikregel] | Das Bahnhofsschild flackert mit einem elektrischen Knall auf; Die ferne Zugatmosphäre geht weiter, ohne Musik. |
| Fordern Sie glaubwürdige Physik | [Gewicht, Kontakt, Impuls oder Materialverhalten] + [Ausschlüsse beobachtbarer Fehler] | Die schwere Kiste drückt beim Landen den nassen Boden zusammen, rutscht nur wenige Zentimeter und bleibt stehen. Kein Abprallen, kein Schweben, keine duplizierte Kiste oder sich ändernde Abmessungen. |
Vergewissern Sie sich zunächst, dass der ausgewählte Topview-Modus den erforderlichen Audioeingang oder die erforderliche Audioerzeugung unterstützt. Halten Sie die Zeilen kurz, benennen Sie den Sprecher und den Vortrag und überprüfen Sie die Synchronisierung nach der Generierung.
Listen Sie die wenigen sichtbaren Invarianten auf, die wichtig sind – Gesicht, Kleidung, Produktgeometrie, Anzahl der Requisiten, Lichtrichtung oder Bildschirmrichtung – ohne eine Garantie zu implizieren.
Beschreiben Sie die beabsichtigte Aktion positiv und schließen Sie dann nur einige szenenspezifische Fehler aus, wie z. B. ein zusätzliches Objekt, ein unerwünschter Schnitt oder eine veränderte Produktform.
Verwenden Sie Zeitstempel oder nummerierte Schläge, wenn Reihenfolge und Tempo andernfalls nicht eindeutig wären. Bei einer kontinuierlichen Aktion sind Start-, Verlaufs- und Endstatus normalerweise klarer. Mehrere Schnitte erhöhen die Anforderungen an die Kontinuität. Teilen Sie daher eine größere Idee in separate Clips auf, wenn jede Szene ihr eigenes Setup benötigt.
Beginnen Sie mit vertrauten Anweisungen wie z. B. fixierter Aufnahme, Nahaufnahme, Weitwinkelaufnahme, langsames Einschieben, Zurückziehen, Schwenken, Orbit, seitliche Spur, Handverfolgung, POV oder niedriger Winkel. Wählen Sie einen Hauptzug aus und verknüpfen Sie ihn mit dem, was das Publikum bemerken soll.
Wenn der ausgewählte Topview-Modus Audio unterstützt, schreiben Sie kurze, genaue Dialoge, identifizieren Sie den Sprecher und den Vortrag und trennen Sie Sprache von Atmosphäre, Effekten und Musik. Verknüpfen Sie sichtbare Aktionen mit wichtigen akustischen Hinweisen und überprüfen Sie die Lippensynchronisation und das Timing, anstatt davon auszugehen, dass sie genau sind.
Beschreiben Sie die beobachtbare Physik: Wo Gewicht landet, was den Boden berührt, wie Impuls absorbiert wird, wie Stoff oder Partikel reagieren und in welchem Zustand das Subjekt endet. Halten Sie die Aktionslast überschaubar und bewerten Sie Kontakt, Proportionen und Objektanzahl nach der Generierung.
Verwenden Sie einen klaren Quellrahmen oder Themenanker, wiederholen Sie nur die wichtigsten visuellen Invarianten, begrenzen Sie unnötige Schnitte und Stiländerungen und sorgen Sie dafür, dass die Produktgeometrie oder die Beschreibungen der Garderobe stabil bleiben. Diese Schritte können die Richtung verbessern, garantieren jedoch nicht, dass in jedem Frame identische Details vorhanden sind.
Beginnen Sie mit positiven Anweisungen für die beabsichtigte Aktion, den Rahmen, die Materialien und den Endzustand. Fügen Sie dann einige Ausschlüsse hinzu, die mit sichtbaren Risiken in dieser Szene verknüpft sind. Ob ein separates negatives Promptsfeld verfügbar ist, hängt vom ausgewählten Topview-Workflow ab.