《我是传奇》Optimus Prime 预告片
A cinematic video prompt for Grok Imagine to create a movie trailer scene replacing Will Smith with a Tesla Optimus robot.
1,625 prompts
A cinematic video prompt for Grok Imagine to create a movie trailer scene replacing Will Smith with a Tesla Optimus robot.
A highly detailed video prompt for generating soft, glowing radial neon color explosions and geometric shapes.
A highly detailed video prompt blending Gustav Klimt's artistic style with futuristic elements like armored knights and space palaces.
An animation prompt where molten gold drops converge and grow into a weeping willow adorned with black pearls against a charcoal gray background.
A video prompt depicting a principal assigning teaching tasks to parents and college seniors in a California high school setting.
A detailed horror-themed anime prompt describing a four-legged monster cat transforming into a bipedal creature to start a live stream.
A descriptive prompt for a fantasy scene featuring Lady Starweave and an ocelot cub in an elven forest.
A narrative video prompt telling the story of an ant family taking shelter from the rain under a leaf.
A cinematic video prompt depicting a tall French woman in an art gallery with a soft autumn aesthetic.
A detailed multi-segment video prompt featuring Luffy and Anya with precise timing for interactions and emotional highlights.
A 45-second tutorial video prompt demonstrating how to make garlic bread with parsley and parmesan cheese.
A narrative video prompt depicting Athena approaching Zeus's temple to plead for help for mortals.
A complex multi-stage dynamic transformation video prompt detailing a continuous animal shapeshifting process.
A tribute video prompt for the Sacred Hearts of Jesus and Mary Church in Scranton, PA, showcasing its 1925 appearance.
A detailed video prompt describing a 20-year-old East Asian woman in a flowing pink and gold dress performing a traditional dance with specific choreography.
A Grok Imagine video prompt depicting a character transitioning from sitting to standing and doing push-ups in an anime style.
A highly detailed surrealist vertical night scene depicting a lone person facing a massive glowing door in the desert.
An advanced prompt for animating two people in a photo with specific lip-syncing and natural facial movements.
A melancholic and serene video prompt depicting an old man fishing alone by a lake, emphasizing the quiet atmosphere after the crowds have left.
A complex temporal prompt for a 15-second high-fidelity video showing natural movements and emotions while eating noodles.
A concise prompt for creating a 6-second loop video featuring a character in a candlelit room.
A descriptive cinematic prompt depicting a girl on a rooftop watching a giant planet rise, emphasizing surreal scale and emotional storytelling.
A cinematic high-contrast architectural prompt featuring stacked concrete blocks, slender glowing white doorways, and dynamic shadow fading effects.
A detailed character action prompt including waving, spinning, falling, and smiling, with specific requirements for tail color.
Ultima revisione: 17 agosto 2026 · Sintesi editoriale degli esempi Topview attuali e delle guide pubbliche al prompting
Risposta rapida
Un utile prompt video Grok Imagine può essere conciso: identifica il soggetto, assegnagli un'azione leggibile e spiega come la telecamera osserva quell'azione. Aggiungi l'ambiente, la luce, il trattamento visivo, il dialogo, il suono o i vincoli solo quando ogni dettaglio risolve una decisione di produzione. Per un flusso di lavoro basato sulle immagini, tratta il fotogramma sorgente come l'ancoraggio visivo e descrivi cosa dovrebbe muoversi, cosa dovrebbe rimanere riconoscibile e dove termina l'azione. Per una clip più complessa, disponi due o tre brevi battute in ordine cronologico anziché combinare eventi non correlati in un'unica frase. È sufficiente il linguaggio naturale; verbi concreti come girare, afferrare, seguire o tirarsi indietro sono più indirizzabili di etichette come epico o dinamico. Se la modalità Topview selezionata fornisce la generazione di audio o dialoghi, assegnare un nome alil parlante, alla battuta esatta, alla consegna, all'ambiente e al segnale sonoro separatamente. Termina con un piccolo insieme di regole di realismo osservabili, quindi rivedi l'output per la deriva del soggetto, il movimento, l'inquadratura, la fisica, il parlato e il fotogramma finale. Una formulazione tempestiva può migliorare la chiarezza, ma non può garantire identità, sincronizzazione labiale, suono o movimento fisicamente perfetto in ogni generazione.
[contesto di output] + [soggetto o ancoraggio del fotogramma sorgente] + [azione primaria o battute brevi] + [inquadratura e telecamera] + [ambiente, luce e stile] + [dialogo e suono quando disponibili] + [vincoli di continuità e realismo]
Assegna un nome al formato, all'orientamento e allo scopo della clip previsti quando influiscono sulla composizione o sul ritmo. Mantieni la risoluzione e la durata nelle impostazioni del prodotto quando il flusso di lavoro selezionato espone tali controlli.
Definisci la persona, il prodotto, l'animale, il veicolo o l'ambiente che gli spettatori dovrebbero seguire. In un flusso di lavoro basato su immagini, indica quali dettagli visibili dovrebbero rimanere riconoscibili senza ridescrivere ogni pixel.
Utilizza un verbo di movimento concreto e una direzione, una velocità o uno stato finale chiari. Per una sequenza, organizza un piccolo numero di azioni nell'ordine in cui dovrebbero verificarsi.
Scegli le dimensioni dello scatto, il punto di vista e un movimento della telecamera motivato. Spiega cosa rivela la mossa invece di accumulare termini cinematografici.
Aggiungi meteo, atmosfera, direzione della luce, tavolozza e un linguaggio di acquisizione coerente che supporti l'azione.
Quando l'audio è disponibile nella modalità Topview selezionata, separa il parlato esatto dall'ambiente, dagli effetti e dalla musica, quindi collega i suoni importanti agli eventi visibili.
Nomina i pochi dettagli, le indicazioni sullo schermo, gli stati degli oggetti o i risultati fisici che interromperebbero visibilmente l'idea se cambiassero.
Inizia con la più piccola istruzione che comunica l'idea, quindi aggiungi il controllo solo laddove l'ambiguità potrebbe cambiare il risultato. La maggior parte delle clip non necessita di tutti i livelli.
| Obiettivo | Schema del prompt | Esempio di formulazione |
|---|---|---|
| Cattura l'idea centrale | [oggetto] + [un'azione visibile] | Una volpe rossa trotta lungo una strada di campagna innevata. |
| Chiarire il movimento | [oggetto] + [direzione dell'azione, ritmo e stato finale] | Una volpe rossa trotta da sinistra a destra, rallenta sulle tracce di pneumatici e si ferma ad ascoltare. |
| Dirigi lo spettatore | [azione] + [dimensione dello scatto] + [comportamento di una telecamera] | Il campo medio con deviazione bassa segue la volpe al suo ritmo, per poi stabilizzarsi quando la volpe si ferma. |
| Crea un mondo coerente | [ambiente] + [luce] + [un trattamento visivo] + [atmosfera fisica] | Tranquilla strada rurale all'ora blu, controluce fredda sulla pelliccia, trama documentaristica naturalistica, neve a debole coesione che si muove nel vento. |
| Proteggi il risultato | [suono importante se disponibile] + [due o tre vincoli osservabili] | Per una modalità abilitata all'audio: passi morbidi di zampe e vento invernale. Una sola volpe, numero di zampe stabile, nessun taglio improvviso o rotazione della telecamera. |
Gli attuali campioni Topview spaziano da azioni su una linea a piani di ripresa dettagliati. Utilizza il modello più semplice che renda comunque leggibile l'evento desiderato.
| Obiettivo | Schema del prompt | Esempio di formulazione |
|---|---|---|
| Animare un'immagine sorgente | Ancorare il soggetto esistente → descrivere ciò che inizia a muoversi → definire uno stato finale trattenuto | Partendo dal ritratto fornito, alza gli occhi verso la finestra, fa un respiro tranquillo e termina con un lieve sorriso; mantenere riconoscibili l'inquadratura e l'armadio. |
| Metti in scena una singola azione | Posizione iniziale → un'azione con direzione e peso → completamento chiaro | Il ciclista entra dall'inquadratura destra, frena con slancio credibile sull'asfalto bagnato, pianta un piede e si ferma completamente accanto al chiosco. |
| Mostra una trasformazione | Forma iniziale stabile → meccanismo di trasformazione visibile → forma e tenuta finite | L'uccellino di carta si dispiega lungo le sue pieghe in una piccola rondine meccanica; i giunti in ottone si bloccano in posizione, le ali si aprono una volta e la forma finita rimane sul tavolo. |
| Costruisci un breve arco narrativo | Stabilisci → trigger → reazione o profitto, con un evento principale per battuta | Inizia largo sulla piattaforma vuota. Una valigia appare da sola. Il conducente in attesa se ne accorge, fa un passo indietro e la telecamera si ferma sulla sua reazione. |
Seleziona la lingua della telecamera in base alle informazioni che lo scatto deve rivelare. Una mossa chiara è solitamente più facile da valutare rispetto a diverse mosse simultanee.
| Obiettivo | Schema del prompt | Esempio di formulazione |
|---|---|---|
| Rivelare l'emozione | Campo medio stabile → spinta lenta → stop prima di un primo piano intimo | Inquadratura media all'altezza degli occhi; spinta lenta non appena il corridore sente l'annuncio, che termina con la sua reazione contenuta. |
| Segui il movimento | Scatto con tracciamento laterale o posteriore alla velocità del soggetto + direzione dello schermo coerente | L'inquadratura laterale all'altezza della vita segue lo skateboarder che si muove da sinistra a destra; mantieni il viso vicino al terzo in alto a sinistra. |
| Mostra forma o scala | Dettaglio ravvicinato o angolo basso → orbita controllata o pullback → contesto più ampio | Inizia dalla ruota del rover che preme sulla polvere rossa, quindi torna indietro lentamente per rivelare il veicolo da solo sotto la parete del canyon. |
| Crea un realismo radicato | Telecamera bloccata o leggermente a mano + imperfezione specifica + limite di movimento | Telecamera bloccata a livello stradale con lieve recupero dell'autofocus mentre l'autobus attraversa il primo piano; nessuno zoom e nessuna vibrazione della telecamera dopo che la messa a fuoco si è stabilizzata. |
Usa dettagli fisici che possono essere visti o ascoltati. Le istruzioni audio sono rilevanti solo quando la modalità selezionata le supporta e ogni output necessita ancora di revisione.
| Obiettivo | Schema del prompt | Esempio di formulazione |
|---|---|---|
| Rendi visibile l'atmosfera | [tempo o particelle] + [come reagiscono al soggetto e alla luce] | La pioggia sottile filtra attraverso la luce del negozio, schizza sotto ogni gradino e gocciola sulla giacca senza diventare nebbia. |
| Mantieni l'illuminazione coerente | [sorgente luminosa] + [direzione] + [risposta della superficie] + [regola di continuità] | La luce calda della finestra rimane a sinistra della telecamera, creando un bordo stabile sul vetro e riflessi morbidi sulla calotta metallica. |
| Scrivi un breve dialogo | [il parlante nominato] dice "[battuta esatta]" in [consegna]; [comportamento dell'ascoltatore o della telecamera] | In modalità audio, Nia dice "Lascia la luce accesa" in silenzio e senza sorridere; l'ascoltatore rimane in silenzio in una doppia inquadratura bloccata. |
| Sincronizza suono e azione | [evento visibile] atterra con [effetto specifico]; [regola dell'atmosfera o della musica] | L'insegna della stazione si spegne con uno schiocco elettrico; l'atmosfera del treno lontano continua, senza musica. |
| Richiedi fisica credibile |
Anima il corriere in bicicletta in modo cinematografico e realistico con movimenti drammatici della telecamera, audio eccezionale e tanta azione.
Breve scena di strada delle 9:16 guidata da immagini che utilizza il fotogramma caricato come ancoraggio visivo. Mantieni riconoscibili lo stesso corriere in bicicletta, la giacca antipioggia gialla, il casco nero, la borsa da carico e la bicicletta rossa. Uno scatto continuo a livello della strada. Inizia in un'inquadratura di media ampiezza bloccata mentre il corriere guarda oltre la spalla sinistra. La bicicletta quindi avanza da destra a sinistra a un ritmo controllato mentre la telecamera inizia un percorso laterale regolare. Una ricevuta di consegna scivola dalla borsa del carico; il corriere frena una volta, pianta il piede sinistro sull'asfalto bagnato, si abbassa e lo raccoglie. Terminare con la bicicletta completamente ferma e lo scontrino visibile nella mano destra vuota del corriere. Pomeriggio nuvoloso, riflessi tenui delle vetrine, pioggia leggera, spruzzi naturali di pneumatici, peso credibile e momento frenante. Per una modalità abilitata all'audio: traffico silenzioso, pioggia sui tessuti, un cigolio dei freni, nessuna musica o dialogo. Conserva la direzione dello schermo e le proporzioni della bicicletta. Nessun taglio, rotazione della telecamera, pilota extra, ruote duplicate, ricevuta fluttuante o cambio di guardaroba.
Il prompt debole nomina uno stato d'animo ma non identifica un evento leggibile, il percorso della telecamera, un segnale sonoro o lo stato finale. La versione più potente trasforma l'idea in un arco d'azione rivedibile, conferisce al fotogramma sorgente un ruolo delimitato, preserva una direzione dello schermo, utilizza un singolo movimento di tracciamento motivato, descrive il contatto e lo slancio e definisce quali suoni si applicano solo in una modalità abilitata all'audio. I suoi vincoli mirano ai fallimenti che potrebbero interrompere questa particolare ripresa invece di promettere un realismo perfetto o aggiungere un generico elenco negativo.
Aggiungi un'azione concreta, la sua direzione o ritmo e uno stato finale chiaro. In un flusso di lavoro basato sulle immagini, concentrati su ciò che cambia dopo il fotogramma iniziale.
Scegli una dimensione di ripresa e un movimento osservabili, ad esempio una spinta lenta, un angolo basso bloccato o una traiettoria laterale, e indica cosa dovrebbe rivelare.
Mantieni un arco di azione principale. Se l'idea necessita di più ubicazioni o azioni importanti, dividila in generazioni separate o in un piccolo numero di battute cronologiche.
Utilizza un comportamento della telecamera principale per battuta. Prenota una panoramica, un pullback o una modifica dell'angolo per il momento in cui aggiunge nuove informazioni.
Indica peso, contatto, quantità di moto, risposta materiale o interazione ambientale, quindi esamina l'output per individuare esattamente il guasto che ti interessa.
Per prima cosa verificare che la modalità Topview selezionata supporti l'ingresso o la generazione audio necessaria. Mantieni le battute brevi, dai un nome al parlante e alla consegna e verifica la sincronizzazione dopo la generazione.
Elenca le poche invarianti visibili che contano (viso, abbigliamento, geometria del prodotto, numero di oggetti scenici, direzione della luce o direzione dello schermo) senza implicare una garanzia.
Descrivi positivamente l'azione prevista, quindi escludi solo alcuni errori specifici della scena, come un oggetto in più, un taglio indesiderato o una forma modificata del prodotto.
Un buon prompt identifica il soggetto, un'azione leggibile, il modo in cui la telecamera lo osserva e l'ambiente o la finitura prevista. Aggiungi suoni e vincoli solo quando sono importanti per la modalità e il concetto scelti. Decisioni di produzione chiare sono più utili di una lunga serie di aggettivi di qualità.
Sì. Molti esempi attuali di Topview utilizzano solo un soggetto e un'azione. Un prompt conciso è appropriato quando l'idea è semplice o un'immagine sorgente stabilisce già la composizione. Aggiungi dettagli quando devi controllare la direzione, i tempi, la telecamera, l'atmosfera, il suono, la continuità o lo stato finale.
Non esiste un conteggio universale delle parole utile. Usa una o due frasi per un movimento semplice e un breve riassunto ordinato per un'azione più complessa. Rimuovi aggettivi ripetuti, stili contraddittori e istruzioni che non cambiano ciò che dovrebbe muoversi, apparire, suonare o rimanere stabile.
Il testo in video necessita di una descrizione sufficiente per stabilire l'argomento e la scena. L'immagine in video può utilizzare il fotogramma iniziale come ancoraggio visivo, quindi il prompt dovrebbe concentrarsi sul movimento, sulla telecamera, sull'atmosfera, sul suono e sui dettagli che desideri rimangano riconoscibili. Gli ingressi disponibili dipendono dalla modalità Topview selezionata.
Utilizza timestamp o battute numerate quando l'ordine e il ritmo sarebbero altrimenti ambigui. Per un'azione continua, lo stato di inizio, progressione e fine è solitamente più chiaro. Tagli multipli aumentano le esigenze di continuità, quindi dividi un'idea più ampia in clip separate quando ogni scena necessita della propria configurazione.
Inizia con istruzioni familiari come tiro bloccato, primo piano, campo lungo, spinta lenta, pullback, panoramica, orbita, traccia laterale, segui a mano libera, POV o angolo basso. Scegli una mossa principale e collegala a ciò che il pubblico dovrebbe notare.
Quando la modalità Topview selezionata supporta l'audio, scrivi dialoghi brevi ed esatti, identifica il parlante e la pronuncia e separa il parlato dall'ambiente, dagli effetti e dalla musica. Associa importanti segnali sonori alle azioni visibili e rivedi la sincronizzazione labiale e i tempi invece di dare per scontato che siano esatti.
Descrivi la fisica osservabile: dove cade il peso, cosa tocca il suolo, come viene assorbito lo slancio, come reagiscono il tessuto o le particelle e in quale stato finisce il soggetto. Mantieni gestibile il carico di azione e valuta il contatto, le proporzioni e il conteggio degli oggetti dopo la generazione.
Utilizza una cornice di origine chiara o un ancoraggio del soggetto, ripeti solo le invarianti visive più importanti, limita i tagli e i cambiamenti di stile non necessari e mantieni stabili la geometria del prodotto o le descrizioni del guardaroba. Questi passaggi possono migliorare la direzione ma non garantiscono dettagli identici in ogni fotogramma.
Inizia con istruzioni positive sull'azione prevista, sulla struttura, sui materiali e sullo stato finale. Quindi aggiungi alcune esclusioni legate ai rischi visibili in quella scena. La disponibilità di un campo di prompt negativa separato dipende dal flusso di lavoro Topview selezionato.
Come è stata realizzata questa guida
Questa guida è una sintesi editoriale di un'istantanea di 1.188 record Grok Imagine nella libreria di prompt Topview revisionata il 17 agosto 2026; ogni registrazione in quell'istantanea è stata classificata come generazione video. Circa sette prompt non vuoti su dieci utilizzavano 40 parole o meno, mentre gli esempi più lunghi aggiungevano la direzione della telecamera o dell'inquadratura, ritmi ordinati, dialoghi o suoni, preservazione del linguaggio e vincoli di realismo specifici della scena quando il concetto richiedeva maggiore controllo. La struttura è stata inoltre verificata rispetto al materiale ufficiale xAI che descrive il movimento guidato dalle immagini, la telecamera, il ritmo, l'atmosfera, la fisica, il sound design e le attuali funzionalità audio Video 1.5, oltre alle guide Grok Imagine pubbliche che coprono la lunghezza dei prompt, i verbi di movimento, il vocabolario della telecamera, esempi di casi d'uso, errori e domande frequenti. Tutte le formule e gli esempi sopra riportati sono stati scritti da zero per Topview. Il materiale ufficiale 1.5 è stato utilizzato per convalidare il vocabolario generale, non per affermare che ogni modalità Topview Grok Imagine espone gli stessi input o comportamenti. Queste raccomandazioni sono punti di partenza, non una garanzia che qualsiasi prompt sia stato testato in modo indipendente o riproduca la stessa identità, dialogo, suono o movimento ad ogni corsa.
| Dirigere la presentazione di un prodotto |
|---|
| Ancoraggio del prodotto → movimento materiale controllato → stato eroe leggibile |
| Un nastro di condensa scorre lungo la bottiglia inalterata mentre il piatto rotante ruota di un quarto di giro; l'etichetta termina di fronte alla telecamera in una cornice di eroe pulita e centrata. |
| Proteggere la continuità spaziale |
|---|
| Dichiara l'ingresso, la direzione del viaggio, la linea dello sguardo e la posizione finale dello schermo |
| Il boccale entra da sinistra, viene catturato una volta al centro dell'inquadratura, quindi esce completamente a destra; la mano finisce vuota. |
| [peso, contatto, quantità di moto o comportamento materiale] + [esclusioni di guasti osservabili] |
| La pesante cassa comprime il terreno bagnato all'atterraggio, scivola solo di pochi centimetri e si ferma; nessun rimbalzo, fluttuazione, cassa duplicata o modifica delle dimensioni. |