Anime Crossover Storyboard Scene
A detailed multi-segment video prompt featuring Luffy and Anya with precise timing for interactions and emotional highlights.
1,609 prompts
A detailed multi-segment video prompt featuring Luffy and Anya with precise timing for interactions and emotional highlights.
A highly detailed surrealist vertical night scene depicting a lone person facing a massive glowing door in the desert.
An advanced prompt for animating two people in a photo with specific lip-syncing and natural facial movements.
Generates a smooth video tracking a futuristic black Tesla driving on a sunny highway with clear reflections.
A highly detailed cinematic prompt where a woman in a robe enters a room, walks to a sofa, and rests while looking out the window.
A conversational video prompt depicting a scene where a man asks a girl for the time.
A Grok Imagine video prompt depicting a character transitioning from sitting to standing and doing push-ups in an anime style.
A cinematic high-contrast architectural prompt featuring stacked concrete blocks, slender glowing white doorways, and dynamic shadow fading effects.
A detailed character action prompt including waving, spinning, falling, and smiling, with specific requirements for tail color.
A highly detailed video prompt for Grok Imagine depicting two blonde martial artists sparring in a Japanese dojo.
A heartwarming video prompt describing a mother singing a lullaby to her baby girl and kissing her.
A cinematic sci-fi video prompt showing a ship on a mission to rescue a starship floating on the ocean.
A descriptive cinematic prompt depicting a girl on a rooftop watching a giant planet rise, emphasizing surreal scale and emotional storytelling.
A detailed horror-themed anime prompt describing a four-legged monster cat transforming into a bipedal creature to start a live stream.
A video prompt for grok-imagine featuring a cat wearing glasses with slow camera movement.
A direct text prompt for creating realistic rainy scene videos with specific movement characteristics in Grok Imagine.
A descriptive prompt capturing an emotional narrative moment where two people look at each other after rolling up a scroll.
A vivid and dramatic narrative describing the confrontation between Odysseus and the Cyclops Polyphemus in Greek mythology.
A 45-second tutorial video prompt demonstrating how to make garlic bread with parsley and parmesan cheese.
A narrative video prompt depicting Athena approaching Zeus's temple to plead for help for mortals.
An animation for a manga scene featuring age-transformation effects and sequential text overlays.
A detailed cinematic prompt describing a black Tesla driving smoothly through a modern city during the blue hour of dusk.
A video generation prompt featuring self-healing AI bio-organic human growth implants.
A dynamic video prompt designed to transform biblical texts and sacred descriptions into visual representations.
最終確認:2026年8月17日 · Topviewの現行サンプルと公開プロンプト資料を編集部が整理
要点
Grok Imagineの動画プロンプトは簡潔でも構いません。被写体を特定し、見て分かる動作を1つ与え、カメラがその動作をどう捉えるかを指定します。環境、光、映像表現、セリフ、音、制約は、それぞれが制作上の判断を明確にするときだけ追加してください。画像を基に生成する場合は、元フレームを視覚的な基準にして、動かす部分、認識できる状態を保つ部分、動作の終点を説明します。複雑なクリップでは、無関係な出来事を一文に詰め込まず、2〜3個の短い展開を時系列で並べます。自然な文章で十分です。「振り向く」「受け止める」「追従する」「引く」のような具体的な動詞は、「壮大」「ダイナミック」といった抽象的なラベルより指示しやすくなります。選択したTopviewモードで音声やセリフを生成できる場合は、話者、正確なセリフ、話し方、環境音、効果音を分けて指定します。最後に、目で確認できるリアリズム上の制約を少数加え、被写体のずれ、動き、構図、物理表現、音声、最終フレームを確認してください。明確な書き方は指示の精度を高めますが、毎回同じ人物、リップシンク、音、物理的に完璧な動きを保証するものではありません。
[出力コンテキスト] + [主題またはソースフレームアンカー] + [主要なアクションまたは短いビート] + [ショットとカメラ] + [環境、光、スタイル] + [利用可能な場合はダイアログとサウンド] + [連続性とリアリズムの制約]
意図したフォーマット、向き、クリップの目的が構成やペースに影響を与える場合は、その名前を付けます。選択したワークフローがこれらのコントロールを公開する場合、製品設定の解像度と期間を維持します。
視聴者がフォローすべき人物、製品、動物、乗り物、または環境を定義します。画像主導のワークフローでは、すべてのピクセルを再記述せずに、目に見えるどの詳細を認識可能なままにするかを指定します。
具体的な動作動詞と、明確な方向、速度、または終了状態を使用します。シーケンスの場合は、少数のアクションを発生する順序で配置します。
ショットのサイズ、視点、および意図的なカメラの動きを 1 つ選択します。映画的な用語を積み重ねるのではなく、その動きによって何が明らかになるのかを説明してください。
天気、雰囲気、光の方向、パレット、およびアクションをサポートする 1 つの一貫したキャプチャ言語を追加します。
選択した Topview モードでオーディオが利用可能な場合、正確な音声を環境、効果、音楽から分離し、重要なサウンドを目に見えるイベントに接続します。
変更するとアイデアが明らかに崩れてしまうような、いくつかの詳細、画面の方向、オブジェクトの状態、または物理的な結果を挙げてください。
アイデアを伝える最小の命令から始めて、あいまいさによって結果が変わる可能性がある場合にのみ制御を追加します。ほとんどのクリップはすべてのレイヤーを必要としません。
| 目的 | プロンプトパターン | 記述例 |
|---|---|---|
| 核となるアイデアを捉える | [被写体] + [目に見える動作を1つ] | 雪に覆われた田舎道をキタキツネが小走りで横切ります。 |
| 動きを明確にする | [主題] + [行動の方向、ペース、終了状態] | アカギツネがフレーム左からフレーム右へ小走りし、タイヤ跡で速度を落とし、立ち止まって耳を傾けます。 |
| 視聴者を誘導する | [アクション] + [ショット サイズ] + [1 つのカメラの動作] | 低いサイドトラッキングのミディアムショットは、キツネのペースで追跡し、キツネが停止すると落ち着きます。 |
| 一貫した世界を設定する | [環境] + [光] + [1 つの視覚処理] + [物理的な雰囲気] | ブルーアワーの静かな田舎道、毛皮に当たる冷たい逆光、自然主義的なドキュメンタリーの質感、風になびくゆるい雪。 |
| 結果を守る | [重要なサウンド (利用可能な場合) + [2 つまたは 3 つの観察可能な制約] | オーディオ有効モードの場合: 柔らかな足音と冬の風。キツネは1匹のみ、脚の数は安定しており、突然のカットやカメラロールはありません。 |
現在の Topview サンプルは、1 行のアクションから詳細なショット プランまで多岐にわたります。目的のイベントを読み取り可能にする最も単純なパターンを使用してください。
| 目的 | プロンプトパターン | 記述例 |
|---|---|---|
| ソース画像をアニメーション化する | 既存の主題を固定する → 動き始めるものを記述する → 拘束された最終状態を定義する | 提示されたポートレートから始める。彼女は窓へ視線を上げ、静かに息を吸い、かすかな笑顔で終える。構図と服装は認識できる状態を保つ。 |
| 単一のアクションをステージングする | 初期位置 → 方向と重みでワンアクション → クリア完了 | 自転車の人物が画面右から入り、濡れた舗装路で説得力のある勢いを保ちながらブレーキをかけ、片足を着き、売店の横で完全に停止する。 |
| 変換を表示する | 安定した開始フォーム → 目に見える変形メカニズム → 完成フォームとホールド | 紙の鳥は折り目に沿って展開し、小さな機械のツバメになります。真鍮のジョイントが所定の位置にロックされ、翼が一度開き、完成した形がテーブルに固定されます。 |
| 短い物語の弧を構築する | 確立→トリガー→反応またはペイオフ、ビートごとに 1 つのメイン イベント | 空いたプラットフォームでワイドスタート。スーツケースが勝手に転がって見えてきます。待っていた車掌はそれに気づき、一度後ずさりし、カメラは彼の反応で終わる。 |
| 製品の発表を指示する | プロダクトアンカー → 制御されたマテリアルモーション → 読み取り可能なヒーロー状態 | ターンテーブルが 4 分の 1 回転する間に、結露のリボンが変化のないボトルを伝っていきます。ラベルはきれいな中央のヒーロー フレームでカメラに向かって仕上げられます。 |
ショットで何を見せる必要があるかに応じて、カメラ表現を選びます。通常は、複数の動きを同時に重ねるより、明確なカメラ動作を1つだけ指定するほうが評価しやすくなります。
| 目的 | プロンプトパターン | 記述例 |
|---|---|---|
| 感情を明らかにする | 安定したミディアムショット → ゆっくり押し込む → 密着手前で停止 | 目の高さでのミディアムショット。ランナーがアナウンスを聞くとゆっくりと押し込み、彼女の抑制された反応で終了します。 |
| 動きに従う | 被写体の速度と一貫した画面方向での側面または背面の追跡ショット | 腰の高さのサイドトラッキングショットは、左から右に動くスケートボーダーを追っています。顔を左上 3 分の 1 付近に保ちます。 |
| 形式またはスケールを表示する | 詳細をクローズアップまたはローアングル → 制御された軌道またはプルバック → より広いコンテキスト | 探査機の車輪に乗り始めて赤い砂ぼこりに押し込み、ゆっくりと後退して、峡谷の壁の下に車両だけが現れるようにします。 |
| 根拠のあるリアリズムを作成する | 固定カメラまたは軽い手持ち撮影 + 具体的な揺らぎ + 動きの制限 | 固定した街路カメラ。バスが前景を横切る間だけオートフォーカスが緩やかに戻り、ピントが合った後はズームも手ぶれも起こさない。 |
| 空間的連続性を守る | 入口、進行方向、アイライン、最終画面位置を宣言 | マグカップは左から入り、中央のフレームで一度捕まり、その後完全に右に出ます。手は空で終わります。 |
見たり聞いたりできる物理的な詳細を使用します。音声指示は、選択したモードでサポートされている場合にのみ有効であり、すべての出力を確認する必要があります。
| 目的 | プロンプトパターン | 記述例 |
|---|---|---|
| 雰囲気を可視化する | [天気または粒子] + [被写体や光に対する反応] | 店頭のライトに細かい雨の筋が入り、各段の下で水しぶきがかかり、霧にならずにジャケットに玉がつきます。 |
| 照明の一貫性を保つ | [キー光源] + [方向] + [表面応答] + [連続性ルール] | 暖かい窓の光がカメラの左側に留まり、ガラス上に 1 つの安定した縁が形成され、金属キャップ全体に柔らかな反射が生じます。 |
| 短い会話を書く | [指定された発言者] は [配信] で「[正確な行]」と言っています。 [リスナーまたはカメラの動作] | オーディオ有効モードでは、ニアは静かに笑顔もせずに「電気をつけっぱなしにしてください」と言います。ロックされたツーショットではリスナーは沈黙したままです。 |
| サウンドとアクションを同期させる | [指定した話者]が「[正確なセリフ]」を[話し方]で言う + [聞き手またはカメラの動作] | 音声対応モードでは、ニアが笑わず静かに「電気はつけたままにして」と言う。固定したツーショットの中で、聞き手は黙ったまま。 |
| 信頼できる物理学をリクエストする | [重量、接触、運動量、または材料の挙動] + [観察可能な故障の除外] | 重い箱は着地時に濡れた土を圧縮し、わずか数センチ滑って止まります。バウンス、フローティング、クレートの複製、寸法の変更はありません。 |
劇的なカメラの動き、素晴らしいサウンド、豊富なアクションを使用して、映画のようにリアルな方法で自転車配達員をアニメーション化します。
アップロードしたフレームを視覚的な基準にする、短い9:16の画像ベースのストリートシーン。同じ自転車配達員、黄色いレインジャケット、黒いヘルメット、カーゴバッグ、赤い自転車を識別できる状態で保つ。街路と同じ高さから撮る1つの連続ショット。配達員が左肩越しに振り返る固定のミディアムワイドから始める。その後、自転車が一定の速度で画面右から左へ進み、カメラは滑らかなサイドトラッキングを開始する。配達伝票がカーゴバッグから滑り落ちる。配達員は一度ブレーキをかけ、濡れた路面に左足を着き、手を伸ばして伝票を拾う。自転車が完全に停止し、何も持っていなかった右手に伝票が見える状態で終える。曇りの午後、店先の柔らかな反射、小雨、自然なタイヤの水しぶき、説得力のある重さと制動の勢い。音声対応モードの場合:静かな交通音、布に当たる雨音、ブレーキのきしみを1回、音楽とセリフはなし。画面内の進行方向と自転車の比率を維持する。カット、カメラロール、追加の配達員、重複した車輪、浮く伝票、衣装変更はなし。
弱いプロンプトは気分に名前を付けますが、読み取り可能なイベント、カメラ パス、サウンド キュー、または終了状態を識別しません。より強力なバージョンでは、アイデアが 1 つのレビュー可能なアクション アークに変換され、ソース フレームに制限された役割が与えられ、1 つの画面方向が保持され、単一の動機付けられた追跡動作が使用され、接触と勢いが記述され、オーディオ対応モードでのみ適用されるサウンドが定義されます。その制約は、完璧なリアリズムを約束したり、一般的なネガティブ リストを追加したりするのではなく、この特定のショットを壊すような失敗をターゲットにしています。
具体的な動作を1つ加え、その方向または速度と、明確な終了状態を指定します。画像ベースのワークフローでは、開始フレームの後に何が変化するかを中心に書きます。
観察可能なショット サイズと動き (ゆっくりとした押し込み、ロックされたローアングル、サイド トラックなど) を選択し、それによって何が明らかにされるかを言います。
主要なアクションの流れを1つだけ残します。複数の場所や大きな動作が必要なら、別々に生成するか、少数の時系列ビートに分けてください。
ビートごとに 1 つのメイン カメラ動作を使用します。パン、プルバック、または角度の変更は、新しい情報が追加されるまで予約してください。
重さ、接触、運動量、素材の反応、環境との相互作用を説明し、生成後に問題となる具体的な破綻がないか確認します。
まず、選択したTopviewモードが必要な音声入力または生成に対応しているか確認します。セリフは短くし、話者と話し方を指定して、生成後に同期を確認してください。
顔、服装、商品の形状、小道具の数、光の方向、画面内の進行方向など、重要な可視要素だけを具体的に列挙します。ただし、結果を保証する表現は避けてください。
意図したアクションを積極的に説明し、余分なオブジェクト、不要なカット、製品の形状の変更など、シーン固有のいくつかの失敗だけを除外します。
適切なプロンプトは、被写体、判読可能な 1 つのアクション、カメラがそれを観察する方法、および意図された環境または仕上げを特定します。サウンドと制約は、選択したモードとコンセプトにとって重要な場合にのみ追加してください。明確な制作上の決定は、品質に関する形容詞の長い文字列よりも役立ちます。
はい。現在のTopviewの例には、被写体と1つの動作だけで構成されたものも多くあります。アイデアが単純な場合や、ソース画像ですでに構図が決まっている場合は、簡潔なプロンプトが適しています。方向、タイミング、カメラ、雰囲気、音、連続性、終了状態をさらに制御したいときだけ詳細を追加します。
あらゆるケースに通用する単語数はありません。単純な動きなら1〜2文、複雑な動作なら短く順序立てた指示を使います。重複する形容詞、矛盾するスタイル、動くもの・現れるもの・鳴るもの・安定しているべきものに影響しない指示は削除してください。
テキストからビデオへの変換には、主題とシーンを確立するのに十分な説明が必要です。画像からビデオへの変換では、開始フレームを視覚的なアンカーとして使用できるため、プロンプトはモーション、カメラ、雰囲気、サウンド、および認識しておきたい詳細に集中する必要があります。利用可能な入力は、選択した Topview モードによって異なります。
順序とペースがあいまいになる場合は、タイムスタンプまたは番号付きビートを使用します。 1 つの連続したアクションの場合、通常、開始、進行、終了の状態がより明確になります。複数のカットでは連続性の要求が高まるため、各シーンに独自のセットアップが必要な場合は、より大きなアイデアを個別のクリップに分割します。
ロック ショット、クローズアップ、ワイド ショット、スロー プッシュイン、プルバック、パン、オービット、サイド トラック、手持ちフォロー、POV、ローアングルなどのおなじみの指示から始めます。主要な動きを 1 つ選択し、それを観客が注目すべきことに結び付けます。
選択した Topview モードがオーディオをサポートしている場合は、短い正確なダイアログを作成し、話者と発言を特定し、スピーチを雰囲気、効果、音楽から分離します。目に見えるアクションに重要な音の合図を付けて、それが正確であると仮定するのではなく、リップシンクとタイミングを確認します。
観察可能な物理学を説明します。つまり、重りがどこに着地するか、何が地面に接触するか、運動量がどのように吸収されるか、布地や粒子がどのように反応するか、対象がどのような状態になるかなどです。アクションの負荷を管理しやすい状態に保ち、生成後に接触、比率、およびオブジェクトの数を評価します。
明確なソースフレームまたは被写体の基準を使い、最も重要な可視要素だけを繰り返し、不必要なカットやスタイル変更を減らし、商品の形状や服装の説明を安定させます。これらは指示の精度を高めますが、すべてのフレームで細部が完全に同一になることを保証するものではありません。
意図したアクション、フレーム、素材、最終状態についての明確な指示から始めます。次に、そのシーンの目に見えるリスクに関連する除外をいくつか追加します。別のネガティブ プロンプト フィールドが使用できるかどうかは、選択した Topview ワークフローによって異なります。
このガイドの作成方法
このガイドは、2026 年 8 月 17 日にレビューされた Topview プロンプト ライブラリ内の 1,188 個の Grok Imagine レコードのスナップショットを編集的に統合したものです。そのスナップショット内のすべてのレコードはビデオ生成として分類されました。空ではないプロンプトの約 10 件中 7 件では、40 単語以下が使用されていましたが、より長いサンプルでは、コンセプトにさらなる制御が必要な場合、カメラまたはショットの方向、順序付けられたビート、ダイアログまたはサウンド、保存言語、およびシーン固有のリアリズムの制約が追加されました。この構造は、画像主導のモーション、カメラ、ペーシング、雰囲気、物理学、サウンド デザイン、現在の Video 1.5 オーディオ機能を説明する公式の xAI 資料に加えて、プロンプトの長さ、モーション動詞、カメラの語彙、使用例、間違い、FAQ をカバーする公開 Grok Imagine ガイドと照合してチェックされました。上記のすべての式と例は、Topview 用に最初から作成されました。公式 1.5 資料は、一般的な語彙を検証するために使用されたものであり、すべての Topview Grok Imagine モードが同じ入力または動作を公開すると主張するものではありません。これらの推奨事項は出発点であり、プロンプトが個別にテストされたこと、または実行のたびに同じアイデンティティ、ダイアログ、サウンド、またはモーションが再現されることを保証するものではありません。