Pegasus Journey of the Forgotten
A metaphorical prompt depicting forgotten impoverished people transformed into royalty, riding pegasi to a castle.
1,523 prompts
A metaphorical prompt depicting forgotten impoverished people transformed into royalty, riding pegasi to a castle.
A cinematic visual sequence showing the crescent moon and Mars appearing close together in the sky at dawn.
A conceptual video prompt depicting photons transforming negative emotions like fear and pain into love and happiness.
A highly detailed cinematic video prompt for a 15-second sequence of a woman discovering a flickering warm light in a rainforest.
A peaceful prompt depicting a full moon hanging over rolling hills and a shimmering lake.
A cinematic video prompt depicting a subject walking forward as a Starship rocket launches behind a mountain range in the background.
A cinematic and melancholic video prompt depicting a little girl sitting inside a giant rusty pocket watch in the desert.
A cinematic wide-angle shot of a massive, rusty industrial pipe spanning a valley with a lone figure walking atop it.
A high-resolution sci-fi prompt for generating a disc-shaped mothership with volumetric lighting effects.
A prompt for creating a 10-second, 9:16 vertical cinematic 3D cartoon video.
A highly detailed multi-shot video prompt with specific timestamps for creating a samurai duel scene in the rain.
A realistic portrait video of a woman in a black lace top standing by a window in natural side lighting.
An animation prompt for Grok-imagine designed to animate a puppy photo, showing it raising a paw as if hailing a taxi.
A detailed cinematic video prompt depicting a victorious gladiator in glowing cyborg armor captured in a dramatic orbital shot.
A detailed animation prompt of a tabby cat in an eggshell, featuring realistic meowing and dust particles in sunlight.
A cinematic and atmospheric photograph depicting a woman sitting on a semi-submerged plane wreck in a stormy ocean.
A cinematic and melancholic video prompt featuring an old woman on an abandoned train platform.
A cinematic video prompt for a miniature world rescue mission, featuring detailed environmental elements and realistic action.
A cinematic video prompt for a giant transforming robot, featuring detailed mechanical parts, sparks, and slow-motion effects.
A detailed cinematic prompt for Grok Imagine featuring a soot-covered female miner in a dark tunnel, focusing on the dramatic lighting as her eyes turn into burning amber.
A poetic video prompt capturing a woman taking a deep breath among roses under warm sunlight and falling petals.
A detailed video generation prompt visualizing a future Mars city built by Tesla's Optimus robots under Elon Musk's vision.
A cinematic video prompt describing a man walking through a lush greenhouse filled with glowing plants at night.
An advanced video generation prompt designed to transform static images into 15-second suspenseful cinematic sequences with precise timing and character movement.
최종 검토: 2026년 8월 17일 · 현재 Topview 샘플과 공개 프롬프팅 자료를 편집해 정리
빠른 답변
Grok Imagine 영상 프롬프트는 간결해도 좋습니다. 피사체를 분명히 정하고, 화면에서 읽히는 동작 하나와 카메라가 그 동작을 관찰하는 방식을 적으세요. 환경, 조명, 시각 표현, 대사, 사운드, 제약 조건은 각각이 실제 제작 결정을 명확하게 할 때만 추가합니다. 이미지 기반 워크플로에서는 소스 프레임을 시각적 기준으로 삼고, 무엇이 움직여야 하는지, 무엇을 알아볼 수 있게 유지해야 하는지, 동작이 어디에서 끝나는지를 설명하세요. 복잡한 클립은 관련 없는 사건을 한 문장에 쌓기보다 두세 개의 짧은 비트를 시간순으로 배열합니다. 자연어로 충분하며, '돌아선다', '받는다', '따라간다', '뒤로 빠진다' 같은 구체적인 동사가 '서사적', '역동적' 같은 추상적 표현보다 지시하기 쉽습니다. 선택한 Topview 모드가 오디오나 대사 생성을 제공한다면 화자, 정확한 대사, 말투, 환경음, 효과음을 구분해 적으세요. 마지막으로 눈으로 확인할 수 있는 현실감 제약을 소수 추가하고, 피사체 변화, 움직임, 구도, 물리 표현, 음성, 마지막 프레임을 검토합니다. 프롬프트를 명확하게 쓰면 지시력은 높아지지만 매번 동일한 인물, 립싱크, 소리, 물리적으로 완벽한 움직임을 보장하지는 않습니다.
[출력 컨텍스트] + [주제 또는 소스 프레임 앵커] + [주요 동작 또는 짧은 비트] + [샷 및 카메라] + [환경, 조명 및 스타일] + [사용 가능한 경우 대화 및 사운드] + [연속성 및 사실성 제약]
구성이나 속도에 영향을 미치는 경우 의도한 형식, 방향 및 클립 목적의 이름을 지정합니다. 선택한 워크플로에 해당 컨트롤이 표시되면 제품 설정에서 해상도와 지속 시간을 유지하세요.
시청자가 따라야 할 사람, 제품, 동물, 차량 또는 환경을 정의하세요. 이미지 기반 작업 흐름에서는 모든 픽셀을 다시 설명하지 않고도 어떤 눈에 보이는 세부 사항을 계속 인식할 수 있는지 말해보세요.
구체적인 동작 동사와 명확한 방향, 속도 또는 최종 상태를 사용하십시오. 시퀀스의 경우 발생해야 하는 순서대로 소수의 작업을 배열합니다.
샷 크기, 시점, 동기 부여된 카메라 이동 하나를 선택하세요. 영화적인 용어를 쌓는 대신 움직임이 무엇을 드러내는지 설명하십시오.
날씨, 분위기, 조명 방향, 팔레트 및 작업을 지원하는 하나의 일관된 캡처 언어를 추가합니다.
선택한 Topview 모드에서 오디오를 사용할 수 있는 경우 분위기, 효과 및 음악에서 정확한 음성을 분리한 다음 중요한 사운드를 눈에 보이는 이벤트에 연결하세요.
변경될 경우 아이디어를 눈에 띄게 깨뜨릴 수 있는 몇 가지 세부 사항, 화면 방향, 개체 상태 또는 물리적 결과의 이름을 지정하세요.
아이디어를 전달하는 가장 작은 명령부터 시작한 다음, 모호함으로 인해 결과가 바뀔 수 있는 부분에만 제어를 추가하세요. 대부분의 클립에는 모든 레이어가 필요하지 않습니다.
| 목표 | 프롬프트 패턴 | 예시 문구 |
|---|---|---|
| 핵심 아이디어 포착 | [피사체] + [눈에 보이는 동작 하나] | 붉은 여우가 눈 덮인 시골길을 빠르게 횡단하고 있습니다. |
| 모션을 명확하게 | [주제] + [행동 방향, 속도, 종료 상태] | 붉은 여우는 왼쪽 프레임에서 오른쪽 프레임으로 빠르게 이동하다가 타이어 자국에서 속도를 늦춘 다음 멈춰서 귀를 기울입니다. |
| 시청자에게 직접 안내 | [액션] + [샷 크기] + [하나의 카메라 동작] | 낮은 측면 추적 미디엄 샷은 여우의 속도에 맞춰 따라갔다가 여우가 멈추면 안정됩니다. |
| 일관된 세상을 설정하세요 | [환경] + [빛] + [하나의 시각적 처리] + [물리적 분위기] | 푸른 시간의 조용한 시골길, 모피에 비치는 차가운 역광, 자연주의적인 다큐멘터리 질감, 바람에 흔들리는 느슨한 눈. |
| 결과를 보호하세요 | [사용 가능한 경우 중요한 소리] + [두세 가지 관찰 가능한 제약 조건] | 오디오 활성화 모드의 경우: 부드러운 발소리와 겨울 바람. 여우 한 마리만 있고 다리 수는 안정적이며 갑작스러운 절단이나 카메라 롤은 없습니다. |
현재 Topview 샘플은 한 줄 동작부터 세부 샷 계획까지 다양합니다. 의도한 이벤트를 읽을 수 있게 만드는 가장 간단한 패턴을 사용하십시오.
| 목표 | 프롬프트 패턴 | 예시 문구 |
|---|
드라마틱한 카메라 움직임, 뛰어난 사운드, 다양한 액션을 통해 영화처럼 사실적인 방식으로 자전거 배달원을 애니메이션화해 보세요.
업로드한 프레임을 시각적 기준으로 사용하는 짧은 9:16 이미지 기반 거리 장면. 같은 자전거 배달원, 노란색 비옷, 검은색 헬멧, 화물 가방, 빨간색 자전거를 알아볼 수 있게 유지한다. 거리 눈높이에서 촬영한 하나의 연속 숏. 배달원이 왼쪽 어깨 너머를 돌아보는 고정 미디엄 와이드로 시작한다. 이어 자전거가 일정한 속도로 화면 오른쪽에서 왼쪽으로 이동하고, 카메라는 부드러운 측면 트래킹을 시작한다. 배송 영수증 한 장이 화물 가방에서 미끄러져 나온다. 배달원은 한 번 브레이크를 잡고 젖은 노면에 왼발을 디딘 뒤 몸을 숙여 영수증을 집는다. 자전거가 완전히 멈추고, 비어 있던 오른손에 영수증이 보이는 상태로 끝낸다. 흐린 오후, 매장 전면의 부드러운 반사, 가벼운 비, 자연스러운 타이어 물보라, 설득력 있는 무게감과 제동 관성. 오디오 지원 모드라면 조용한 교통음, 옷감에 닿는 빗소리, 브레이크가 한 번 삐걱거리는 소리, 음악과 대사는 없음. 화면 진행 방향과 자전거 비율을 유지한다. 컷, 카메라 롤, 추가 인물, 중복 바퀴, 공중에 뜨는 영수증, 의상 변경은 없음.
약한 프롬프트는 분위기를 명명하지만 읽을 수 있는 이벤트, 카메라 경로, 사운드 큐 또는 완료 상태를 식별하지 않습니다. 더 강력한 버전은 아이디어를 검토 가능한 하나의 액션 아크로 바꾸고, 소스 프레임에 제한된 역할을 부여하고, 하나의 화면 방향을 유지하고, 동기가 부여된 단일 추적 이동을 사용하고, 접촉 및 추진력을 설명하고, 오디오 지원 모드에서만 적용되는 사운드를 정의합니다. 제약 조건은 완벽한 현실감을 약속하거나 일반적인 네거티브 목록을 추가하는 대신 이 특정 장면을 깨뜨릴 수 있는 실패를 목표로 합니다.
구체적인 동작 하나와 그 방향 또는 속도, 명확한 종료 상태를 추가하세요. 이미지 기반 워크플로에서는 시작 프레임 이후 무엇이 달라지는지에 집중합니다.
관찰 가능한 샷 크기를 선택하고 느린 푸시인, 잠긴 낮은 각도 또는 사이드 트랙과 같은 움직임을 선택하고 그것이 무엇을 드러내야 하는지 말하십시오.
주요 액션 흐름 하나만 유지하세요. 여러 장소나 큰 동작이 필요하다면 별도로 생성하거나 소수의 시간순 비트로 나눕니다.
비트당 하나의 기본 카메라 동작을 사용합니다. 새로운 정보가 추가되는 순간을 위해 팬, 풀백 또는 각도 변경을 예약하세요.
무게, 접촉, 운동량, 재질의 반응, 환경과의 상호작용을 설명한 뒤 생성 결과에서 문제가 되는 구체적인 물리적 오류를 확인하세요.
먼저 선택한 Topview 모드가 필요한 오디오 입력 또는 생성을 지원하는지 확인하세요. 대사는 짧게 유지하고 화자와 말투를 지정한 뒤, 생성 후 동기화를 검토합니다.
얼굴, 의상, 제품 형태, 소품 수, 조명 방향, 화면 진행 방향처럼 중요한 시각적 불변 요소만 구체적으로 나열하세요. 결과를 보장하는 표현은 피합니다.
의도한 동작을 긍정적으로 설명하고, 추가 개체, 원치 않는 절단, 제품 모양 변경 등 장면별 몇 가지 오류만 제외합니다.
좋은 프롬프트는 피사체, 읽을 수 있는 하나의 동작, 카메라가 이를 관찰하는 방법, 의도한 환경 또는 마무리를 식별합니다. 선택한 모드와 컨셉에 중요한 경우에만 사운드와 제약 조건을 추가하세요. 명확한 생산 결정은 긴 품질 형용사보다 더 유용합니다.
네. 현재 Topview 예시 중에는 피사체와 동작 하나만으로 구성된 프롬프트도 많습니다. 아이디어가 단순하거나 소스 이미지가 이미 구도를 정했다면 간결한 프롬프트가 적합합니다. 방향, 타이밍, 카메라, 분위기, 사운드, 연속성 또는 최종 상태를 더 제어해야 할 때만 세부 정보를 추가하세요.
모든 경우에 통하는 단어 수는 없습니다. 단순한 움직임에는 한두 문장, 복잡한 동작에는 짧고 순서가 분명한 지시를 사용하세요. 반복되는 형용사, 서로 충돌하는 스타일, 움직이거나 나타나거나 들리거나 안정적으로 유지되어야 할 요소에 영향을 주지 않는 지시는 삭제합니다.
텍스트-투-비디오는 피사체와 장면을 세울 만큼 충분한 설명이 필요합니다. 이미지-투-비디오는 시작 프레임을 시각적 기준으로 사용할 수 있으므로 움직임, 카메라, 분위기, 사운드, 그리고 알아볼 수 있게 유지할 세부 요소에 집중하세요. 사용할 수 있는 입력은 선택한 Topview 모드에 따라 달라집니다.
순서와 속도가 모호할 경우 타임스탬프나 번호가 매겨진 비트를 사용하세요. 하나의 연속 작업의 경우 일반적으로 시작, 진행 및 종료 상태가 더 명확합니다. 다중 컷은 연속성 요구를 증가시키므로 각 장면에 자체 설정이 필요할 때 더 큰 아이디어를 별도의 클립으로 분할합니다.
고정 샷, 클로즈업, 와이드 샷, 느린 푸시인, 풀백, 팬, 궤도, 사이드 트랙, 핸드헬드 팔로우, POV 또는 로우 앵글과 같은 친숙한 지침으로 시작하세요. 주요 동작 하나를 선택하고 청중이 주목해야 할 내용과 연결하세요.
이 가이드의 작성 방법
이 가이드는 2026년 8월 17일에 검토된 Topview 프롬프트 라이브러리에 있는 1,188개의 Grok Imagine 레코드 스냅샷을 편집하여 종합한 것입니다. 해당 스냅샷의 모든 기록은 영상 생성으로 분류되었습니다. 비어 있지 않은 프롬프트 10개 중 약 7개는 40단어 이하를 사용했으며, 더 긴 예시에서는 개념에 더 많은 제어가 필요할 때 카메라 또는 샷 방향, 순서 있는 비트, 대화 또는 사운드, 보존 언어, 장면별 사실성 제약 조건을 추가했습니다. 또한 이미지 기반 동작, 카메라, 속도, 분위기, 물리학, 사운드 디자인 및 현재 Video 1.5 오디오 기능을 설명하는 공식 xAI 자료와 프롬프트 길이, 동작 동사, 카메라 어휘, 사용 사례 예, 실수 및 FAQ를 다루는 공개 Grok Imagine 가이드와 비교하여 구조를 확인했습니다. 위의 모든 공식과 예는 Topview에 대해 처음부터 작성되었습니다. 공식 1.5 자료는 모든 Topview Grok Imagine 모드가 동일한 입력 또는 동작을 노출한다고 주장하는 것이 아니라 일반적인 어휘를 검증하는 데 사용되었습니다. 이러한 권장 사항은 시작점일 뿐 프롬프트가 독립적으로 테스트되었거나 실행될 때마다 동일한 ID, 대화, 사운드 또는 모션이 재현된다는 보장은 없습니다.
| 소스 이미지에 애니메이션 적용 | 기존 주제를 고정 → 움직이기 시작하는 것을 설명 → 제한된 최종 상태 정의 | 제공된 인물 사진에서 시작한다. 그녀는 창문 쪽으로 시선을 들고 조용히 숨을 들이쉰 뒤 옅은 미소로 끝낸다. 구도와 의상은 알아볼 수 있게 유지한다. |
|---|
| 단일 작업 준비 | 초기 위치 → 방향과 무게로 한번의 동작 → 클리어 완료 | 자전거 운전자는 오른쪽 프레임에서 진입하여 믿을 수 없을 만큼 힘차게 젖은 포장도로에 브레이크를 밟고 한 발을 딛고 키오스크 옆에 완전히 멈춥니다. |
|---|
| 변신을 보여줘 | 안정적인 시작 형태 → 눈에 띄는 변형 메커니즘 → 완성된 형태 및 유지 | 종이새는 주름을 따라 작은 기계 제비로 변합니다. 황동 조인트가 제자리에 고정되고 날개가 한 번 열리며 완성된 형태가 테이블에 고정됩니다. |
|---|
| 짧은 내러티브 아크 구축 | 비트당 하나의 메인 이벤트로 설정 → 트리거 → 반응 또는 보상 | 빈 플랫폼에서 넓게 시작하십시오. 여행가방이 저절로 굴러 들어옵니다. 기다리고 있던 차장이 그것을 알아채고 한 번 뒤로 물러나자 카메라는 그의 반응을 끝냅니다. |
|---|
| 직접 제품 공개 | 제품 앵커 → 제어된 머티리얼 모션 → 판독 가능한 히어로 상태 | 턴테이블이 1/4바퀴 회전하는 동안 응축 리본이 변경되지 않은 병 아래로 이동합니다. 라벨은 깔끔하게 중앙에 위치한 히어로 프레임에서 카메라를 향하여 마감됩니다. |
|---|
숏에서 반드시 보여 줘야 할 정보에 맞춰 카메라 표현을 선택하세요. 여러 움직임을 동시에 겹치기보다 명확한 카메라 움직임 하나를 지정하는 편이 결과를 평가하기 쉽습니다.
| 목표 | 프롬프트 패턴 | 예시 문구 |
|---|---|---|
| 감정을 드러내다 | 안정적인 미디엄 샷 → 느린 푸시인 → 친밀한 클로즈업 전에 중지 | 눈높이에서 중간 샷; 주자가 발표를 듣고 천천히 밀어넣고 절제된 반응으로 끝납니다. |
| 움직임을 따라가세요 | 피사체 속도 + 일관된 화면 방향으로 측면 또는 후면 추적 촬영 | 허리 높이의 측면 추적 샷은 왼쪽에서 오른쪽으로 움직이는 스케이트보더를 따라갑니다. 얼굴을 왼쪽 상단 1/3 근처에 유지하세요. |
| 형태 또는 규모 표시 | 가까운 디테일 또는 낮은 각도 → 제어된 궤도 또는 풀백 → 더 넓은 맥락 | 로버 바퀴를 타고 붉은 먼지를 밟은 후 천천히 뒤로 당겨서 협곡 벽 아래에 홀로 있는 차량을 드러냅니다. |
| 근거 있는 현실감을 창조하라 | 고정 카메라 또는 가벼운 핸드헬드 + 구체적인 불완전함 + 움직임 제한 | 고정된 거리 카메라. 버스가 전경을 지날 때만 자동 초점이 부드럽게 돌아오고, 초점이 맞은 뒤에는 줌이나 카메라 흔들림이 없다. |
| 공간 연속성 보호 | 입구, 이동 방향, 시선, 최종 화면 위치 선언 | 머그는 왼쪽에서 들어가고 중앙 프레임에 한 번 잡힌 다음 완전히 오른쪽으로 나옵니다. 손은 비어 있습니다. |
보거나 들을 수 있는 물리적인 세부 사항을 사용하십시오. 오디오 지침은 선택한 모드에서 지원하는 경우에만 관련이 있으며 모든 출력은 여전히 검토가 필요합니다.
| 목표 | 프롬프트 패턴 | 예시 문구 |
|---|---|---|
| 분위기를 눈에 띄게 만들어라 | [날씨 또는 입자] + [피사체 및 빛에 반응하는 방식] | 점포 전면 조명을 통해 가는 빗줄기가 흐르고 각 계단 아래로 물이 튀며 안개가 되지 않고 재킷에 구슬이 맺힙니다. |
| 일관된 조명 유지 | [주요 광원] + [방향] + [표면 반응] + [연속성 규칙] | 따뜻한 창 빛은 카메라 왼쪽에 남아 유리에 하나의 안정적인 테두리를 만들고 금속 캡에 부드러운 반사를 만듭니다. |
| 짧은 대화 쓰기 | [명명된 화자]가 [배달]에서 "[정확한 줄]"이라고 말합니다. [청취자 또는 카메라 동작] | 오디오 활성화 모드에서 Nia는 웃지 않고 조용히 "불을 켜두세요"라고 말합니다. 청취자는 잠긴 투샷에서 침묵을 유지합니다. |
| 소리와 동작을 동기화하세요 | [지정한 화자]가 "[정확한 대사]"를 [말투]로 말한다 + [듣는 사람 또는 카메라 동작] | 오디오 지원 모드에서 니아는 웃지 않고 조용히 "불은 켜 둬"라고 말한다. 고정된 투샷에서 듣는 사람은 말없이 그대로 있다. |
| 믿을 수 있는 물리학을 요청하세요 | [무게, 접촉, 운동량 또는 재료 거동] + [관찰 가능한 실패 제외] | 무거운 상자는 착지 시 젖은 토양을 압축하고 몇 센티미터만 미끄러지다가 멈춥니다. 바운스, 플로팅, 중복된 상자 또는 크기 변경이 없습니다. |
선택한 Topview 모드가 오디오를 지원하는 경우 짧고 정확한 대화를 작성하고 화자와 전달을 식별하고 분위기, 효과 및 음악에서 음성을 분리합니다. 눈에 보이는 동작에 중요한 소리 신호를 추가하고 정확하다고 가정하기보다는 립싱크와 타이밍을 검토하세요.
눈으로 확인할 수 있는 물리 표현을 적으세요. 무게가 어디에 실리는지, 무엇이 지면에 닿는지, 운동량이 어떻게 흡수되는지, 옷감이나 입자가 어떻게 반응하는지, 피사체가 어떤 상태로 끝나는지를 설명합니다. 한 클립의 동작 수를 감당 가능한 수준으로 유지하고, 생성 후 접촉, 비율, 물체 수를 확인하세요.
명확한 소스 프레임이나 주제 앵커를 사용하고, 가장 중요한 시각적 불변 요소만 반복하고, 불필요한 컷과 스타일 변경을 제한하고, 제품 기하학이나 의상 설명을 안정적으로 유지하세요. 이러한 단계는 방향을 개선할 수 있지만 모든 프레임에서 동일한 세부정보를 보장하지는 않습니다.
의도한 작업, 구성, 재료 및 최종 상태에 대한 긍정적인 지침부터 시작하세요. 그런 다음 해당 장면의 눈에 띄는 위험과 관련된 몇 가지 제외 사항을 추가합니다. 별도의 네거티브 프롬프트 필드를 사용할 수 있는지 여부는 선택한 Topview 워크플로에 따라 다릅니다.