
WAN 3.0 AI 视频 生成器
让每个创意都有足够空间成长为完整故事。通过文本、图片、视频、音频、文档和网页原生生成 30 秒视频,以多模态参考精准控制每一处关键细节。
看看 WAN 3.0 能承载怎样的故事
6 个能力向案例,展示 Wan 3.0 如何承载完整叙事、细腻表演、高强度动作与多样视觉风格,而不只是生成彼此割裂的动态镜头。

机器人遇见春天
伤痕累累的机器人走过被自然重新占领的废墟,在樱花树下发现一朵小花。环境、尺度与情绪共同讲述这个安静的故事。
制作一部科幻短片:一个伤痕累累的机器人在鲜花与樱花覆盖的战争废墟中发现春天之美。

她得知真相的那一刻
一名遭到背叛的女性默默拼凑事实,随后直面责任人。紧凑特写、克制表演与精准光影让揭晓成为完整的戏剧节点。
制作一部真人复仇短剧,从女性发现真相开始,逐步推进到冷静而有力的对峙。

每个动作都充满冲击
动态跟拍、快速甩镜、悬停式冲击瞬间与清晰收势,让打斗呈现出编排严密的动作片节奏与力量。
制作一段高能打斗场面,运用动态跟拍、快速甩镜、慢动作冲击和干净利落的英雄式收尾。

最后一记剑击
孤独剑士蓄积力量,释放决定性一击并击败魔王。情节先累积紧张感,再以魔法冲击和胜利结局完成释放。
制作一段日式动漫场景:孤独剑士对魔王释放最终奥义。

温柔的睡前冒险
一只柔软的羊毛毡兔子探索明亮的微缩花园。手工质感、温暖色彩与轻柔动作,让画面像一本被唤醒的儿童绘本。
制作一段温暖的羊毛毡儿童绘本视频,采用柔和手作质感,并以好奇的小兔子为主角。

一个值得进入的世界
英雄肖像、重甲敌人、世界观镜头与战斗瞬间共同组成电影感概念预告,在最终揭晓前完整介绍游戏。
制作一支奇幻动作游戏 CG 预告,展现世界、主角、强敌、史诗战斗与戏剧化最终揭晓。
WAN 3.0 是什么?
Wan 3.0 是面向完整叙事而非孤立短片的多模态 AI 视频模型。它提供最长 30 秒的原生叙事空间,在文本之外接收视觉与音频参考,并通过文档和网页扩展创作上下文。你可以在同一工作流中统一控制故事、角色与品牌身份、风格、声音、结构化数字信息和节奏。
五项能力塑造全新创作体验
- 原生 30 秒生成,为开场、转场、演示和结尾留出完整空间。
- 智能时长根据创意简报所需空间决定节奏,不再把每个想法压进固定长度。
- 全能参考在一条指令中组合图片、文本、视频、音频、文档和网页信息。
- 超写实世界渲染覆盖人物、材质、光影、表演、空间和同步声音。
- 像素级一致性让角色身份、道具、UI、音频和空间关系在整段视频中保持对齐。
突破短片限制的五次跃升
每项能力都进一步扩展 Wan 3.0 视频能够表达、保留并让观众感受到的内容。
为完整故事留出更多时间
当创意需要开场、发展、转场与结尾时,使用原生 30 秒生成。智能时长可根据简报的信息密度匹配篇幅,让解说、广告与剧情场景拥有自然呼吸感。

万物皆可成为视频参考
使用图片、文本、视频与音频四种核心模态指导 Wan 3.0,再加入文档或网页提供结构化上下文。将它们组合进一条指令,让模型不仅理解成片应该是什么样,也理解必须传达什么。

重建现实与数字世界
真实呈现皮肤、材质、光线、动作、声音与环境,同时精准表现软件 UI、字体、动画及其他结构化数字信息。Wan 3.0 将身临其境的真实感与准确的数字叙事连接起来。

保留的不只是神似
让角色、产品、道具、声音、地点、构图逻辑和空间关系与参考内容稳定对齐。目标不是“差不多像”,而是让整段视频始终忠于观众真正会注意到的细节。

让每个镜头更有戏
同时增强动作、声音、表演、镜头能量、节奏和剧情。视频不止拥有可信的运动,还能完成揭晓、累积张力、承载表演并留下情绪余韵。

从源素材到完整成片
当创意不只来自一句提示词,成片还需要经得起真实制作审核时,在 Topview 中使用 Wan 3.0。

文档转视频解说
将产品简报、提案、教案或报告转化为节奏清晰的视觉解说。用文档定义事实与层级,再加入图片、UI、角色和音频参考完成呈现。

网页转视频营销内容
以网页作为发布影片或社交广告的创作上下文,在转化为动态内容时保留产品语言、视觉体系、界面结构和关键信息。

参考锁定的故事世界
组合角色、场景、道具、声音、音乐和分镜,构建连续叙事。为不同营销版本复用同一套参考素材,而不丢失已经建立的世界。
谁适合使用 WAN 3.0?
Wan 3.0 适合需要更大叙事空间、更严格参考控制,并希望画面与声音形成更强联系的团队。
影视创作者与预演团队
编排完整剧情节点、探索镜头语言、测试表演,并在正式拍摄前清晰传达场景设想。
品牌与产品营销团队
让产品、字体、界面细节与营销风格在发布影片、广告和不同比例版本中始终清晰可识别。
创意代理机构
将客户提案、网站、品牌参考、声音与分镜组合成可审核的视频方向,无需手动重建整份简报。
游戏与世界观创作者
快速验证环境、角色互动、UI 叠加层和剧情时刻,同时保持世界的空间逻辑。
教育与产品团队
将文档、软件流程和结构化信息转化为节奏更清晰、数字细节更准确的视觉解说。
音乐与表演创作者
围绕曲目、声音、节奏和表演参考展开创作,让剪辑真正由声音驱动,而不是后期附加。
如何在线创作 WAN 3.0 视频

输入提示词
描述视频创意,包括主体、场景、视觉风格、动作、镜头方向、声音和目标时长。

生成视频
检查可编辑指令与单张参考图片,选择输出设置,然后启动 Wan 3.0 生成流程。

审核并导出
检查动作与参考一致性,再将最佳结果导出,用于广告、社交内容、产品视频或创意项目。
WAN 3.0 提示词示例
30 秒产品发布片
使用 Product、Presenter、UI 和 BrandDeck 制作一支 30 秒发布影片。以富有触感的微距揭晓开场,展示出镜者在日光摄影棚中使用产品,转入清晰可读的界面演示,最后以准确的产品轮廓和指定声音标志收尾。每个镜头都要保持几何形态、颜色、标签、面部身份和空间朝向一致。
数字世界解说
将 Webpage 和 WorkflowDocument 转化为简洁的软件解说视频。准确重建界面层级,保持标签可读,在不改变数值的前提下为图表添加动画,并以平静旁白、细腻光标运动和统一的 16:9 构图引导观众完成三项任务。
超写实故事序列
使用 Character、Compartment、Prop 和 Voice 制作一段 30 秒夜行列车故事。在建立镜头、两个对白特写、走廊跟拍与最终揭晓中,保持演员面容、外套、银色箱子、车厢布局和声线一致。为表演叠加真实的列车震动、雨声和克制配乐。
WAN 3.0 创作参数
Topview 工作流所呈现的输入、控制项与输出选项实用概览。
最长 30 秒
(以下为预测信息,不代表实际模型参数)针对明确交付选择固定时长,或让智能时长根据简报内容决定节奏。
文本 · 图片 · 视频 · 音频
组合四种基础模态,无需将所有创作方向都塞进一条提示词。
文档 · 网页
将结构化源素材带入解说、营销活动和信息密集型视频简报。
全能 · 图片 · 文本
根据已有源素材选择合适的创作工作流。
1080P · 720P
选择适合审核、社交媒体、演示或制作流程的输出规格。
16:9 · 9:16 · 1:1 · 4:3 · 3:4
适配横屏、竖屏、方形、编辑排版和社交媒体场景。
身份 · 道具 · 空间
用参考素材保护让主体或场景保持可识别的关键细节。
UI · 文字 · 动画
精准指导产品演示与解说中的结构化数字信息。
人声 · 音乐 · 音效
通过音频参考指导表演、节奏、氛围和视听同步。
镜头级指令
在一份创意简报中描述镜头、动作、表演、节奏、声音和连续性约束。
给下一个创意完整的 30 秒
带上定义创意的提示词、参考素材、文档、网页和声音。Wan 3.0 提供足够的空间与控制力,将它们变成完整的视听故事。
使用 Topview 积分开始创作。模型可用性与积分消耗以产品工作流中的实时显示为准。
