Wan3.0 开启公测:AI 视频生成迈向更长叙事与全能表达

发布时间:新闻资讯

图片展示的是全新一代视频生成模型Wan3.0的公测标识。背景为深蓝色,配有蓝色和紫色的粒子构成的山峦状图案,粒子在山峦间流动,营造出科技感与未来感。画面中央大字“Wan3.0”以白色和紫色呈现,“Public Beta”以白色小字居于其下。该图片位于介绍Wan3.0开启公测的文档开头,直观呈现了模型的名称和公测状态,与上下文内容相呼应。

全新一代视频生成模型 Wan3.0 已正式开启公测。相比前代模型,Wan3.0 在生成时长、多模态输入、参考一致性与真实感方面进行了全面升级,让 AI 视频不再只是生成一个镜头,而是更接近讲述一段完整故事。

Wan3.0 的核心特点包括:

  1. 支持单次生成 30 秒视频,适合更完整的剧情和镜头表达
  2. 支持智能时长推荐,可根据提示词自动匹配合适视频长度
  3. 支持文本、图片、音频、视频作为参考输入
  4. 支持 doc、xls、ppt、pdf、md 等文档格式输入
  5. 强化人物真实感,提升五官、皮肤、表情和动作细节表现
  6. 提升角色、道具、场景、声音和风格的一致性
  7. 支持视频编辑,可修改画面、剧情与台词
  8. 更适合产品演示、教学课件、品牌宣传和商业短片等生产力场景

其中,30 秒单段视频生成是 Wan3.0 的重要升级。更长的生成时长让连续运镜、一镜到底、剧情铺垫和完整叙事有了更大的发挥空间,AI 视频从“生成一个镜头”进一步走向“讲述一段故事”。

图片展示的是Wan 3.0演示片截图。画面中,一位男士坐在沙发上,背景为书架、海报等。画面下方有“Omni”界面,显示“Wan AI Lead”“根据_”“+ Media”等内容,右侧有“Wan3.0”“720P”“Smart Ratio”“5s”“+10”等选项。该图片与上下文紧密相关,直观呈现了Wan 3.0在AI视频生成方面的操作界面,体现了其在输入能力上的扩展,可读取多种文件类型,助力AI视频从“生成一个镜头”走向“讲述一段故事”。

▲Wan 3.0 演示片截图

在输入能力上,Wan3.0 不仅支持文本、图片、音频、视频等基础模态,还可以读取文档、表格、PPT、PDF 和 Markdown 文件。用户可以将产品资料、教学内容、品牌介绍或数据文档作为输入,搭配提示词生成更完整的视频内容。

与其他主流视频生成模型相比,Wan3.0 的特点不只在于画面表现,而在于更完整的信息理解与表达能力。部分模型更强调电影感、运动效果或视觉风格,而 Wan3.0 更突出长时长叙事、多格式输入、全能参考和真实世界还原能力,适合从创意短片延展到商业内容、教育内容与产品演示等多种应用。

这是Wan 3.0的演示片截图,图中人物身处布置有灯效电脑主机、装饰画和多台显示设备的桌面场景,其面前的操作界面显示:输入素材有Image1、Video1、安卓文件Flax,操作是根据软件界面截图制作视频,步骤生成的内容为生成软件教程,界面还标注了生成设置为Wan3.0、分辨率720P、帧率25,界面底部有“已经做完了”的文字提示,该演示片直观呈现了Wan3.0可结合界面截图制作对应操作步骤类教程的视频生成能力。

▲Wan 3.0 演示片截图

Pixmax 也将持续关注 Wan3.0 的能力升级,并计划接入该模型,为用户提供更丰富的 AI 视频生成选择。未来,创作者可以通过 PixMax 更高效地完成短视频、广告素材、产品展示和品牌视觉内容创作。

从 Wan1.0 到 Wan3.0,AI 视频生成正在从“会画”“会拍”走向“更懂表达”。随着模型能力持续开放,AI 视频也将成为连接文字、图像、声音、数据与真实场景的重要内容载体。

用 Pixmax 一站式生成 AI 短剧
用 Pixmax 一站式生成 AI 短剧

从剧本到分镜、角色、视频生成和配音,快速完成完整创作流程。