LogoPanify
  • Seedance
  • Wan
  • 功能
  • 价格
  • 博客
  • 文档
LogoPanify

使用 MkSaaS 在几天内轻松构建您的 AI SaaS

GitHubX (Twitter)BlueskyYouTube
Built withLogo of MkSaaSMkSaaS
产品
  • Seedance 模型
  • Wan 模型
  • MiniMax 模型
  • HappyHorse 模型
  • Kling 模型
  • 功能
  • 价格
  • 常见问题
资源
  • 博客
  • 文档
  • 更新日志
  • 路线图
公司
  • 关于我们
  • 联系我们
  • 邮件列表
法律
  • Cookie政策
  • 隐私政策
  • 服务条款
© 2026 Panify. All Rights Reserved.
  1. 首页
  2. AI 模型
  3. Wan
Wan 模型家族

Wan AI 模型

探索阿里巴巴 Wan 模型家族——从开放的视频生成基础,发展到更长的多模态创作、原生音频与精准编辑。

探索 Wan 3.0比较模型版本

最新能力

更长、更丰富的参考创作
Wan 3.0

原生 30 秒生成

图片、视频与音频参考

沉浸式双声道

精准编辑与延长

  • 文字、图片与参考生视频
  • 新版本支持原生声画
  • 生成、编辑与视频延长
  • 由阿里巴巴 Wan 团队开发

模型概览

Wan 是什么?

覆盖视频、图像、音频与编辑工作流的生成模型家族。

Wan 是阿里巴巴的生成式视频与图像模型家族。该系列覆盖文生视频和图生视频,并逐步扩展到关键帧控制、参考生视频、角色动画、原生声画生成和指令编辑。

最新的万相官方产品把生成和编辑整合到更广泛的多模态工作流中。不同端点的能力、模型 ID、部署区域和输出限制仍有差异,因此 Panify 会在开放前逐项验证。

创作系统

从创意简报到可控的声画结果

根据素材类型和控制需求选择合适的 Wan 工作流。

文字与图片生成
从文字简报生成视频,或为已授权的起始图片加入动作和运镜。
参考素材一致性
使用支持的图片、视频和音频引导角色、道具、场景、声音、动作与空间关系。
原生声画生成
较新的 Wan 工作流可在同一结果中协调对白、环境声、音乐和画面节奏。
生成与编辑
创建新场景,或通过指令、参考素材、局部修改和视频延长优化已有视频。

模型时间线

Wan 的版本演进

Wan 从开放视觉生成逐步发展为托管式多模态制作工作流。

Wan 2.1
开放基础

开放的文生视频与图生视频模型,包括首尾帧控制。

Wan 2.2
扩展工作流

增加开放变体以及角色动画和替换等专用工作流。

Wan 2.5
原生音频

在文字和图片工作流中加入托管式同步声画生成。

Wan 2.6
多镜头

扩展有声多镜头和参考生视频能力。

Wan 2.7
正式 API

支持 2–15 秒、最高 1080P、自定义音频以及参考或编辑端点。

Wan 3.0
最新

重点提升原生 30 秒、多模态参考、精准编辑、一致性和双声道体验。

探索该模型

创作模式

从最能表达意图的素材开始

不同工作流在速度、参考控制和可编辑性之间提供不同平衡。

文生视频
通过按时间顺序编写的简报指导电影级镜头、复杂动作与叙事发展。
图生视频
将起始图片转化为带自动分镜的更长声画序列。
参考生视频
使用获得授权的人物或物体作为单人或多人场景的持续主体。
视频编辑
修改画面、剧情、环境、光影或声音,或延长支持的视频。

创作用途

可以用 Wan 创作什么?

Wan 家族既适合早期创意探索,也适合更可控的制作概念。

01

广告概念

通过可控镜头发展更长的产品与营销叙事。

02

角色场景

使用已授权的身份和声音参考规划单人或多人表演。

03

电影级动作

预演动作、运镜与物理关系复杂的场景。

04

产品叙事

在连接的镜头和场景中保留重要产品细节。

05

音乐与对白

围绕对白、环境声、节奏和双声道构建场景。

06

视频修改

优化主体、背景、光影或声音,并延长支持的素材。

Wan 常见问题

常见问题

探索下一代 Wan 创作工作流

了解 Wan 3.0 的官方能力,并在 Panify 验证生产接入期间准备已授权的参考素材。

探索 Wan 3.0加入候补名单