Video Generation

Wan AI视频生成器

阿里巴巴的Wan系列是最通用的开源视频生成模型家族之一。从轻量级的Wan 2.1到支持15秒高清生成的旗舰Wan 2.6,在ComfyUI Web试用运行所有版本 — 无需GPU、无需配置。

为什么选择Wan AI

图生视频

上传照片,将其转化为具有自然运动、真实物理效果和摄像机运动的动态视频。Wan 2.5和2.6支持720p和1080p输出。

文生视频

用自然语言描述场景,生成原创视频片段。通过提示词控制摄像角度、光照、运动风格和主体行为。

角色动画

Wan 2.2 Animate将静态图片转化为流畅的角色动画,实现动作和表情迁移 — 无需姿态图或深度图。

5个模型版本

从一个平台访问Wan 2.1、2.2、2.5和2.6。每个版本在速度、质量和功能之间有不同的平衡。

100%云端运行

无需GPU、无需Python配置、无需本地安装ComfyUI。云端基础设施在任何有浏览器的设备上运行模型。

提供试用方案

无需信用卡即可开始生成视频。试用账户获得定期刷新的积分。付费方案每月$9起。

如何在ComfyUI Web上使用Wan AI

两分钟内生成你的第一个Wan AI视频。

步骤 1

选择Wan版本

根据需求选择Wan模型。Wan 2.6用于最高画质(15秒,1080p),Wan 2.5用于快速图生视频,Wan 2.2 Animate用于角色动画。

步骤 2

上传图片或输入提示词

图生视频请上传源照片。文生视频请描述场景、摄像机运动和风格。示例:「相机缓慢环绕主体,电影质感光照」。

步骤 3

生成并下载

点击生成,等待30-120秒。预览结果,按需调整提示词,以MP4格式下载。

什么是Wan AI?

Wan是阿里巴巴通义实验室开发的开源视频生成模型家族。2025年初以Wan 2.1首次发布,该系列经过四个主要版本的快速迭代,不断推动开源视频AI的边界。

与Sora或Runway Gen-3等闭源竞品不同,Wan模型在宽松许可证下试用提供。你可以通过ComfyUI在本地运行,也可以使用ComfyUI Web等云平台无需硬件投入即可生成视频。

Wan模型版本对比

Wan 2.1引入了基础架构,Mocha变体专注于角色替换 — 使用参考图像替换源视频中的角色,无需姿态图等显式结构引导。

Wan 2.2扩展了专用的Animate模型用于角色动画,以及优化的图生视频管线。14B参数的A14B变体在合理的生成速度下提供高质量运动。

Wan 2.5专注于生成速度,提供显著缩短生成时间的「快速」推理模式。支持720p和1080p输出,时长5秒或10秒。

2025年12月发布的Wan 2.6是最强版本。生成最长15秒的1080p高清视频,支持自动分镜的多镜头叙事,引入R2V(Reference-to-Video)模型,可在不同场景间保持角色外观和声音。

技术规格

Wan模型提供1.3B和14B参数两种规模。14B变体生成质量更高、运动连贯性更好的输出;1.3B版本生成速度更快,适合快速原型制作。

支持的宽高比包括16:9、9:16、1:1、4:3和3:4。分辨率根据版本从720p到1080p。Wan 2.6新增原生音视频同步,支持音频驱动的视频生成。

所有Wan模型接受文字提示词(文生视频)和图像输入(图生视频)。Wan 2.2 Animate额外接受角色静态图用于动画,Wan 2.1 Mocha接受角色参考图用于替换。

Wan AI对比闭源替代方案

Wan直接与Sora(OpenAI)、Runway Gen-3、Kling(快手)和Pika竞争。这些闭源模型提供精致的界面,但Wan以完全透明和无供应商锁定提供可比的质量。

在ComfyUI Web上,你可以兼得两者的优势:Wan模型的开放性和灵活性,加上云平台的便捷性。无需购买GPU、无需复杂配置,试用积分即可开始。

常见问题

Wan AI试用吗?
是的。Wan是开源的,本地运行试用。在ComfyUI Web上你可以获得试用积分生成视频。付费方案每月$9起。
Wan 2.5和Wan 2.6有什么区别?
Wan 2.6支持最长15秒1080p视频(Wan 2.5为10秒),新增自动分镜的多镜头叙事和用于场景间角色一致性的Reference-to-Video功能。
Wan AI支持什么分辨率?
Wan支持720p和1080p输出。宽高比包括16:9、9:16、1:1、4:3和3:4。视频时长根据版本从5秒到15秒不等。
使用Wan AI需要GPU吗?
在ComfyUI Web上不需要。云端GPU处理所有推理。只需网页浏览器。本地使用Wan 14B大约需要24GB显存。
Wan AI可以仅从文字生成视频吗?
可以。Wan同时支持文生视频和图生视频。用自然语言描述场景,模型就会生成原创视频内容。
Wan 2.2 Animate用于什么?
Wan 2.2 Animate将静态角色图像转化为具有流畅动画和表情迁移的动态视频序列。无需姿态图 — 只需源图像。
Wan视频生成需要多长时间?
在ComfyUI Web上,根据模型版本、分辨率和视频长度,通常需要30-120秒。Wan 2.5 Fast针对更快结果进行了优化。
Wan AI是开源的吗?
是的。所有Wan模型由阿里巴巴通义实验室以宽松的开源许可证发布。可以从Hugging Face下载权重或通过ComfyUI运行。