Wan 2.6 & 2.5 — AI Video & Image Generation by Alibaba — Wan 2.6 & 2.5 — 阿里巴巴的AI视频与图像生成
v1使用阿里巴巴的Wan 2.6和Wan 2.5生成AI视频和图像——支持文本转视频、图像转视频、视频转视频、文本转图像和图像编辑,最高支持1080p分辨率、15秒时长、单/多摄像头拍摄类型、音频引导生成和提示扩展。支持2个世代的18种模型变体。通过Atlas Cloud API提供,最高可享受标准价格30%的折扣。当用户想要生成AI视频、创建视频片段、动画图像、编辑视频、生成图像、编辑照片,或提到Wan、阿里巴巴视频、Tongyi视频、Wanx或Wan 2.6/2.5时,请使用此技能。同时,当用户要求创建产品演示、营销视频、社交媒体短片、动画场景、电影片段、视频转视频传输、角色一致的视频编辑、多摄像头拍摄或使用AI创建任何视觉内容时,也会触发此技能。
运行时依赖
安装命令
点击复制技能文档
Wan 2.6 & 2.5 — AI 视频和图像生成,由阿里巴巴提供 使用阿里巴巴的 Wan 2.6 和 Wan 2.5 生成 AI 视频和图像,支持文本到视频、图像到视频、视频到视频、文本到图像和图像编辑,最高支持 1080p 分辨率、15 秒时长、多/单摄像头模式、音频引导生成和内置提示扩展。 Wan 2.6 是最新的旗舰模型,具有电影级运动质量、多摄像头拍摄类型、音频 URL 输入用于引导生成和视频到视频转换,具有字符级提示控制。 Wan 2.5 提供了一种经济有效的替代方案,支持 480p 和 Flash 变体,用于快速原型设计。 数据使用说明:此技能将文本提示、图像 URL、音频 URL 和视频文件发送到 Atlas Cloud API(api.atlascloud.ai)进行生成。除下载的输出文件外,不存在本地存储。API 使用根据分辨率、时长和选择的模型收取费用。 主要功能 文本到视频 — 根据文本描述生成视频片段,支持音频(2.6 / 2.5) 图像到视频 — 将静态图像动画化为动态视频(2.6 / 2.5) 视频到视频 — 使用字符 X 提示符转换现有视频的样式或替换角色(2.6) 文本到图像 — 根据文本描述生成图像,27 个预设大小(2.6) 图像编辑 — 使用提示式指令编辑图像,最高支持 4 个参考图像(2.6) 音频引导生成 — 提供音频 URL 引导视频生成,具有同步音频(2.6) 多/单摄像头 — 多摄像头用于动态拍摄,单摄像头用于稳定框架(2.6) 提示扩展 — 内置提示优化,用于获得更好的结果 最高 1080p — 分辨率:480p、720p、1080p 最高 15s — 时长:5/10/15 秒(2.6),5/10 秒(2.5) Flash 变体 — 快速、经济的生成,用于草稿(2.6 I2V Flash、2.5 Fast) 设置 在 https://www.atlascloud.ai 注册 控制台 → API 密钥 → 创建新密钥 设置环境变量:export ATLASCLOUD_API_KEY="你的密钥" API 密钥与你的 Atlas Cloud 账户及其按需付费余额绑定。所有使用情况都将计入此账户。 Atlas Cloud 目前不支持范围密钥 — 密钥授予访问账户上所有可用模型的权限。 脚本使用 此技能包括用于视频和图像生成的 Python 脚本。无需外部依赖。 列出可用模型 python scripts/generate_video.py list-models python scripts/generate_image.py list-models 生成视频 python scripts/generate_video.py generate \ --model "alibaba/wan-2.6/text-to-video" \ --prompt "你的提示这里" \ --output ./output \ duration=5 生成图像 python scripts/generate_image.py generate \ --model "alibaba/wan-2.6/text-to-image" \ --prompt "你的提示这里" \ --output ./output 图像到视频 python scripts/generate_video.py generate \ --model "alibaba/wan-2.6/image-to-video" \ --image "https://example.com/photo.jpg" \ --prompt "动画化这个场景" \ --output ./output \ resolution=1080p duration=5 上传本地文件 python scripts/generate_video.py upload ./local-file.jpg 运行 python scripts/generate_video.py generate --help 或 python scripts/generate_image.py generate --help 以获取所有选项。 额外的模型参数可以作为 key=value 传递。 定价 Wan 2.6 — 视频模型(每秒,按分辨率) 所有视频价格均为每秒生成的视频。Atlas Cloud 的定价根据分辨率不同而不同。 文本到视频和视频到视频 分辨率 fal.ai Atlas Cloud 节省 480p - $0.04/s - 720p $0.10/s $0.08/s 20% off 1080p $0.15/s $0.12/s 20% off 图像到视频 分辨率 Atlas Cloud 节省 720p $0.10/s $0.10/s - 1080p $0.15/s $0.15/s - 图像到视频 Flash 分辨率 Atlas Cloud 所有 $0.018/s Wan 2.6 — 图像模型(每张图像) 模型 原始 Atlas Cloud 节省 文本到图像 $0.03 $0.021 30% off 图像编辑 $0.035 $0.021 40% off Wan 2.5 — 视频模型(每秒,固定费率) 模型 Atlas Cloud 时长 文本到视频 $0.035/s 5/10 秒 图像到视频 $0.035/s 5/10 秒 fal.ai 定价来自 fal.ai/models/wan。 可用模型 Wan 2.6 视频模型 模型 ID 类型 分辨率 时长 alibaba/wan-2.6/text-to-video 文本到视频 480p–1080p 5/10/15s alibaba/wan-2.6/image-to-video 图像到视频 720p–1080p 5/10/15s alibaba/wan-2.6/image-to-video-flash 图像到视频(快速) 720p–1080p 5/10/15s alibaba/wan-2.6/video-to-video 视频到视频 480p–1080p 5/10s Wan 2.6 图像模型 模型 ID 类型 最大大小 alibaba/wan-2.6/text-to-image 文本到图像 2184×936 alibaba/wan-2.6/image-edit 图像编辑 24 个预设 Wan 2.5 视频模型 模型 ID 类型 分辨率 时长 alibaba/wan-2.5/text-to-video 文本到视频 480p–1080p 5/10s alibaba/wan-2.5/image-to-video 图像到视频 480p–1080p 5/10s 参数 Wan 2.6 — 文本到视频 参数 类型 必需 默认值 描述 prompt 字符串 是 - 视频描述 negative_prompt 字符串 否 - 要从视频中排除的内容 size 字符串 否 1280*720 输出大小(见下面的大小选项) duration 整数 否 5 5、10 或 15 秒 shot_type 字符串 否 - 拍摄类型(见下面的拍摄类型选项)