通义万相
通义万相是阿里巴巴通义实验室推出的AI视频与图像生成模型,核心为Wan2.7系列,支持文生视频、图生视频、参考生视频、视频编辑及图像生成。国内首个支持角色扮演的视频模…
📋 工具信息卡片
通义万相 是什么
通义万相是阿里巴巴旗下领先的AI视频与图像生成模型,由阿里云通义实验室打造。作为通义大模型家族的重要成员,通义万相致力于将AI生成能力从"素材生产"升级为"创作全链路工具",让用户从"演员"变为"导演"。
通义万相的核心模型为 Wan2.7 系列,涵盖文生视频、图生视频、参考生视频和视频编辑四大模型。该系列支持文本、图像、视频、音频全模态输入的统一创作体系,全系列支持 720P 和 1080P 分辨率输出,视频时长可在 2 至 15 秒 范围内任意指定。作为国内首个支持角色扮演功能的视频模型,万相2.6就已实现了音画同步、多镜头生成及声音驱动等核心能力。
🔗 通义万相官网:https://tongyi.aliyun.com/wan/(支持网页端和千问App体验)
通义万相 主要功能
🎬 文生视频——一句话生成电影级视频
输入文字描述,AI自动生成流畅视频。万相2.6支持 15秒长视频 生成,具备智能分镜叙事能力,可将简单提示词转换为多分镜脚本,生成包含多个镜头的连贯叙事视频,并保持多镜头间主体、场景等关键信息的一致性。
🖼️ 图生视频——让静态图片动起来
上传一张图片,AI将其转化为动态视频。万相2.7-图生视频模型支持 多模态输入(文本/图像/音频/视频),可完成 首帧生视频、首尾帧生视频、视频续写 三大任务。支持自定义视频时长和分辨率。
🎭 角色扮演——万物皆可为主演
国内首个支持角色扮演功能的视频模型。可参考输入视频中的 角色外观和音色,实现角色扮演,按照提示词生成单人表演、多人合拍、人与物合拍的视频。指定角色"出演你的剧本",不仅复刻外观,还能 复刻音色。
✂️ 视频编辑——一句话精准修改视频
支持对视频进行 多维度指令编辑,对画面、剧情、环境进行二次创作。用户仅需输入简短文字描述,即可实现视频画面修改、风格切换、角色动作表情调整及台词修改,并保持口型自然匹配。
🔄 视频续写——让创意无限延展
支持 首尾帧、视频续写、续写+尾帧 等多种创作方式,让画面和时间精准把握。可将2秒视频最长续写至15秒,支持首尾帧精细调控,确保画面过渡自然。
👤 数字人——一站式数字人工厂
通义万相提供 数字人制作及应用服务的一站式工厂,支持通过视频、图片、3D资产等方式训练数字人。数字人资产可搭配视频合成(课程培训视频)、直播(电商带货)、互动娱乐或教学(口语陪练、儿童教育)等应用。
适合人群
通义万相 价格方案
计费说明:通义万相文生图模型按成功生成的输出图片数量计费,输入内容及处理失败的请求不计费。视频生成按生成时长和分辨率计费。免费额度用尽或过期后,按实际用量付费。具体价格以阿里云官网实时公布为准。
✅ 优点
- 国内首个角色扮演视频模型:可参考视频角色外观和音色,生成单人/多人合拍视频,技术领先。
- 全链路创作能力:从文生视频、图生视频到视频编辑、续写,覆盖创作全流程。
- 免费额度友好:新用户90天内享受50张图片+100秒视频免费额度。手机端App完全免费不限次数。
- 多模态输入统一:支持文本、图像、视频、音频全模态输入,720P/1080P输出。
- 阿里生态深度整合:与阿里云百炼平台无缝对接,支持API调用和企业级定制。
⚠️ 缺点
- 视频时长有限:单次生成最长仅15秒,长视频创作需多次拼接。
- 个别场景画面逻辑偏差:在部分复杂场景下仍可能出现画面逻辑偏差的小问题。
- 依赖阿里云生态:需通过阿里云百炼平台开通服务,对非阿里云用户有一定门槛。
- PC端免费额度有限:PC端每日仅送50灵感值(约10次生成),高频使用需付费。
📖 使用教程
1
访问官网,选择体验方式
打开 tongyi.aliyun.com/wan,可选择 网页端 直接体验,或在 千问App 中体验(手机端完全免费)。
2
选择功能并输入内容
根据需求选择 "文生视频"、"图生视频"、"视频编辑" 或 "图像生成" 等功能。输入文字描述或上传图片/视频,AI将自动处理。
3
高级功能:角色扮演与视频续写
使用 "参考生视频" 功能,上传参考视频即可让AI复刻角色外观和音色。使用 "视频续写" 功能,可将视频从2秒延长至15秒。
4
API集成(开发者)
开发者可通过 阿里云百炼 平台开通服务,调用通义万相API。支持HTTP调用和DashScope SDK,将AI能力集成到自有产品中。
常见问题
Q:通义万相可以免费使用吗?
A:可以。新用户开通阿里云百炼后享 90天免费额度:文生图50张、视频类各50秒。此外,千问App手机端完全免费、不限次数。
Q:通义万相生成的视频可以商用吗?
A:付费生成的视频内容可用于商业用途。免费额度生成的视频商用需确认具体授权范围,建议查看阿里云官方服务条款。
Q:通义万相支持哪些语言?
A:图像生成支持 12国语言,包括中文、英文等。视频生成提示词支持中文和英文输入。
Q:通义万相和Midjourney有什么区别?
A:通义万相是 视频生成+图像生成 的综合模型,支持文生视频、图生视频、视频编辑等。Midjourney专注于图像生成。通义万相在国内直连、中文支持和免费额度上更具优势。
✍️ NavCN 点评
通义万相是阿里巴巴在AI视频生成领域的重要布局,也是 国内首个支持角色扮演功能的视频模型。当Runway、Pika等海外工具在视频生成赛道激烈竞争时,通义万相以"角色扮演+全模态输入+全链路创作"的差异化定位,走出了一条自己的路——不仅生成视频,更让用户能 指定角色"出演剧本",从"演"迈向"导"。
通义万相最值得称道的是其 免费策略的诚意——新用户90天内享受50张图片+100秒视频免费额度,手机端千问App更是完全免费不限次数。这种"低门槛体验+按量付费"的模式,让创作者可以零成本试错。同时,从Wan2.1到Wan2.7的快速迭代,持续提升画质、音效和指令遵循能力,展现了阿里在AI视频领域的技术实力。
对于影视制作人、广告创意者、自媒体创作者和电商运营来说,通义万相能显著提升视频内容的生产效率、降低制作成本。建议先从千问App或网页免费版体验入手,感受角色扮演和视频编辑的核心能力,再根据实际需求选择按量付费或API集成。
一句话总结:通义万相——国内首个角色扮演AI视频模型,从"演"到"导"的全链路创作工具,让每个人都能成为AI视频的导演。
