![]()
阿里巴巴正式发布 万相2.6 版本,这一全新升级的视频生成模型在功能、性能和创作自由度上均实现了显著提升。新版本引入了 “角色扮演”、多分镜控制、音画同步 等关键功能,单次视频生成时长更是提升至 15秒,刷新了国内视频生成模型的时长纪录。
这一更新不仅标志着阿里在视频生成领域的持续领先,也展现了 AI 技术在影视、广告、内容创作等场景的深度应用潜力。
👉 官方入口:https://tongyi.aliyun.com/wan/
![]()
🎭 一、国内首个支持“角色扮演”功能的视频生成模型
万相2.6 是国内首个支持 角色扮演(Role Play) 的视频生成模型。用户可在输入脚本或提示词时设定特定人物身份、情绪和动作,AI 将基于语义和镜头逻辑,生成符合设定的角色演绎画面。
无论是单人表演、多人互动,还是人与物体同框,模型都能准确识别角色关系,实现自然流畅的动态表现。这一能力让 AI 生成视频从“画面复现”迈向“情节演绎”,大大提升了内容的叙事力与表现力。
📽️ 二、多分镜控制:让AI视频更接近专业影视创作
相比以往版本,万相2.6 最大的技术突破之一在于 多分镜控制能力。
创作者可以通过文本描述或分镜脚本,精准控制每个镜头的构图、角度、时长与衔接方式,AI 会自动识别语义并生成完整的镜头序列。
这一功能不仅适用于广告短片、剧情短视频,也为影视级创作提供了 AI 辅助工具。
创作者无需复杂的剪辑与后期操作,就能快速生成具有分镜逻辑的成片,大幅缩短制作周期。
🔊 三、音画同步与声音驱动:AI视频生成更自然
万相2.6 引入了全新的 音画同步机制,可以根据语音或音乐节奏自动匹配人物动作和表情,实现更自然的口型、节奏和情绪表现。
同时新增的 声音驱动(Voice-Driven Animation) 功能,使得用户只需上传音频或语音文件,AI 即可自动生成与声音匹配的动态画面。
这一功能对于配音视频、讲述类内容创作、音乐MV生成等场景尤为实用,为创作者提供了更高的自由度和表现空间。
🎬 四、单次视频时长突破至15秒,创作空间更广阔
在视频生成时长方面,万相2.6 将单次生成时长提升至 15秒,这是目前国内 AI 视频生成模型中最长的连续输出时长。
这一提升意味着创作者可以在一次生成中完成更完整的剧情或广告内容,减少后期拼接,保证画面连贯性和叙事一致性。
从广告营销到短片叙事,再到影视预演,15秒的连续生成为 AI 视频创作带来了更多想象空间,也让 AI 生成内容更接近“真实拍摄”的质感。
🚀 五、AI 视频创作新阶段:效率与艺术性的融合
阿里万相2.6 的推出,标志着中国在 生成式视频模型(AIGV) 领域的持续突破。
它不仅提升了生成质量和内容一致性,还赋予了用户更强的控制力,使 AI 视频不再只是“随机生成”,而成为一种具备导演思维与艺术表达的创作方式。
未来,阿里计划继续在多模态生成、语义理解与角色建模方向进行优化,让 AI 视频创作更贴近真实拍摄体验,同时降低内容生产门槛,服务更多创意从业者和品牌团队。
✅ 总结
阿里万相2.6 的发布,不仅带来了更智能、更灵活的 AI 视频生成能力,也让“角色扮演”、“多镜头控制”与“音画同步”等高级功能进入大众创作场景。
从短视频创作者到影视制作人,万相2.6 正在成为国内视频生成生态的重要推动力。
通过这一版本,阿里在生成式 AI 领域再次树立了行业标杆,让 AI 生成视频 迈向更加自然、真实、专业的创作时代。
👉 想体验万相2.6 的最新功能,请访问官方链接:
https://tongyi.aliyun.com/wan/
