0

0

通义万相新模型上传图复刻动作,2.5系列升级实现音画同步!

爱谁谁

爱谁谁

发布时间:2025-11-08 20:15:20

|

439人浏览过

|

来源于php中文网

原创

近日,通义万相正式发布wan2.2 - animate模型,主打“上传一张人物图 + 一段视频”即可实现动作复刻与角色替换的全新功能。无论是让静态图像中的人物“跳起舞蹈”,还是在影视后期中“更换主角”,都能生成媲美电影级别的动态效果,广泛适用于剧情魔改(如角色穿越混搭)、影视换人等创意应用场景。

该模型是在此前通义万相开源的Animate Anyone基础上全面升级而来,不仅在人物一致性、画面质量等方面显著提升,更首次同时支持动作模仿角色扮演两种模式。在动作模仿模式下,只需输入一张角色图片和一段驱动视频,模型即可将视频中人物的动作与表情精准迁移至图片角色上,赋予其生动的动态表现力;而在角色扮演模式下,则可在保留原视频动作、表情及背景环境的前提下,将其中的角色无缝替换为指定图片中的形象。

为实现这一突破,通义万相团队构建了一个大规模人物视频数据集,涵盖丰富的说话场景、面部微表情与全身动作,并基于通义万相图生视频模型进行深度后训练。模型依托四大核心技术实现领先性能:

  • 统一模型架构设计:通过优化输入范式,将“图生动作”(Move模式)与“视频换人”(Mix模式)统一为同一符号表示体系。模型可根据输入内容自动切换生成模式,无需分别训练两个独立模型,极大提升了开发效率与资源利用率。

  • 精细化控制肢体与表情:将控制信号拆解为两部分处理——身体动作由VitPose提取的2D骨骼关键点注入初始噪声潜在向量,确保姿态迁移准确自然;面部表情则直接对参考视频中的人脸原始图像进行帧级隐式编码,借助时序对齐的交叉注意力机制注入模型,避免传统关键点方法丢失细节的问题,真实还原细微表情变化。

  • 真实光影融合能力:在Mix模式中引入Relighting LoRA模块,基于IC-Light合成数据训练,能够在保持角色外观一致的同时,学习目标视频的光照条件与色彩风格,使新角色真正“融入”原场景,而非简单“贴图”。该技术原生支持包含运镜运动、镜头抖动在内的复杂视频输入。

  • 完整开源工作流:提供从模板视频预处理到模型推理的全流程代码支持,包括驱动视频转模板文件的处理脚本,以及输入模板+角色图生成视频的推理接口,助力开发者全面提升各类姿态驱动模型的表现效果。

实测数据显示,Wan2.2 - Animate在视频质量、主体一致性、感知损失等多项关键指标上超越StableAnimator、LivePortrait等主流开源方案,成为当前性能最强的动作生成模型。在人类主观评测中,其表现甚至优于Runway Act-one等闭源商业模型。

目前,用户可通过通义万相官网(国内站与国际站 https://www.php.cn/link/62dee803f4071bd95a11e66e9b8324a7 Face及GitHub三大平台,便于二次开发与创意落地。

AskAI
AskAI

无代码AI模型构建器,可以快速微调GPT-3模型,创建聊天机器人

下载

值得一提的是,在2025杭州云栖大会上,阿里巴巴还发布了通义万相Wan2.5 preview系列模型,涵盖文生视频、图生视频、文生图和图像编辑四大核心能力。其中,通义万相2.5视频生成模型首次实现音画同步——可自动生成与画面匹配的人声解说、环境音效及背景音乐(BGM),大幅降低高质量视频创作门槛。

通义万相2.5在创作能力上实现全方位跃升:

  • 视频生成时长由5秒延长至10秒,单次输出即可呈现更完整的故事情节;
  • 支持24fps的1080P高清视频生成,画质清晰流畅,满足电影级制作需求;
  • 指令理解能力进一步增强,能准确响应运镜轨迹、镜头推拉等连续复杂指令,在图像编辑任务中也可通过一句话指令完成人物变身、风格迁移等操作;
  • 图像生成能力升级,支持中英文文字与图表生成,涵盖艺术海报、流程图、架构图等复杂排版场景,结合语义级编辑功能,实现“一句话P图”。

截至目前,通义万相模型家族已具备文生图、文生视频、图生视频、人声驱动视频、动作生成等十余种视觉创作能力,累计生成图片达3.9亿张,视频超7000万个。自今年2月以来,已连续开源超过20款模型,在ModelScope、Hugging Face等社区的下载量突破3000万次,持续领跑AIGC开源生态。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

相关专题

更多
硬盘接口类型介绍
硬盘接口类型介绍

硬盘接口类型有IDE、SATA、SCSI、Fibre Channel、USB、eSATA、mSATA、PCIe等等。详细介绍:1、IDE接口是一种并行接口,主要用于连接硬盘和光驱等设备,它主要有两种类型:ATA和ATAPI,IDE接口已经逐渐被SATA接口;2、SATA接口是一种串行接口,相较于IDE接口,它具有更高的传输速度、更低的功耗和更小的体积;3、SCSI接口等等。

1019

2023.10.19

PHP接口编写教程
PHP接口编写教程

本专题整合了PHP接口编写教程,阅读专题下面的文章了解更多详细内容。

63

2025.10.17

php8.4实现接口限流的教程
php8.4实现接口限流的教程

PHP8.4本身不内置限流功能,需借助Redis(令牌桶)或Swoole(漏桶)实现;文件锁因I/O瓶颈、无跨机共享、秒级精度等缺陷不适用高并发场景。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

413

2025.12.29

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

1976

2024.08.16

aigc查重率多少合格
aigc查重率多少合格

AIGC 查重率合格标准不统一,因场景而异。学术领域要求严格,多在 10% - 20% 以下;商业写作、新闻报道稍宽松,在 20% - 30% 左右;自媒体要求差异大,个人账号或达 30% - 40%,专业平台则严控在 20% - 30% 。想了解更多相关内容,请阅读专题下面的文章。

605

2025.04.09

高德地图升级方法汇总
高德地图升级方法汇总

本专题整合了高德地图升级相关教程,阅读专题下面的文章了解更多详细内容。

4

2026.01.16

全民K歌得高分教程大全
全民K歌得高分教程大全

本专题整合了全民K歌得高分技巧汇总,阅读专题下面的文章了解更多详细内容。

1

2026.01.16

C++ 单元测试与代码质量保障
C++ 单元测试与代码质量保障

本专题系统讲解 C++ 在单元测试与代码质量保障方面的实战方法,包括测试驱动开发理念、Google Test/Google Mock 的使用、测试用例设计、边界条件验证、持续集成中的自动化测试流程,以及常见代码质量问题的发现与修复。通过工程化示例,帮助开发者建立 可测试、可维护、高质量的 C++ 项目体系。

10

2026.01.16

java数据库连接教程大全
java数据库连接教程大全

本专题整合了java数据库连接相关教程,阅读专题下面的文章了解更多详细内容。

33

2026.01.15

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
C 教程
C 教程

共75课时 | 4万人学习

Go语言实战之 GraphQL
Go语言实战之 GraphQL

共10课时 | 0.8万人学习

PHP自制框架
PHP自制框架

共8课时 | 0.6万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号