阿里开源动作生成模型Wan2.2
9月19日消息,阿里阿里开源全新动作生成模型通义万相Wan2.2-Animate,开源该模型同时支持动画和替换两种模式,动作输入一张角色图片和一段参考视频,生成可将视频角色的模型动作、表情迁移到图片角色中,阿里赋予图片角色动态表现力;同时还可在保留原始视频的开源动作、表情及环境的动作基础上,将视频中的生成角色替换为图片中的角色。该模型支持驱动人物、模型动漫形象和动物照片,阿里可应用于短视频创作、开源舞蹈模板生成、动作动漫制作等领域。生成 此次,通义万相团队构建了一个涵盖说话、面部表情和身体动作的大规模人物视频数据集,并基于通义万相图生视频模型进行后训练。Wan2.2-Animate将角色信息、环境信息和动作等,规范到一种统一的表示格式,实现了单一模型同时兼容两种推理模式;针对身体运动和脸部表情,分别使用骨骼信号和隐式特征,配合动作重定向模块,实现动作和表情的精准复刻。在替换模式中,团队还设计了一个独立的光照融合LoRA,用于保证完美的光照融合效果。 实测结果显示,Wan2.2-Animate在视频生成质量、主体一致性和感知损失等关键指标上,超越了StableAnimator、LivePortrait等开源模型,是目前性能最强的动作生成模型,在人类主观评测中,Wan2.2-Animate甚至超越了以 Runway Act-two代表的闭源模型。 自今年 2 月以来,通义万相已连续开源20多款模型,在开源社区和三方平台的下载量已超3000万,是开源社区最受欢迎的视频生成模型之一。通义万相模型家族已支持文生图、文生视频、图生视频、人声生视频和动作生成等10多种视觉创作能力。
去年年初,阿里推出了Animate Anyone模型,基于该模型的「全民舞王」功能一度火爆全网,兵马俑、萌宠跳科目三的视频在社交平台刷屏。但此前的技术框架无法同时控制动作、表情和环境交互,生成的视频依旧存在不自然的问题。
- 最近发表
- 随机阅读
-
- AI黑客越来越凶?奇安信推出AI时代的全栈式产品矩阵
- 吴川—三江粤桂协作再续深情,爱心捐赠温暖童心
- 洛瑞30+11+7法里德17+19 猛龙轻取掘金迎两连胜
- 恒兴:勇担时代重任,以品质与全链构建品牌护城河
- 他用WPS笔记,把AI报错变成了可复用的“避坑指南”
- 星光璀璨齐相聚,群策群力促发展—2023葡口超级品牌战略发布会圆满结束
- 广东年菜飘香上海滩:谁在叩门,如何登堂,安家何处?
- 星光璀璨齐相聚,群策群力促发展—2023葡口超级品牌战略发布会圆满结束
- 我在矿山深处送拼多多快递
- 苏辰集团董事局主席赴新疆塔城地区考察洽谈
- 25日早报:火箭锋将盼次轮复出 发展联盟MVP出炉
- 闽超泉州热度跃居全国第六全省第一
- 《尼尔》系列15周年PV温情回顾 玩家最期待的新作依旧成谜
- 大健康,大未来!看这款乳酸菌果汁如何走出新航线!
- 重庆太平洋三集团领导前往辽宁省本溪县考察
- 新城镇化建设 玻璃产业的二次生命,行业资讯
- 汽车做玻璃镀膜有用吗 汽车玻璃镀晶镀花了怎么办,行业资讯
- 黄河大桥被吐槽停收费就堵车 大桥成“停车场”
- 华佗集团召开第二季度监事会、财务工作会议
- 宁芜高速将拓为双向八车道_
- 搜索
-
- 友情链接
-