支持文本图像视频输入LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
先上代码再发论文,腾讯新开源文生视频工具火了。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
名为MuseV,主打基于视觉条件并行去噪的无限长度和高保真虚拟人视频生成。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
老规矩,先看效果。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
静态的金克丝秒秒钟就能动起来朝你抛媚眼:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

画中诗圣也“活”了过来:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

各种风格都能驾驭,风景图也不在话下:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

更有搞笑风《微笑的骑士》:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

再上难度,复杂些的弹唱也处理得比较自然:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

此外,加入“骨架”控制动作、姿势也可以:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

腾讯这次论文还没发直接放出训练好的模型和部署运行的代码的操作让网友眼前一亮。主页显示训练代码也即将推出。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
不少人已趁热码住,GitHub获星500+。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

还有网友已经玩上了:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

围观网友直呼距离成为视频达人只差一个AI。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

嘴唇也能同步
除了直接放出模型代码,目前MuseV还有demo可体验。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

demo界面有两种玩法。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
一种可以上传一张图然后加上Prompt在这张图的基础上进行视频生成;另一种是上传一个参考视频和一张图,使图片中的内容按照视频中的动作运动起来。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

紧接着下方还有一些参数可以调整。可以自定义视频的时长以及视频的尺寸。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

此外值得一提的是,文本、图像到视频的生成结果的所有帧直接由MuseV生成,没有时序超分辨、空间超分辨等任何后处理。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
而输入视频控制姿态的生成模式下,开发团队表示需要参考视频的首帧条件和参考图像的首帧条件对齐,不然会破坏首帧的信息,效果会更差。所以一般生成流程是:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
- 确定参考视频;
- 用参考视频的首帧走图生图、controlnet流程,可以使用MJ等各种平台;
- 拿第二步中的生成图、参考视频用MuseV生成视频。

除MuseV,开发团队还表示即将发布一个实时高质量的唇同步模型——MuseTalk,可与MuseV一起搭配使用。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
MuseV里面长啥样?
技术方面,据了解MuseV是在去年7月左右基于扩散模型实现的技术进展,受到Sora启发,开发团队决定开源MuseV,之后将转向扩散+Transformer方案。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
也就是说,MuseV是基于扩散模型的虚拟人视频生成框架。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
模型架构如下图所示:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

总的来说,MuseV具有以下特点:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
首先是支持使用新颖的视觉条件并行去噪方案进行无限长度生成,不会再有误差累计的问题,尤其适用于固定相机位的场景。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
并行去噪算法示意图如下:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

其次,MuseV提供了基于人物类型数据集训练的虚拟人视频生成预训练模型。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
而且支持图像到视频、文本到图像到视频、视频到视频的生成;兼容Stable Diffusion文图生成生态系统,包括base_model、lora、controlnet等。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
还支持多参考图像技术,包括IPAdapter、ReferenceOnly、ReferenceNet、IPAdapterFaceID。LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
参考链接:LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
[1]https://github.com/TMElyralab/MuseVLzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
[2]https://twitter.com/Gorden_Sun/status/1774825159939256678LzI速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM
据英国《自然》杂志网站19日报道,美国华盛顿大学科学家首次使用生成式人工智能(AI)工具,帮助他们制造全新抗体。研究团队表示,AI设计抗体或能更好靶向一些很难被攻击的药物标靶,但这些抗体距离临床
记者3月20日从中国科学技术大学获悉,该校郭光灿院士团队在量子态分辨研究中取得重要进展。研究组在最小资源消耗的量子态分辨问题中首次提出了全局最优自适应策略,并发展了自适应集体测量实验
3月20日,在2024全球游戏开发者大会(GDC)上,腾讯发布了自研游戏AI引擎——GiiNEX。基于生成式AI和决策AI技术,GiiNEX将为游戏全生命周期提供丰富的AI解决方案。据悉,借助大模型等生成式AI
3月22日消息,数码闲聊站爆料称,xiaomi15 Pro将采用5000万像素的超大底三摄方案,其中一颗是全新的潜望长焦镜头。据资料显示,xiaomi11 Pro配备了潜望长焦镜头,而后续的12 Pro、13 Pro和14 Pro等机型则
记者3月22日获悉,中山大学、深圳华大生命科学研究院与复旦大学的研究团队合作,揭示了多种蚊虫在不同生境下病毒的多样性、传播分布的影响因素及地理谱系特征,在多维尺度上为研究蚊虫病毒组提供
“人工智能作为数字新基建重点建设方向,前景广阔,大有作为。今年的政府工作报告更首次提出开展‘人工智能+’行动,无疑将为人工智能技术在国内各行各业的广泛应用开启新篇章。”3月22
。
本文链接:腾讯开源视频生成新工具,论文还没发先上代码的那种http://www.sushuapos.com/show-2-4575-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。
上一篇: 弱智吧竟成最佳中文AI训练数据?!中科院等:8项测试第一
下一篇: 英伟达AI新课爆火!免费学习,干货满满