只需一段文字指令就能生成一段逼真视频,今年初,文生视频大模型Sora在全球人工智能业内外引发广泛关注。27日,2024中关村论坛年会上首次发布我国自研的具“长时长、高一致性、高动态性”特点的文生视频大模型Vidu。
记者从会上获悉,这一视频大模型由清华大学联合北京生数科技有限公司共同研发,可根据文本描述直接生成长达16秒、分辨率高达1080P的高清视频内容,不仅能模拟真实物理世界,还拥有丰富想象力。
清华大学人工智能研究院副院长、生数科技首席科学家朱军说,当前国内视频大模型的生成视频时长大多为4秒左右,Vidu则可实现一次性生成16秒的视频时长。同时,视频画面能保持连贯流畅,随着镜头移动,人物和场景在时间、空间中能保持高一致性。
在动态性方面,Vidu能生成复杂的动态镜头,不再局限于简单的推、拉、移等固定镜头,而是能在一段画面里实现远景、近景、中景、特写等不同镜头的切换,包括能直接生成长镜头、追焦、转场等效果。
“Vidu能模拟真实物理世界,生成细节复杂且符合物理规律的场景,例如合理的光影效果、细腻的人物表情等,还能创造出具有深度和复杂性的超现实主义内容。”朱军介绍,由于采用“一步到位”的生成方式,视频片段从头到尾连续生成,没有明显的插帧现象。
此外,Vidu还可生成如熊猫、龙等形象。
据悉,Vidu的技术突破源于团队在机器学习和多模态大模型方面的长期积累,其核心技术架构由团队早在2022年就提出并持续开展自主研发。“作为一款通用视觉模型,我们相信,Vidu未来能支持生成更加多样化、更长时长的视频内容,探索不同的生成任务,其灵活架构也将兼容更广泛的模态,进一步拓展多模态通用能力的边界。”朱军说。
(来源:新华社 记者:魏梦佳)
十四届全国人大二次会议3月6日举行记者会,国家发展和改革委员会主任郑栅洁回答记者提问时表示,推动大规模设备更新和消费品以旧换新,是党中央、国务院着眼于高质量发展大局作出的重大部署,既能促进消费、拉动投资,也能 高合汽车回应被FF起诉:不存在任何抄袭 3月5日,在法拉第未来(FFIE.US)(以下简称FF)宣布起诉高合汽车之后,高合汽车发布声明称,公司及公司创始人丁磊不存在任何抄袭和侵犯FF公司商业秘密、知识产权的行为,也不存在不 实探北京小米汽车门店:外部装修即将开工,SU7有望3月底到店 每经记者 李星 每经编辑 裴健如 门口轰隆隆的混凝土搅拌车,在工人的指挥下,正向着地面搭好的方形钢筋框架内浇灌水泥,门店内装修工人则各自忙碌着手 21世纪经济报道记者 李果 北京报道全国人大代表、四川省工商联副主席王麒一直关注和关心民营经济发展。在2024年全国两会上,她就促进民营经济高质量发展提出了多条建议。在接受21世纪 3 月 11 日消息,工信部今日公布《减免车辆购置税的新能源汽车车型目录》(第三批),包含特斯拉 Model S / X、五菱宏光 MINIEV、小鹏 G6、哪吒 L、领克 07 等车型。从目录中注意到,五菱宏光 MINIEV 免税的是215km(CLT 近日,从相关渠道得到了一组全新别克GL8的清晰测试谍照,为我们提前揭秘新一代车型的样貌,据悉,新一代GL8除了纯燃油版,还有望推出插混版本,将与腾势D9等中国品牌MPV展开竞争。『全新别克GL8谍照』 外观方面,全新别克GL 。本文链接:直接生成16秒高清视频 我国自研视频大模型在京发布http://www.sushuapos.com/show-4-5946-0.html
声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。