设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

AI生成视频用文字难以描述需求,如何破?

发布时间: 2025-04-25 10:21:41 来源:

  中新经纬4月15日电 (常涛)用户在用AI工具生成图片尤其是视频时,普遍会遇到用文字难以描述的情况。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  快手高级副总裁、社区科学线负责人盖坤15日在北京表示,AI在辅助创意表达上拥有巨大潜力,但当前的行业发展现状还远远无法满足用户需求,在AI生成内容的稳定性以及用户复杂创意的精确传达上仍有“很多挑战”。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  “大家应该很自然地会感受到文字在表达影像信息时,是不完备的。我们需要有新的方式,能让人真正精准地表达出心中所想。”盖坤说。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  当日,快手发布可灵AI全新2.0模型,包括可灵2.0视频生成模型及可图2.0图像生成模型。其中,在本次2.0模型的迭代中,可灵AI发布AI视频生成的全新交互理念Multi-modal Visual Language(MVL),让用户能够结合图像参考、视频片段等多模态信息,将脑海中包含身份、外观、风格、场景、动作、表情、运镜在内的多维度复杂创意,直接高效地传达给AI。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  盖坤介绍,MVL由TXT(Pure Text,语义骨架)和MMW(Multi-modal-document as a Word,多模态描述子)组成,能从视频生成设定的基础方向以及精细控制这两个层面,精准实现AI创作者们的创意表达。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  基于MVL理念,可灵AI推出多模态编辑功能。“用户可以在可灵AI的平台上体验多模态编辑能力。用户可以非常直接地把自己的想法用图像等方式作为输入,生成符合自己想法的创意视频。”盖坤介绍,MMW将不只局限于图片和视频,也可以引入其他模态的信息,例如声音、运动轨迹等,让用户实现更加丰富的表达。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  快手副总裁、可灵AI负责人张迪介绍,当前,图生视频约占到可灵AI视频创作量的85%,图片质量也对视频的生成效果产生重要作用。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  据快手方面介绍,截至目前,可灵AI全球用户规模已突破2200万,累计生成1.68亿个视频及3.44亿张图片素材。自2024年6月上线至今的10个月时间里,可灵AI已累计完成超20次迭代,月活用户数量增长25倍。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  (更多报道线索,请联系本文作者常涛:changtao@chinanews.com.cn)(中新经纬APP)eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

  中新经纬版权所有,未经书面授权,任何单位及个人不得转载、摘编或以其他方式使用。eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

责任编辑:魏薇 李中元eQD速刷资讯——每天刷点最新资讯,了解这个世界多一点SUSHUAPOS.COM

竹类植物是竹亚科植物的总称,与水稻、小麦、大麦和燕麦同属于禾本科BOP分支,具有重要的经济、生态和文化价值。为更好地服务竹类植物的系统进化和功能研究,有效整理归纳盘活海量的竹类组学和分 3月17日,记者从海南大学获悉,该校化学化工学院副教授李萌婷与相关研究团队合作,合成了多功能复合金纳米花颗粒。该颗粒配合温和光热、光动力、药物控释联合疗法,可有效促进感染性组织再生修复。 英国“我超爱科学”网站1月1日刊登题为《什么是“时空连续体”?》的文章,作者是斯蒂芬·伦茨,内容编译如下:“时空连续体”(space-time continuum)是源自于大多数人听说过却未必完全了解的 记者3月21日从中国科学技术大学获悉,该校物理学院张斗国教授课题组,提出并实现了一种基于矢量光场调控原理的动量空间偏振滤波器件。该滤波器件安装于传统无标记光学显微镜后,可采集到单个纳米 3月22日消息,根据huawei旗舰机型迭代策略,今年上半年将发布影像旗舰huaweiP70系列。然而,这两天一张流出的图片声称huaweiP70将于3月23日开始预售,并附有各个版本的具体售价。但据媒体报道,huawei相关 3月23日消息,vivo即将于3月26日发布vivo X Fold3系列折叠屏电话,其中包含vivo X Fold3和vivo X Fold3 Pro两款新品。据悉,vivo X Fold3采用了首发的碳纤维龙骨铰链,重量仅为219克,厚度为4.65毫米。相 。

本文链接:AI生成视频用文字难以描述需求,如何破?http://www.sushuapos.com/show-2-12112-0.html

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

上一篇: OpenAI被曝打造社交网络 数据或将反哺AI模型训练

下一篇: 营销巨头蓝色光标披露800万元数据资源存货,All in AI、营收同比增长15.5%

热门资讯

  • 培育一批专利产业化样板企业

    近日,国家知识产权局等五部门联合印发了《专利产业化促进中小企业成长计划实施方案》(以下简称《实施方案》)。《实施方案》提出,到2025年底,中小企业知

  • 马斯克开源3140亿参数的Grok,大模型争相开源所为何求?

      马斯克开源3140亿参数的Grok,大模型争相开源所为何求?  作者:刘晓洁  特斯拉CEO埃隆・马斯克(Elon Musk)给大模型领域投下一枚重磅炸弹。  北京时间3月18日凌晨,马斯

  • Sora将如何影响科学与社会

    英国《自然》周刊网站3月12日刊登题为《OpenAI的文生视频工具Sora会如何改变科学——以及社会》的文章,作者为乔纳森·奥卡拉汉,内

  • “95后”的无人机“造像师”

    “当时是怎样选中低空经济这个领域,并且来深圳发展的?”面对这个关乎事业发展的问题,“95后”台青张晏纶坦言,“这是一场面试带来的惊喜。”张晏纶来自

  • 专家:警惕常见睡眠认知误区

    3月21日是世界睡眠日,中国主题为“健康睡眠 人人共享”。近日发布的《2023年中国居民睡眠白皮书》显示,我国居民平均睡眠时长6.75小时,平均在零点后入

  • 甘肃首座特高压换流站迎来“新成员”

    3月18日,伴随着搬运车的轰鸣声,全国首个大规模清洁能源特高压直流输电工程的送端±800千伏特高压祁连换流站迎来了一位“新成员”—&mdas

  • 走进新中国建材科技的发源地,探索“隐秘”的玻璃世界

    玻璃,是我们日常生活中常见且应用非常广泛的一种材料,如外墙、窗户、杯子、灯饰……但玻璃的应用远不止于此。2024年3月22日14时,由中国

  • 黑场显微镜让单个颗粒实现无标记光学显微成像

    3月21日记者从中国科学技术大学获悉,该校物理学院张斗国教授课题组,提出并实现了一种基于矢量光场调控原理的动量空间偏振滤波器件。科研人员将该滤

  • AI+智能家居赋能健康睡眠

    3月21日是第二十五个“世界睡眠日”,中国睡眠研究会联合慕思集团在北京正式发布《2024情绪与健康睡眠白皮书》(以下简称《白皮书》)。《白皮书》指出,

  • Kimi累趴下了,券商仍看好

    21世纪经济报道记者雷晨 北京报道近日,国内AI领域的明星产品——Kimi智能助手,因流量激增遭遇了短暂的服务中断。月之暗面随后发布公告,对此

  • “AI钢铁侠”黄仁勋,又进化了英伟达

      “AI钢铁侠”黄仁勋,又进化了英伟达  作 者丨倪雨晴  2024年,英伟达一年一度的GTC大会已然成为AI界春晚,现场座无虚席,全球AI爱好者翘首以待黄仁勋的独家SOLO。  北京

  • 被美国诉讼垄断:iPhone回应想让苹果变成安卓!iOS开放还怎么玩

    3月22日消息,美国司法部对iPhone提起诉讼,声称其苹果生态系统构成垄断。司法部表示,iPhone将苹果生态系统视为一种垄断,以牺牲消费者、开发者和竞争对手的

推荐资讯

  • 日榜
  • 周榜
  • 月榜