当前位置:首页 > 元宇宙 > AI

谷歌 Veo 2 升级可生成更具电影感视频,文本、音频 AI 同步升级

来源: 责编: 时间:2025-04-13 08:41:48 137观看
导读 4 月 10 日消息,谷歌为其视频 AI 模型 Veo 2 推出新功能,旨在帮助用户更轻松地生成具有电影质感的画面以及编辑真实视频。这些新增的 Veo 2 功能目前可通过谷歌云的 Vertex AI 平台进行预览,与此同时,谷歌还对文

4 月 10 日消息,谷歌为其视频 AI 模型 Veo 2 推出新功能,旨在帮助用户更轻松地生成具有电影质感的画面以及编辑真实视频。这些新增的 Veo 2 功能目前可通过谷歌云的 Vertex AI 平台进行预览,与此同时,谷歌还对文本转图像生成器 Imagen 3 以及音频相关 AI 模型进行了更新。6sZ28资讯网——每日最新资讯28at.com

6sZ28资讯网——每日最新资讯28at.com

据了解,Veo 2 的新功能包括修复功能(inpainting)和外扩功能(outpainting)。谷歌表示,修复功能可以自动移除视频中的“不想要的背景图像、标志或干扰元素”,而外扩功能则能够将原始视频的画面进行扩展,该工具会用 AI 生成的视频片段填充新增的空间,使其与原始片段自然融合,类似于 Adobe 为图像提供的生成式扩展功能。6sZ28资讯网——每日最新资讯28at.com

6sZ28资讯网——每日最新资讯28at.com

此次更新还允许 Veo 2 用户在生成画面时,将电影拍摄技巧预设与文字描述一同选用,以便指导最终结果中的镜头构图、拍摄角度和节奏。例如,预设包括延时效果、无人机视角以及模拟不同方向的镜头平移等。6sZ28资讯网——每日最新资讯28at.com

此外,Veo 2 新增了一种插值功能,能够为两个静态图像之间创建视频过渡,为开头和结尾序列填充新的帧。6sZ28资讯网——每日最新资讯28at.com

6sZ28资讯网——每日最新资讯28at.com

Adobe 的竞争产品 Firefly 视频模型也具备一些类似的功能,其生成式 AI 视频扩展功能于上周在 Premiere Pro 中推出。谷歌还在其 AI 生成的输出中加入了 SynthID 数字归属水印,类似于 Adobe 的内容凭证系统。不过,Adobe 进一步承诺其工具完全可用于商业用途,因为它们是基于授权和公有领域内容进行训练的,而谷歌在训练其 AI 模型时大量抓取了网络上的内容,无法达到这一标准。6sZ28资讯网——每日最新资讯28at.com

在文本转图像模型 Imagen 3 方面,谷歌对其编辑功能进行了更新,声称可以“显著”提升自动移除物体的效果,使移除干扰元素后的结果看起来更加自然。Veo 2 和 Imagen 3 已被包括欧莱雅和卡夫亨氏在内的公司用于营销内容制作。卡夫亨氏的数字体验负责人贾斯汀・托马斯表示,过去需要八周才能完成的任务,现在只需八小时。6sZ28资讯网——每日最新资讯28at.com

6sZ28资讯网——每日最新资讯28at.com

在音频领域,谷歌推出了其文本转音乐模型 Lyria 的私人预览版,并为其合成语音模型 Chirp 3 推出了“即时定制语音”功能。谷歌称,Chirp 3 现在能够从 10 秒的音频输入中生成“逼真的定制语音”,并且正在推出一项新的转录功能预览,该功能可以识别并分离出多人对话中的各个说话者,从而为多参与者的谈话提供更清晰的转录。6sZ28资讯网——每日最新资讯28at.com

这些更新只是谷歌今日宣布的一系列 AI 相关消息中的一部分。谷歌效率优化型 Flash 模型的最新版本 Gemini 2.5 Flash 即将登陆 Vertex AI。谷歌表示,Gemini 2.5 Flash 会根据任务的复杂程度“自动调整处理时间”,以便为简单请求提供更快的结果。6sZ28资讯网——每日最新资讯28at.com

此外,谷歌本周还将更新其面向企业的 Agentic AI 工具,使 AI 代理能够在不同平台(如 PayPal 和 Salesforce)之间相互沟通并执行任务。同时,谷歌云市场将推出一个新板块,供企业浏览和购买由第三方谷歌合作伙伴构建的 AI 代理。6sZ28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-12214-0.html谷歌 Veo 2 升级可生成更具电影感视频,文本、音频 AI 同步升级

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 大模型“自动修 bug”能力将提升,豆包团队开源首个多语言代码修复基准 Multi-SWE-bench

下一篇: 谷歌推出 Vertex AI Media Studio 文生视频套件:自动化包办画面渲染、旁白、配乐等

标签:
  • 热门焦点
  • 清华、北大等86所高校布局元宇宙,是风口还是噱头?

    作者:徐赐豪来源:区块链日报据全国高校人工智能与大数据创新联盟元宇宙专委会不完全统计,截至2023年7月,全国共有86所高校战略布局元宇宙领域,其中本科院校73所,高职专科院校13所
  • 这一超级富豪“逆袭”,身价大增4330亿

    来源:侃见财经互联网的突围没有“终点”。在快节奏的商业环境下,不断的试错成了互联网企业的标配,一年一个风口,一个风口造就一个热点,但是回头来看,最终受益的还是身处
  • 关于年度热词NFT,除了钱,我们还可以聊点啥?

    每到年底,社交媒体总少不了年度盘点、年度总结、年度热词。如果让你来总结2021年度热词,你会想到什么?柯林斯词典将年度热词颁给了“NFT”,而其理由是:一个缩写词的
  • 【量子位】虚拟数字人深度产业报告 | 元宇宙Meta洞见

    虚拟数字人行业未来的主要驱动力包括:用户代际变化,新一代消费者对内容消费和虚拟世界更为渴求;虚拟数字人相关技术门槛相对降低,成本有所回落;资本热度上升,受Metav
  • 顶流IP“冰墩墩”带着中国元素NFT进入全球视野

    一场被国际奥委会主席评价堪称独具匠心、非凡卓越的2022年北京冬季奥运会,在这个“双奥之城”经历了16个令人难忘的精彩日夜,最终圆满闭幕。让我们印象深刻的不
  • 2022年去中心化交易所会崛起吗?

    “在某个时候,去中心化衍生品的交易量可能会超过去中心化现货交易所。”DEX 越来越多地转向第二层解决方案。“数字化金融市场的概念以及如何沿着以用户为中心
  • 与元宇宙美少女艺术家的对话

    我最近宣布了我自己的NFT项目,这是我已经工作了几个月的事情。由于我之前只是一个收藏家,拥有自己的项目真的给了我一个新的视角来看待这个领域。我一直欢迎人们
  • 就业年龄歧视如何解决?来Web3看看

    上周,我突然想到我的第一份工作实际上是在为一家失败的航空公司制定破产退出计划,那年我们的协议实习生刚出生。在一阵恐慌后,我又花了一点时间反思我这个拥有近1
  • MR——元宇宙平台的下一代入口

    作为“元宇宙”的领头羊,Meta的一举一动都受到业内的高度关注。华尔街见闻提及,2月17日周四,Facebook母公司Meta在透露,其混合现实技术(MR)将在几年后实现,让人们对元
Top