当前位置:首页 > 科技  > 网络

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度

来源: 责编: 时间:2024-01-26 09:01:05 312观看
导读 谷歌一出手,又把AI视频生成卷上了新高度。一句话生成视频,现在在名为Lumiere的AI操刀下,可以是酱婶的:△“阳光明媚,帆船在湖中航行”如此一致性和质量,再次点燃了网友们对AI视频生成的热情:谷歌加入战

谷歌一出手,又把AI视频生成卷上了新高度。bCK28资讯网——每日最新资讯28at.com

一句话生成视频,现在在名为Lumiere的AI操刀下,可以是酱婶的:bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度△“阳光明媚,帆船在湖中航行”bCK28资讯网——每日最新资讯28at.com

如此一致性和质量,再次点燃了网友们对AI视频生成的热情:谷歌加入战局,又有好戏可看了。bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

不止是文生视频,Lumiere把Pika的“一键换装”也复现了出来。bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度左谷歌右pika,同样是选中区域一句话完成视频编辑,你pick哪一边?bCK28资讯网——每日最新资讯28at.com

让图片中静止的火焰跃动起来,也同样一选就能完成:bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

还有图片转视频:bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

视频风格化:bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

总之就是主打一个质量又高又全能。bCK28资讯网——每日最新资讯28at.com

更多细节,我们论文扒起~bCK28资讯网——每日最新资讯28at.com

用于视频生成的时空扩散模型bCK28资讯网——每日最新资讯28at.com

Lumiere旨在解决以往视频生成中存在的几个关键问题:bCK28资讯网——每日最新资讯28at.com

真实性bCK28资讯网——每日最新资讯28at.com

多样化bCK28资讯网——每日最新资讯28at.com

运动的连贯性bCK28资讯网——每日最新资讯28at.com

在此前的方法中,常见的做法是,扩散模型先生成一些稀疏的关键帧,而后通过一系列时间超分辨率(TSR)模型来填补关键帧之间的空白,接着再用空间超分辨率模型获取高清视频结果。bCK28资讯网——每日最新资讯28at.com

可以想见,在全局连贯性上,这样的做法存在先天的缺陷。bCK28资讯网——每日最新资讯28at.com

Lumiere的创新点在于,提出了时空U-Net(STU-Net)架构:将视频在空间和时间两个维度同时进行下采样和上采样,在网络的中间层得到视频的压缩时空表示。bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

具体来说,基于这一架构,模型能够一次性生成视频中的所有帧——这也就提升了生成视频的连贯性。bCK28资讯网——每日最新资讯28at.com

同时,因为大部分计算发生在压缩后的表示上,STU-Net能有效减少计算量,降低对计算和内存的需求。bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

另外,为了提升视频的分辨率,研究人员使用多重扩散(MultiDiffusion)技术,通过线性加权空间超分辨率网络来处理重叠时间窗口带来的边界伪影等问题,从而能将生成画面融合为一个整体,得到连贯、高清的视频效果。bCK28资讯网——每日最新资讯28at.com

时长和分辨率方面,Lumiere能输出1024×1024、16fps下长5秒的视频。bCK28资讯网——每日最新资讯28at.com

研究人员提到:bCK28资讯网——每日最新资讯28at.com

5秒已经超过了大多数视频作品中的平均镜头长度。bCK28资讯网——每日最新资讯28at.com

值得一提的是,得益于时空U-Net架构端到端全帧率视频生成的能力和高效计算,Lumiere灵活可扩展,可以轻松应用到下游任务中,包括文生视频、图生视频、视频风格化、视频编辑修复等等。bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度△视频修复实验结果bCK28资讯网——每日最新资讯28at.com

研究人员将Lumiere与其他文本-视频生成模型进行了实验对比。bCK28资讯网——每日最新资讯28at.com

首先来看人类用户的判断。bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

实验设计是这样的:志愿者会同时看到一对视频,一个来自Lumiere,另一个来自其他基线模型。志愿者被要求从中选出视觉质量、动态效果更好,更符合文本提示的视频。bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

研究人员收集了大约400份反馈,结果显示,在视频质量、文本匹配度方面,Lumiere超越了Pika、Gen2、Imagen Video、SVD等一众顶级视频生成模型。bCK28资讯网——每日最新资讯28at.com

同时,在UCF101数据集(动作识别数据集)上,与MagicVideo、Make-A-Video、SVD等模型相比,Lumiere取得了具有竞争力的FVD和IS指标。bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

网友:谷歌,模型呢?bCK28资讯网——每日最新资讯28at.com

效果很惊艳,网友很兴奋,但桥豆麻袋……bCK28资讯网——每日最新资讯28at.com

这次,谷歌依然只放出了论文,没有试玩,更没有开源。bCK28资讯网——每日最新资讯28at.com

这种似曾相识的操作,把人快整麻了:bCK28资讯网——每日最新资讯28at.com

视频很不错,但是谷歌,你又不打算发布任何代码、权重,也不提供API了,对吗?bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

还有人想起了Gemini发布时那个造假的小蓝鸭视频……bCK28资讯网——每日最新资讯28at.com

一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度bCK28资讯网——每日最新资讯28at.com

那么,这波你还会看好谷歌吗?bCK28资讯网——每日最新资讯28at.com

论文地址:https://arxiv.org/abs/2401.12945bCK28资讯网——每日最新资讯28at.com

项目地址:https://lumiere-video.github.io/#section_video_stylizationbCK28资讯网——每日最新资讯28at.com


文章出处:量子位

本文链接:http://www.28at.com/showinfo-17-68230-0.html一句话让小姐姐为我换了N套衣服:谷歌卷出视频生成新高度

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 继续推进摩尔定律!英特尔实现3D先进封装大规模量产

下一篇: 官宣!何超莲正式带着高端闲置入驻闲鱼

标签:
  • 热门焦点
  • 红魔电竞平板评测:大屏幕硬实力

    前言:三年的疫情因为要上网课的原因激活了平板市场,如今网课的时代已经过去,大家的生活都恢复到了正轨,这也就意味着,真正考验平板电脑生存的环境来了。也就是面对着这种残酷的
  • 六大权益!华为8月服务日开启:手机免费贴膜、维修免人工费

    8月5日消息,一年一度的华为开发者大会2023(Together)日前在松山湖拉开帷幕,与此同时,华为8月服务日也式开启,到店可享六大专属权益。华为用户可在华为商城Ap
  • 不容错过的MSBuild技巧,必备用法详解和实践指南

    一、MSBuild简介MSBuild是一种基于XML的构建引擎,用于在.NET Framework和.NET Core应用程序中自动化构建过程。它是Visual Studio的构建引擎,可在命令行或其他构建工具中使用
  • 如何使用JavaScript创建一只图像放大镜?

    译者 | 布加迪审校 | 重楼如果您曾经浏览过购物网站,可能遇到过图像放大功能。它可以让您放大图像的特定区域,以便浏览。结合这个小小的重要功能可以大大改善您网站的用户体验
  • 从零到英雄:高并发与性能优化的神奇之旅

    作者 | 波哥审校 | 重楼作为公司的架构师或者程序员,你是否曾经为公司的系统在面对高并发和性能瓶颈时感到手足无措或者焦头烂额呢?笔者在出道那会为此是吃尽了苦头的,不过也得
  • 每天一道面试题-CPU伪共享

    前言:了不起:又到了每天一到面试题的时候了!学弟,最近学习的怎么样啊 了不起学弟:最近学习的还不错,每天都在学习,每天都在进步! 了不起:那你最近学习的什么呢? 了不起学弟:最近在学习C
  • 消费结构调整丨巨头低价博弈,拼多多还卷得动吗?

    来源:征探财经作者:陈香羽随着流量红利的退潮,电商的存量博弈越来越明显。曾经主攻中高端与品质的淘宝天猫、京东重拾“低价”口号。而过去与他们错位竞争的拼多多,靠
  • 认真聊聊东方甄选:如何告别低垂的果实

    来源:山核桃作者:财经无忌爆火一年后,俞敏洪和他的东方甄选依旧是颇受外界关心的“网红”。7月5日至9日,为期5天的东方甄选“甘肃行”首次在自有App内直播,
  • Android 14发布:首批适配机型公布

    5月11日消息,谷歌在今天凌晨举行了I/O大会,本次发布会谷歌带来了自家的AI语言模型PaLM 2、谷歌Pixel Fold折叠屏、谷歌Pixel 7a手机,同时发布了Androi
Top