谷歌推出AI扩散模型Lumiere,可通过文字生成连贯动作视频
【#谷歌推出AI扩散模型Lumiere#,可通过文字生成连贯动作视频】谷歌研究院日前推出了一款名为 Lumiere 的“文生视频”扩散模型,主打采用自家最新开发的“Space-Time U-Net”基础架构,号称能够一次生成“完整、真实、动作连贯”的视频。谷歌表示,业界绝大多数“文生视频”模型无法生成时间长、质量佳、动作连贯逼真的内容,这是因为此类模型通常“分段生成视频”,首先产生几张关键帧,接着用“时间超级分辨率(Temporal Super-Resolution)”技术,生成关键帧之间的视频文件,这种方法虽然能够节省 RAM,但难以生成“连贯逼真”的视频。
谷歌提到,他们的新模型 Lumiere 相对于业界模型最大的不同是采用了全新“Space-Time U-Net”基础架构,该架构能够在空间和时间上同时“降采样(Downsample)”信号,从而在“更紧凑的时空中进行更多运算”,令 Lumiere 生成持续时间更长、动作更连贯的视频。Lumiere 一次可以生成 80 帧视频(16FPS 下 5 秒视频 / 24FPS 下约 3.34 秒视频),虽然这一数据看起来很短,不过谷歌研究人员提到,5 秒视频长度实际上“已经超过大多数媒体作品中的平均镜头时长”。(IT之家)


发布于:北京
相关推荐
谷歌推出AI扩散模型Lumiere,可通过文字生成连贯动作视频
这款视频生成人工智能工具,可生成超高清视频
四款视频大模型5大场景测评:Sora到底有多炸裂?
谷歌DeepMind发布Genie 2模型:一键生成3D游戏
国产大模型新年动作频频:智谱联手华为开源新模型,MiniMax开源评测集
又一个视频生成AI火了:Pika五大功能分析
半年过去,AI视频卷到哪儿了?
Sora不吃香了?Runway推出新一代视频生成模型
AI视频生成有多卷?
凌晨重磅!谷歌、OpenAI接连发布!
网址: 谷歌推出AI扩散模型Lumiere,可通过文字生成连贯动作视频 https://www.xishuta.cn/newsview106844.html
推荐科技快讯
- 1问界商标转让释放信号:赛力斯 95792
- 2报告:抖音海外版下载量突破1 25736
- 3人类唯一的出路:变成人工智能 25175
- 4人类唯一的出路: 变成人工智 24611
- 5移动办公如何高效?谷歌研究了 24309
- 6华为 nova14深度评测: 13155
- 7滴滴出行被投诉价格操纵,网约 11888
- 82023年起,银行存取款迎来 10774
- 9五一来了,大数据杀熟又想来, 9794
- 10手机中存在一个监听开关,你关 9519
