首页 > 汽车生活 > 汽车生活 > 谷歌真·AI配音神器来了!自动看懂画面、对齐音频

谷歌真·AI配音神器来了!自动看懂画面、对齐音频

发布时间:2024-06-18 22:34:50

6月18日消息,今日凌晨,谷歌DeepMind发布了一个名为V2A(Video-to-Audio)的系统,能根据画面内容或者手动输入的提示词直接为视频配音。它还可以为任何视频输入生成无限数量的音轨。

谷歌DeepMindV2A系统最大的特点就是无需人工输入提示词也可以为视频配音。DeepMind在博客中称V2A能依靠自己的视觉能力理解视频中的像素。也就是说,V2A能看懂画面,知道画面里正在发生什么

汽车生活更多>>

字节Seed用化学思想搞AI,把DeepSeek-R1的脑回路拆成了分子结构 北汽极狐公布高端产品系列问道 首款MPV定名问道V9 只买适合不买贵,关键性价比超高哈弗枭龙MAX最高优惠1.91万 提供限时新春礼 星光730上市80天销量破26000台 首款量产L3级SUV 岚图泰山黑武士版将于今年3月登场 AI的尽头是硅钢片!A股硅钢片相关公司主要有7家,4家股价低于5元 4.07版固件的作用是什么?华擎:解决AM5平台无法启动的问题 Navitas纳微推出10kW全GaN DC-DC电源平台,效率高达98.5% 莱森光学携高光谱技术出席“智能生态监测网”技术交流会 库克称iPhone 17等兼容机型用户正“积极利用”苹果牌AI IDC发布最新数据:OPPO系手机全球销量猛增,挤进前三! 特斯拉财报会议万字实录|马斯克意外官宣停产Model S/X;直言只有中国机器人配做对手 【智库声音】上观新闻 | 张虎祥等:社群运营:上海社区商业的新玩法 抖音电商:年货节期间品牌年货礼盒销量增长3倍 对话九识CEO孔旗:我们已实现业务现金流和毛利率正向增长 千问迭代,是阿里的又一次 AI 战略选择 哈工大系闯出人形机器人黑马:成立不到一年,全栈开源3m/s原型机 新能源车的「硬核」战事,2026年卷向何处? 贾国龙再发声:西贝从来不存在“两岁的西蓝花”,现在标准是一个月内使用完毕 ARR达2.4亿美元,可灵能带快手起飞吗? 世界级工厂按斤卖,观致常熟工厂是如何被人为做空的 两部门:对公租房建设期间用地及公租房建成后占地,免征城镇土地使用税 华住,比携程还会捞金? 追觅科技俞浩:生态链基金已获募资数量和规模双料第一 国泰海通证券:维持农夫山泉“增持”评级 料下半年提速 盈利继续乐观 国泰海通证券:维持优然牧业(09858)“增持”评级 大股东定增彰显信心 新一代奥迪Q5L卖30.98万起!盘盘优缺点,我推荐购买吗? Agent时代,为什么多模态数据湖是必选项? 索尼与本田联手造车了?AFEELA 1亮相,车内可远程操控PS游戏机 尺寸全面升级!哈弗猛龙加长版要来了,造型硬朗气派,搭1.5T插混