向右滑动:上一篇 向左滑动:下一篇 我知道了
广告

人工智能生成的声音可以欺骗你的耳朵

MIT开发出一款人工智能系统,该系统可“观看”无声视频并生成该视频应该包含的声音……

人工智能已经突破了一项声音障碍。麻省理工学院(MIT)的研究人员开发了一款人工智能系统,可以“观看”无声的视频并且生成一段声音,效果十分逼真,以至于多数观众无法分辨出这些声音是否是计算机生成的。40Kesmc

MIT计算机科学和人工智能实验室(MIT Computer Science and Artificial Intelligence Laboratory)称,其“深度学习算法”是头一个通过“声音图灵测试”的,生成的声音能够以假乱真。
20160616-AI-1
这款视觉指示声音系统(Visually Indicated Sounds,简称Vis)受到训练,能够对棍子击打、刮擦或者捅一系列物体(从树叶、水到土壤和钢铁)时发出的声音进行分析。40Kesmc

研究人员称,Vis的本领可以延伸至很多其他场景。例如,未来的版本可以为电影和电视生成比传统方法(比如在铝箔上撒盐以模拟雨声)更逼真的声音效果。40Kesmc

该项目的负责人安德鲁•欧文斯(Andrew Owens)称,更重要的应用或许是帮助机器人理解物体的物理属性、更好地与它们所在的环境互动。该项目将于本月晚些时候在拉斯维加斯举行的计算机视觉与模式识别大会(CVPR)上展出。40Kesmc

“机器人可以看着人行道、本能地知道水泥地是硬的而草地是软的,因此知道如果它踩上两种地面会发生什么,”他说,“能够预测声音,是预测与世界进行物理互动的后果的重要第一步。”40Kesmc

该MIT团队“训练”Vis的方法是,向其输入包含4.6万种声音的1000段视频,这些声音是鼓槌在不同坚实度的物体上敲打或划过而产生的。之后,帮计算机在大量数据中找到模式的“深度学习”算法对这些声音进行解构。40Kesmc

为了从无声视频片断中预测一种新声音,Vis会查看最可能与每个视频画面相关的音频属性,并把这些音频串在一起编辑成连贯的声音。Vis可以模拟快节奏和舒缓的微妙声音,无论是断断续续拍打岩石的声音,还是穿过常春藤时发出的细小沙沙声。它既可以模拟击打垫子发出的低沉砰砰声,又可以模拟敲击栏杆时发出的刺耳声音。40Kesmc

为了测试这些声音在人耳听起来的逼真性,研究人员对400名观众进行了调查。他们观看了两遍视频,其中一遍听的是真实声音,另一遍听的是Vis的模拟版。他们要说出哪一次是真实的声音。40Kesmc

如果Vis生成的声音与真实的声音无法区分,Vis版被选择的概率应为50%。结果调查得出的概率为40%,这是一个相当不错的分数。40Kesmc

当声音清晰、尖锐时——比如敲木头或金属的声音——该系统的表现最差,在生成由树叶或泥土产生的较轻柔、持续时间较长的声音时,Vis表现最好。有时,如果棍子刚好停在目标物之前,它还会“幻想出”假的敲击声。40Kesmc

欧文斯的梦想是在没有明确视觉线索的情况下让Vis模拟声音。“从微风轻抚、到笔记本电脑的嗡嗡作响,任何时候环境中都存在着许多与我们正盯着看的东西无关的声音,”他说。(来源/FT中文网)40Kesmc

20160613-ESMC-140Kesmc

Edit
本文为国际电子商情原创文章,未经授权禁止转载。请尊重知识产权,违者本司保留追究责任的权利。
  • 微信扫一扫,一键转发

  • 关注“国际电子商情” 微信公众号

您可能感兴趣的文章

  • Q1全球EDA收入同比增长14.4%,达到45亿美元

    国际电子商情18日讯 据SEMI旗下电子系统设计(ESD)联盟在其最新的电子设计市场数据 (EDMD)报告指出,2024年一季度电子系统设计(主要包括EDA及半导体IP)市场营收45.216 亿美元,相比去年同期的39.511 亿美元增长了 14.4%。

  • 打破MCU内卷魔咒,航顺芯片如何出招?

    近几年,MCU厂商的经历像极了坐过山车。2020-2021年因芯片产能受限,全球MCU市场供不应求、价格“狂飙”,相关厂商迎来增长红利期。但到2022-2023年,整个芯片市场陷入库存积压,MCU厂商不惜亏本降价清库存,拼成本、杀价格、争市占,持续高度内卷的状态。

  • 智能制造定义演变史:工业4.0、IIoT、元宇宙、AI……

    这两年,我们听到的有关智能制造的周边词汇越来越多,比如:IIoT(工业物联网)、自主机器人、增材制造(additive manufacturing)、边缘计算、工业数字孪生/工业元宇宙、工业4.0,甚至还有工业5.0。

  • 不被苹果看好的Micro LED赛道,还能有哪些创新方向?

    前段时间,苹果宣布取消Micro LED手表和自动驾驶项目,当时就有分析师猜测,或与其重心转移到人工智能(AI)上有关。最近,苹果在全球开发者大会上发布了Apple Intelligence系统,并宣布将为自家设备引入AI功能。很显然,苹果现在更看好AI的商用化,而被它放弃的Micro LED赛道,接下来会如何发展?

  • 协作机器人帮助打破供应链瓶颈

    随着工业4.0时代的到来,工厂自动化已成为制造业发展的关键,协作机器人在生产线上扮演着越来越重要的角色。

  • 2024年下半年存储芯片价格走势及未来技术方向

    截至2024年Q2,存储行业仍在上行周期,整条产业链生机勃勃。在多重因素的影响下,存储芯片下半年的价格将如何演变,存储技术的未来又指向何方?

相关推荐

可能感兴趣的话题