英伟达推出新AI模型Fugatto,可修改并生成新声音
英伟达(NVDA.US)推出了一款用于生成音乐和音频的新型人工智能(AI)模型,旨在为制作音乐、电影和视频游戏的人们提供服务。
根据英伟达的说法,这款模型名为Fugatto(Foundational Generative Audio Transformer Opus),可以使用任何文本和音频文件来生成或修改音乐和声音。
例如,该模型可以根据文本提示创建音乐片段,从现有歌曲中删除或添加乐器,改变声音中的口音或情绪,甚至发出从未听过的声音。
英伟达应用音频研究经理、管弦乐队指挥兼作曲家Rafael Valle表示:“我们希望创建一个能像人类一样理解和产生声音的模型。”
英伟达指出,广告代理商可以使用Fugatto快速定位多个地区的现有广告,并在配音中加入不同的口音和情感。此外,视频游戏开发者可以使用人工智能模型修改游戏中预先录制的资产,以适应用户在玩游戏时不断变化的动作。
Fugatto可以使小号发出狗吠声或萨克斯管发出喵喵声。该公司补充说,通过微调和少量的歌唱数据,研究人员发现它可以处理未经预先训练的任务,比如从文本中生成高质量的歌声。
英伟达表示,Fugatto的完整版本使用了25亿个参数,并在包含32个Nvidia H100 Tensor Core GPU的Nvidia DGX系统上进行了训练。该模型的整体工作耗时一年多。
Fugatto可能会与Runway等初创公司以及 Meta Platforms(META.US)等大公司的类似技术展开竞争。10月,Meta 发布了名为Movie Gen的人工智能模型,该模型可以根据用户提示创建逼真的视频和音频剪辑。
今年 2 月,ChatGPT制造商OpenAI推出了Sora,它可以根据文本指令创建逼真且富有想象力的场景。这家由微软(MSFT.US)支持的公司尚未向公众发布文本转视频模型。
标签: 伟达
相关文章
-
英伟达将向OpenAI投资1000亿美元详细阅读
英伟达公司表示,将向OpenAI投资至多1000亿美元,用于支持新数据中心及相关基础设施的建设,以承载人工智能工作负载。 英伟达在周一的一份声...
2025-09-23 16 伟达
-
英特尔最大难题未因英伟达50亿美元入股而化解详细阅读
英伟达(NVDA)宣布将斥资50亿美元入股英特尔(INTC)的决定或许令投资者欢欣鼓舞,后者股价周四一度飙升30%。但这项投资对解决英特尔最大难题...
2025-09-20 16 伟达
-
英伟达出手,英特尔大涨超26%详细阅读
9月18日晚间,英特尔美股盘前短线拉升涨超26%。消息面上,英伟达与英特尔宣布建立合作关系:英伟达将投资50亿美元于英特尔,每股价格为23.28美...
2025-09-18 15 伟达
-
英伟达营收展望不温不火 引发人工智能支出放缓之忧详细阅读
专题:英伟达Q2数据中心收入不及市场预期 本季度营收指引不够亮眼 全球市值最高的上市公司英伟达对当前季度的收入预测不温不火,这令人们担忧巨幅增长...
2025-08-28 16 伟达
-
期权交易透露市场情绪:英伟达财报预计带来6.5%的股价波动详细阅读
财联社8月26日讯(编辑 马兰)英伟达将在周三美股收盘后公布其业绩,期权交易员预计这份财报将为英伟达市值带来高达2880亿美元的波动。 根据期权定价,...
2025-08-27 22 伟达
-
期权数据显示:英伟达财报发布后股价或波动6%详细阅读
专题:聚焦2025年第二季度美股财报 美国期权市场数据显示,芯片制造商英伟达(Nvidia)定于周三发布第二季度财报,期权交易员预计,财报公布...
2025-08-27 20 伟达