英伟达(NVDA.US)推出了一款用于生成音乐和音频的新型人工智能(AI)模型,旨在为制作音乐、电影和视频游戏的人们提供服务。
根据英伟达的说法,这款模型名为Fugatto(Foundational Generative Audio Transformer Opus),可以使用任何文本和音频文件来生成或修改音乐和声音。
例如,该模型可以根据文本提示创建音乐片段,从现有歌曲中删除或添加乐器,改变声音中的口音或情绪,甚至发出从未听过的声音。
英伟达应用音频研究经理、管弦乐队指挥兼作曲家Rafael Valle表示:“我们希望创建一个能像人类一样理解和产生声音的模型。”
英伟达指出,广告代理商可以使用Fugatto快速定位多个地区的现有广告,并在配音中加入不同的口音和情感。此外,视频游戏开发者可以使用人工智能模型修改游戏中预先录制的资产,以适应用户在玩游戏时不断变化的动作。
Fugatto可以使小号发出狗吠声或萨克斯管发出喵喵声。该公司补充说,通过微调和少量的歌唱数据,研究人员发现它可以处理未经预先训练的任务,比如从《加拿大官方预测网》文本中生成高质量的歌声。
Fugatto可能会与Runway等初创公司以及 Meta Platforms(META.US)等大公司的类似技术展开竞争。10月,Meta 发布了名为Movie Gen的人工智能模型,该模型可以根据用户提示创建逼真的视频和音频剪辑。
责任编辑:于健 SF069
硅业分会进一步分析了当前硅片环节的供需情况,在供给端, ♓一线企业和专业化企业再度降低开工率,原因一是企业对上游硅料降 ✋价持观望态度,二是为了解决硅片供应过剩造成的库存问题。需求端 ➣则加拿大官方预测网面临全产业链降价与终端萎靡,其中,电池端,大尺寸利润相对丰 ♋厚,因此企业仍维持开工率生产,组件端以执行前期订单为主,海外 ♉出口维持正常。
美股缘何又大跌 ✋?除了GDP数据,回购禁售期开始也是重要 ⛔推手
本报记者 胡耀宇 【编辑:拉西德 】