原标题:英伟达推出新AI模型Fugatto,可修改并生成新声音
英伟达(NVDA.US)推出了一款用于生成音乐和音频的新型人工智能(AI)模型,旨在为制作音乐、电影和视频游戏的人们提供服务。
根据英伟达的说法,这款模型名为Fugatto(Foundational Generative Audio Transformer Opus),可以使用任何文本和音频文件来生成或修改音乐和声音。
例如,该模型可以根据文本提示创建音乐片段,从现有歌曲中删除或添加乐器,改变声音中的口音或情绪,甚至发出从未听过的声音。
英伟达应用音频研究经理、管弦乐队指挥兼作曲家Rafael Valle表示:“我们希望创建一个能像人类一样理解和产生声音的模型。”
英伟达指出,广告代理商可以使用Fugatto快速定位多个地区的现有广告,并在配音中加入不同的口音和情感。此外,视频游戏开发者可以使用人工智能模型修改游戏中预先录制的资产,以适应用户在玩游戏时不断变化的动作。
Fugatto可以使小号发出狗吠声或萨克斯管发出喵喵声。该公司补充说,通过微调和少量的歌唱数据,研究人员发现它可以处理未经预先训练的任务,比如从文本中生成高质量的歌声。
英伟达表示,Fugatto的完整版本使用了25亿个参数,并在包含32个Nvidia H100 Tensor Core GPU的Nvidia DGX系统上进行了训练。该模型的整体工作耗时一年多。
Fugatto可能会与Runway等初创公司以及 Meta Platforms(META.US)等大公司的类似技术展开竞争。10月,Meta 发布了名为Movie Gen的人工智能模型,该模型可以根据用户提示创建逼真的视频和音频剪辑。
今年 2 月,ChatGPT制造商OpenAI推出了Sora,它可以根据文本指令创建逼真且富有想象力的场景。这家由微软(MSFT.US)支持的公司尚未向公众发布文本转视频模型。
责任编辑:于健 SF069
同时,对于某些销售价格确实变动比较频繁、时令性较强的商品,《规范》强调,在价格发生变动时,商家应当及时在经营场所显著位置进行更新。
同时,不时有朋友、同事带孩子找我学写字,随着接触的不断增多,我越发感觉到汉字书写成为青少年遇到的难题,学生们需要有老师教他们写好字。
同年7月起任红20军参谋长、红3军第7师师长、红15军军长等职,参加中央苏区第一、二、三次反“围剿和漳州、南雄水口、乐安宜黄等战役。
同时,《通知》中还指出,禁止收取任何形式的出境游押金后,旅行社应当完善对游客签证材料以及相关证明材料的审核评估,把好审核评估关,最大限度地降低因不再收取出境游押金可能引起的经营风险。
通知指出,要把思想建设放在首位,教育引导党员尊崇党章、遵守党规,以习近平总书记系列重要讲话精神武装头脑、指导实践、推动工作,着力解决党员队伍在思想、组织、作风、纪律等方面存在的问题,努力使广大党员进一步增强政治意识、大局意识、核心意识、看齐意识,坚定理想信念、保持对党忠诚、树立清风正气、勇于担当作为,充分发挥先锋模范作用。
(来源:(湖南在线))