生成式音乐模型 + 工作台
AUDIOGEN 将生成式音乐模型与新的音乐创作界面结合在一起,而不是把生成当作一个独立的提示框。
AUDIOGEN 是一款基于浏览器的生成式音乐产品,结合了音乐模型与全新的歌曲创作和编辑界面。公司将其描述为一个“生成式音频工作站”,旨在让音乐创作更像在时间线上作画,核心交互包括修补、延展、混音以及多轨或分轨编辑。
该产品介于研究预览和创作者工具之间:演示页面展示了跨多种流派和人声风格生成的音频样本,而关于页面说明团队花费了 2.5 年构建模型,并围绕适合初学者的浏览器体验重新设计工作流。现有页面未说明集成、导出或定价信息。
AUDIOGEN 将生成式音乐模型与新的音乐创作界面结合在一起,而不是把生成当作一个独立的提示框。
公司表示,它从零开始重建了 DAW/时间线体验,打造出一个对初学者友好的网页 GAW。
该界面围绕画布上的修补、延展、混音以及多轨或分轨编辑而设计。
演示页面展示了多种风格和模式,包括人声、纯音乐以及“weird mode”示例,涵盖流行、独立民谣、电子和圣咏等流派。
关于页面列出了三个模型组件:Aphrodite,一种神经音频编解码器;Apollo,一种扩散 Transformer;以及 Virgil,一种合成音频描述器。
演示页面包含标注为研究和演示用途的音频样本,并注明部分样本复现了受版权保护的内容。
创作者可以从一个音乐想法开始,使用时间线界面添加、延展或修改段落,而无需离开浏览器。
用户可以借助修补和混音工具更改某一段内容,同时保留周围的编曲结构。
探索风格的人可以浏览演示,听听系统如何处理不同流派、人声处理和器乐音色。
研究人员或技术读者可以通过演示示例了解模型栈的呈现方式,包括编解码器和扩散组件。
AUDIOGEN 将自己定位为一款生成式音乐模型,并配套一个基于网页的生成式音频工作台。该网站强调在时间线界面中进行创作、修补、延展、混音以及基于多轨或分轨的编辑。
网站说明它是一个对初学者友好的网页 GAW,因此设计上可直接在浏览器中使用。现有页面未提供安装步骤、本地安装细节,或受支持的桌面/移动应用信息。
来源未列出导出格式、文件类型或发布选项。不过它展示了生成音乐和编解码器研究样本的演示,这说明该产品更侧重创作与实验,而非交付格式说明。
来源称团队围绕修补、延展、混音以及多轨/分轨编辑重建了 DAW/时间线体验。它没有提到协作功能或团队工作区。
定价页面当前返回 404 页面,因此可用来源无法确认价格或方案结构。