Stability AI 为其音乐生成模型 Stable Audio 3.0 增加了两个新的使用入口。一个是可以在 DAW(数字音频工作站)内部直接生成声音的插件,另一个是面向生成之后继续打磨的全新网页应用。两者均为测试版,官方表示生成结果可用于商业用途。

生成的声音直接落在音轨上

新的 Stable Audio 插件在 DAW 中以乐器的形式运行。在 Ableton Live 里位于乐器音轨的 PlugIns 中,在 Logic Pro 里则放入 Instrument 插槽。生成的音频会直接出现在该音轨上,可以像其他素材一样排列、加效果、剪辑。

在此之前,用生成式 AI 做声音通常要先在网页上导出文件,下载后再导入 DAW,来回折腾。去掉这段往返看似细节,但在实际工作中积累起来的影响并不小。

插件与工程的配合也做了考虑。同步到工程的 BPM 之后,生成内容就能落在既有节奏上。长度可以从一小段指定到最长 6 分钟的完整曲目,多次生成的版本还能保存为播放列表逐一比较。

支持格式为 macOS 平台的 AU 与 VST3,同时兼容 Apple Silicon 和 Intel 架构的 Mac,并支持包括 Logic Pro 和 Ableton Live 在内的主流 DAW。

网页端从一次成型转向边改边磨

另一处更新在 StableAudio.com。新版网页应用围绕这样一条路径构建:先用提示词生成第一版,再在其基础上反复修改。

修改指令可以用自然语言给出,比如减少低频、把高潮往后挪、更换乐器配置等。此外还提供 audio-to-audio,可以把已有的音频推向别的曲风、氛围或变体。

生成结果也不再只是一次性的整体导出。每条音轨都可以调整音量、声像、静音和独奏,并支持单轨效果与总线效果。既可以只导出需要的分轨,也可以导出完整混音,长度同样支持延长。

换句话说,这次的重点是:当一版接近但还不满意时,不必推倒重来,而是保留工程继续打磨。

商业使用与测试版的前提

插件和网页应用都运行在 Stability AI 所称的 commercially-safe(商业使用层面安全)模型之上。生成结果的权利归使用者所有,可以自由分发。在训练数据来源容易引发争议的音乐生成领域,是否明确说明这一点,往往是实际选型时的判断依据。

不过,两者目前都处于早期测试阶段。部分功能仍属实验性质,官方表示会持续调整。若打算将其纳入正式的制作流程,建议先在自己的环境中确认导出质量与稳定性。

总结

Stability AI 公开测试了面向 Stable Audio 3.0 的 DAW 插件,以及编辑功能得到强化的网页应用。插件以 macOS 的 AU/VST3 形式进入 Logic Pro 或 Ableton Live 的乐器插槽,支持 BPM 同步、最长 6 分钟的生成以及多版本比较。网页端则具备自然语言修改、audio-to-audio、分轨混音与导出,使生成从一次性的赌注变成制作流程中的一环。