Stable Audio 3.0 Small SFX
Stable Audio 3.0 Small
Stable Audio 3.0 Medium
Stable Audio 3.0 Large
Stable Audio 3.0 最大的升级之一是 生成长度显著提升。
Stability AI 采用了混合发布策略。
开放权重模型:
API / 托管模型:
这种策略与 Stability AI 在其他生成式模型上的做法类似:为开发者开放部分能力,同时将最强模型保留在商业服务中。
在许可方面:
为了强化授权数据来源,Stability AI 与主要音乐公司建立合作关系。
这些合作被视为解决生成式音乐版权问题的一种方式,即让模型训练基于合法授权的数据。
Stable Audio 3.0 发布之际,AI 音乐领域竞争正在迅速升温。
包括 Google、Suno、Udio 和 ElevenLabs 在内的公司,都在开发能够生成高质量音乐和人声的系统。
Stable Audio 3.0 的差异化主要体现在两点:
再加上超过 6 分钟的生成时长,AI 音乐工具正逐渐从生成短 demo 片段,迈向真正意义上的完整歌曲创作平台。
Stable Audio 3.0 也反映了生成式 AI 的一个重要趋势:从单一模型转向模型家族。
通过同时提供轻量模型、开放权重模型和企业级模型,Stability AI 试图覆盖从个人创作者到专业音乐制作人的广泛用户群。