xiaoye 发表于 2026-5-27 19:23:36

Stability AI 发布 Stable Audio 3:长音频秒级生成

知名人工智能公司 Stability AI 近日正式发布了其最新一代音频大模型Stable Audio3,并同步开源了部分模型权重。
创新架构打破硬件限制
Stable Audio3采用SAME语义声学自编码器,实现了高达4096倍的音频压缩率。
超高效率实现即时渲染
仅需约0.62秒便可渲染出一段20秒的音频,而生成长达380秒的音乐也仅需1.31秒。
来源:AIBase | https://news.aibase.com/zh/news/28377
页: [1]
查看完整版本: Stability AI 发布 Stable Audio 3:长音频秒级生成