首页 > 人工智能 >Stable Audio 2.5 企业级音频生成 AI 模型发布,号称“3 分钟曲目 2 秒钟完成”

Stable Audio 2.5 企业级音频生成 AI 模型发布,号称“3 分钟曲目 2 秒钟完成”

来源:ithome 2025-09-14 22:30:15

xiayx 9月14日消息,Stability AI 现已正式发布企业级音频生成模型 Stable Audio 2.5,相对上一代主要围绕音频细节、生成速度方面进行提升,号称“仅需 2 秒钟即可创建 3 分钟音频曲目”。

Stable Audio 2.5 企业级音频生成 AI 模型发布,号称“3 分钟曲目 2 秒钟完成”

据介绍,Stable Audio 2.5 的核心改进集中在音乐生成能力方面,号称生成结果更加贴合实际编曲逻辑,可呈现前奏、发展与结尾等完整多段式结构。同时新模型对提示词的理解更为准确,尤其在情绪描述和音乐风格词汇的把握上,响应更符合预期。

此外,新版模型还显著改进了音频生成速度,Stability AI 称这主要得益于研发团队提出的后训练方法 ARC(xiayx注:Adversarial Relativistic-Contrastive),这一技术通过结合相对式对抗训练与对比判别器,加速扩散模型的生成过程,可在保证音轨质量的同时显著降低 GPU 推理耗时,从而实现 2 秒钟生成长达 3 分钟的音频内容。

除此之外,Stable Audio 2.5 还新增了音频修补能力,用户可以导入自己的音频文件,并指定“延展位置”,模型即可根据音频前后内容及整体曲风,将音频一键“延长”,特别适合剪辑等场景。

目前,Stable Audio 2.5 已可通过 StableAudio 官网直接试用,同时支持本地化部署。不过官方规定,用户上传的音频文件不得包含受版权保护的内容,StableAudio 网站将利用自带的内容识别系统进行检测,以确保不侵犯他人版权。

侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述

热游推荐

更多
湘ICP备14008430号-1 湘公网安备 43070302000280号
All Rights Reserved
本站为非盈利网站,不接受任何广告。本站所有软件,都由网友
上传,如有侵犯你的版权,请发邮件给xiayx666@163.com
抵制不良色情、反动、暴力游戏。注意自我保护,谨防受骗上当。
适度游戏益脑,沉迷游戏伤身。合理安排时间,享受健康生活。