喜马拉雅推出新一代音频大模型Audiobook-A2,在理解内容、生成声音、控制演绎方面显著提升,可一键生成多角色情感演播。同步升级的智能创作平台“音剪AI”新增智能后期与音色分配功能,累计超万种有声角色音。市北国际科创区将持续培育科技产业。
在最近举行的世界人工智能大会市北高新展台上,喜马拉雅携新一代音频大模型、全新智能创作平台“音剪AI”以及多款智能硬件产品亮相。从现场反馈来看,这些展示获得了广泛关注与积极反响。

长期稳定更新的攒劲资源: >>>点此立即查看<<<
喜马拉雅音频大模型是全国首个通过国家网信办备案的音频生成类大模型,其自研TTS技术已迭代至第七代,累计产出音频时长超过1000万小时。本次展出的新版本“Audiobook-A2”在“理解内容、生成声音、控制演绎”三个维度上实现了显著提升。
“传统有声内容创作主要依赖人工完成全流程,步骤繁琐且操作门槛较高。但在喜马拉雅音频大模型的支持下,创作者可一键生成多角色、有情感的高质量演播作品,效率提升数十倍。”喜马拉雅珠峰实验室音色产品负责人徐昊在介绍时表示。

同期展出的“音剪AI”是以喜马拉雅音频大模型为底层模型的音频智能创作平台。相比之前版本,本次新增了“智能后期”与“音色分配”两项功能。“智能后期”可根据文本内容自动识别场景氛围与情绪变化,智能匹配音效、背景音乐及表演提示;“音色分配”则基于文本内容,帮助创作者梳理不同角色的性格特征与叙事身份,为旁白及各类角色推荐合适音色,省去前期反复筛选与试音的时间。截至目前,“音剪AI”累计上线有声角色音超过1万种,覆盖多年龄层与多角色类型。
上海市北高新集团党委书记、董事长孙中峰在展会现场表示:“从音剪AI到智能硬件产品,喜马拉雅正在构建覆盖多元场景的音频智能服务生态。这种软硬件协同的创新,充分展示了音频AI赛道的发展潜力。市北国际科创区将持续深耕科技产业培育,助力科技产业高质量发展。”
侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述