静安“模界场”第二场活动聚焦音频大模型创新,将发布喜马拉雅Audiobook-a2(全国首个备案音频生成大模型)、夜莺-东方声愈ACE1.5Step(国内首个临床治疗逻辑音乐疗愈模型),火山引擎解读云原生架构,并举行两大国家级平台揭牌及生态签约。
真正的行业风向,往往藏在那些不张扬的场合。例如静安,本周即将亮相的“模界场”系列活动第二场,正是这样的风向标。如果你关注过之前的动态,应该还记得黄浦江畔那场聚焦超高清与AI的多模态盛宴。而这次,很快就要登场。
本周四,一场聚焦音频大模型创新突破的大会将在市北国际科创区举行。主题明确为:“模界聚声·智域启航”。简单来说,大会旨在将超高清视听产业与垂类大模型深度融合,探索两者的协同效应。
长期稳定更新的攒劲资源: >>>点此立即查看<<<


活动现场将集结一批“硬核”角色——头部互联网企业、顶尖专业院校、云算力服务商,以及产业链关键玩家。他们将带来:标杆音频垂类大模型的集中亮相、前沿技术主旨分享、平台揭牌,以及一系列生态签约。这可以视作一次“超高清视听+多模态大模型”领域的成果展示与行业风向标。

这是全国首个通过国家网信办生成式人工智能服务备案的音频生成类大模型,分量不言而喻。

该模型依托喜马拉雅超过100万小时的自有版权音频训练数据,自研的audiobook系列TTS大模型已迭代七代。在长篇章有声书这种高难度场景下,其表现力和稳定性均优于业界主流方案。珠峰AI已积累9,384个角色音色和超过300个自研音色资产,累计生产音频超1,000万小时。更重要的是,其AI智能体(Agent)能力将专业有声制作流程打造成MCP能力矩阵——从人机协作到Agent闭环,这属于有声领域Agent范式的领先实践。

该模型来自上海音乐学院人工智能音乐疗愈重点实验室。实验室的特色在于:它是国内首个横跨“艺术学”“医学”“工学”三个一级学科的重点实验室,将音乐疗愈从传统心理学范畴直接拉入神经科学领域。夜莺模型融合了WFS空间音频技术与AI音乐生成算法,可实现三维全息声场和精准的声波频率调节。现场将由上海音乐学院博士后研究员、实验室骨干成员杨维佳,以及脑舒科技CEO马诗轩共同发布分享。
解决方案架构师张宇洋将带来一场题为《AI云原生时代——火山豆包大模型能力分享》的演讲,深度解读云原生架构如何为视听垂类模型的训练、部署和规模化落地提供底层支撑。

此外,大会还将举行两大国家级平台的揭牌仪式——中国联合展台上海视听工作站和长三角智慧运维工作组。同时,智诚流金联展视听共创平台将同步启用,AI视听成果实验验证平台也将完成签约。背后的逻辑很清晰:技术、学术、平台和场景需要深度耦合,而非各自为战。


时间:6月25日(周四)14:00-16:00
地点:视听静界·元空间(元气场会议室),上海市静安区江场路1450弄云芯科创中心T1幢7层
最后补充一下,“模界场”平台本身。它是“视听静界元空间”在AI时代的战略延伸载体。依托市北国际科创区的产业集聚优势,其目标是打造一个超高清视听+AI多模态的一体化创新平台,将视听全产业链与AI大模型创新通道真正串联起来。空间算力、数据场景、资本政策、技术研发、生态出海——五个板块提供全周期配套服务,并通过常态化峰会、沙龙、供需对接和成果路演,最终形成算力、模型、内容、场景、生态一体化的完整产业闭环。这正是区域超高清视听产业生态提质赋能的底层逻辑。
侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述