2026年日内瓦AIforGood峰会期间,中国信通院举办大模型评测研讨会,发布“方升”评测体系。该体系兼具创新指南、应用连接和安全保障三重功能,未来将聚焦复杂任务验证、系统风险识别及成本效率协同,并深化国际协作,推动开放包容的AI评测生态。
2026年7月8日,瑞士日内瓦,人工智能向善(AI for Good)全球峰会期间,中国信息通信研究院举办了一场聚焦“大模型评测与标准”的研讨会。这场会议的直接背景,是响应《联合国全球数字契约》中关于“消除AI评测领域新数字鸿沟”的倡议。

长期稳定更新的攒劲资源: >>>点此立即查看<<<
会上,中国信通院人工智能研究所所长魏凯做了题为“大模型评测:实践与标准化”的主题报告,并正式介绍了“方升”大模型评测体系。在魏凯看来,大模型评测承担着三重角色:它既是牵引技术创新的“指南针”,也是连接技术与应用的“连接器”,更是保障AI向善发展的“安全阀”。面向未来,能力评测的重心将转向更复杂的任务验证,安全可信评测要从单点走向系统风险识别,而工程效能评测则必须强化成本与效率之间的协同——这几个方向,基本勾勒出了下一步评测标准化的攻坚要点。
会议结束后,魏凯接受了央视一线记者的专访。他透露,中国信通院接下来会进一步深化与ITU、IEC、ISO等国际组织的合作,同时联合全球产业界、学术界和开源社区,开放共享评测方法、数据集和实践经验。目标很明确:推动形成开放、包容、互操作的人工智能评测生态,为人工智能向善发展提供来自中国的实践样本。
侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述