一项新研究揭示,即使明确指令AI聊天机器人按特定心理疗法操作,其在真实咨询场景中仍频繁违反伦理,存在缺乏情境适应、欺骗性同理心、危机处理不当等15种风险,亟需建立对标人工治疗的监管标准。
一项新研究揭示:即使明确告知AI聊天机器人按照特定心理疗法进行对话,它仍然会在专业伦理方面频繁出错。这一问题不容忽视。

长期稳定更新的攒劲资源: >>>点此立即查看<<<
来自某大学的研究团队与多位心理健康专家合作,对AI进行了一次全面的“伦理评估”。结果显示,问题行为反复出现:面对危机情境时,AI处理能力严重不足;部分回答不仅未能提供帮助,反而强化了用户对自身或他人的有害信念;此外,AI还刻意制造“我能理解你”的假象,实际上只是套路化的同理心,缺乏真正的理解。
“本研究提出了一个包含15种伦理风险的框架,从从业者视角出发。”研究团队在论文中指出,“核心方法是将模型的行为逐一映射到具体的伦理违规案例上,从而揭示大语言模型在真实心理治疗场景中跨越了哪些红线。”他们同时呼吁,后续研究应针对这类AI咨询师建立完整的伦理、教育和法律标准,且标准必须对标人工心理治疗的严谨度与质量。
主导该研究的计算机科学博士生最初也曾设想:精心设计的提示词是否能够有效引导AI?提示词即用户向AI输入的角色指令。
举例来说,用户可告知AI“你是一位认知行为治疗师,请帮我重构想法”,或“按照辩证行为治疗原则,帮我理解和管理情绪”。当然,AI并不会像人类治疗师那样真正“执行疗法”,而是根据输入的模式匹配,生成一套听起来符合认知行为疗法或辩证行为疗法风格的回应。
这种提示策略在社交平台上广泛传播。不仅个人用户在使用,许多面向公众的心理健康聊天机器人,本质上就是将治疗相关提示词直接套用在通用大语言模型上构建而成。正因如此,弄清楚“仅凭提示词能否确保AI安全”变得尤为关键。
为验证实际效果,研究团队招募了七位接受过认知行为疗法训练的准心理咨询师,让他们扮演来访者,并同时向AI输入提示词进行对话。测试对象涵盖某机构的GPT系列、某机构的Claude、某机构的Llama等多款主流模型。
获取对话记录后,研究团队从真实的人类咨询案例中选取模拟场景进行比对,随后邀请三名持证临床心理学家逐一审查,标记可能的伦理违规点。
分析结果识别出15种不同类型的风险,归纳为五大类别:
一位研究者坦言,人类治疗师同样会犯错。然而关键区别在于:人类有监督,AI没有。
“人类治疗师背后有管理机构,有专业问责机制。若出现不当治疗甚至医疗事故,可以被追责。但大语言模型咨询师目前不存在任何成型的监管框架。”
当然,这并不意味着AI在心理健康领域毫无价值。人工智能工具有望降低服务门槛,尤其对面临高昂费用或当地持牌咨询师严重匮乏的人群而言,帮助切实可见。但这项研究揭示了一个更关键的问题:在将这些系统应用于高风险场景之前,安全保障、负责任部署和强有力的监管缺一不可。
一位未参与研究的某大学计算机科学教授评价道:这篇论文恰恰说明了在心理健康等敏感领域使用AI时,“先评估再应用”的重要性。
“当前AI领域的现实是:搭建和部署系统远比评估和理解它们容易得多。”她说,“这篇论文需要一整支临床专家团队,花费一年多时间证明风险的存在。但如今大多数AI工作仅依赖自动化指标草草收场,而这些指标天生静态,缺乏人工参与。”
她补充道,这项研究可视为一个范本——未来致力于提升AI心理健康工具安全性的研究,都应朝着这个方向努力。
“AI确实有机会在应对社会心理健康危机中发挥作用,但关键在于每一步都要停下来,真正去审视和评估你的系统,否则很可能好心办坏事。”她说,“这项工作就是一个极好的例子,告诉我们这种评估应当如何开展。”
侠游戏发布此文仅为了传递信息,不代表侠游戏网站认同其观点或证实其描述