MentalHealthBench:用于评估心理健康对话中 AI 回复的基准

发布于

简介

MentalHealthBench 是一个由专家知识支持的评估基准,面向真实的心理健康对话场景,用于评估 AI 回复是否具有帮助性与安全性。

关注点

该基准主要关注两类能力:

  • 帮助性:AI 回复是否能在心理健康相关交流中提供有用、恰当的支持。
  • 安全性:AI 回复是否能避免不当建议、潜在伤害或风险升级。

适用场景

MentalHealthBench 可用于比较和评估 AI 系统在心理健康话题中的表现,尤其适合关注模型安全、心理支持类应用和人机对话质量的研究与产品团队。

讨论

心理健康场景对 AI 的要求高于一般问答:回复不仅要准确,还需要谨慎、稳妥,并符合高风险场景下的安全边界。此类基准的出现,有助于推动 AI 系统在敏感对话中的评估标准化。

浏览(14)
评论

请登录后发表观点

暂无数据