大多数心理健康基准测试专注于紧急情况。MentalHealthBench 旨在覆盖全面范围…

X AI KOLs 工具

摘要

OpenAI 宣布,MentalHealthBench 旨在覆盖 AI 心理健康对话的完整范围,从日常支持到急性危机场景。

大多数心理健康基准测试专注于紧急情况。 MentalHealthBench 旨在覆盖人们向 AI 提出的心理健康对话的全面范围——从日常支持到更严重的危机场景。 https://t.co/bxnTv1ril5
查看原文
查看缓存全文

缓存时间: 2026/09/23 20:17

大多数心理健康基准测试聚焦于紧急情况。

MentalHealthBench旨在涵盖人们向AI咨询的全谱系心理健康对话——从日常支持到更急性的危机情境。https://t.co/bxnTv1ril5

相似文章

推出MentalHealthBench

OpenAI Blog

OpenAI推出了MentalHealthBench,这是一个开放基准,用于评估心理健康对话中的AI回复,与超过80名心理健康专家共同创建,以衡量安全性、上下文、主动性和指导性。

HealthBench-Psych: OpenAI HealthBench 的心理健康子集

arXiv cs.CL

HealthBench-Psych 引入了 OpenAI HealthBench 基准测试的一个心理健康子集,用于评估 LLMs 在心理健康对话中的表现,经过临床医生审查验证,并评估了 20 个模型作为可重复使用的资源。

介绍 HealthBench

OpenAI Blog

OpenAI 推出了 HealthBench,这是一个用于评估医疗保健环境中人工智能系统的新基准。该基准由来自 60 个国家的 262 名医生共同创建,包含 5,000 个逼真的健康对话和医生编写的评分标准,用于评估模型在有意义、可信和可改进的指标上的性能。

关于我们心理健康相关工作的更新

OpenAI Blog

OpenAI 宣布了关于 ChatGPT 心理健康相关工作的更新,包括为成年用户提供新的信任联系人功能、通过先进的评估方法改进情绪困扰检测,以及于 2025 年 9 月推出的家长控制功能。该公司还涉及了在加州法院合并审理的持续心理健康相关诉讼,承诺保持透明度并持续改进安全功能。

我们对心理健康相关诉讼的处理方式

OpenAI Blog

OpenAI 阐述了其处理心理健康相关诉讼的方式,强调透明度、关怀和尊重,同时为相关指控进行辩护。公司详细介绍了其在改进 ChatGPT 安全功能方面的持续努力,包括识别心理困境和引导用户寻求专业支持。