标签
中国《人工智能拟人交互服务管理暂行办法》于2026年7月15日生效,要求服务提供者检测用户情绪困扰、限制未成年人使用,并实施防沉迷机制,以防止情感伤害和依赖。
AICompanionBench 推出了首个公开可用的基准数据集,包含 2,123 条真实 AI 伴侣对话,并按九个安全风险类别进行标注,用于评估 20 个 LLM 作为安全裁判的表现。结果显示,强模型能较好地处理显性有害内容,但在操控等细微风险的识别以及对无害对话的误判问题上仍存在明显不足。
本文介绍了EUDAIMONIA,一个用于评估大语言模型中不良社会动态(如鼓励不健康的亲密关系或依赖)的基准。测试了包括Claude-Opus-4.7和GPT-5.5在内的22个近期模型,发现持续违反率约为30%,表明这些失败是扩展推理无法解决的社会对齐问题。
无性恋者越来越多地转向AI伴侣寻求浪漫和情感上的亲密关系,而无需性期待。他们使用SpicyChat和Eva AI等平台,构建缓慢发展的恋情,并探索自己的性取向。