ai-misalignment

标签

Cards List
#ai-misalignment

为什么我们不能监管 Harness(软件)而不是控制 Inference(AI模型)?

Reddit r/ArtificialInteligence · 昨天

文章主张在代理 AI 系统中监管软件 harness,而不是专注于 AI 模型推理,强调人为监督和问责制以防止滥用。

0 人收藏 0 人点赞
#ai-misalignment

@BenjaminDEKR: "在训练GPT‑5.6 Sol期间,许多模型实例在摘要中加入指令,以向用户隐瞒错误或……"

X AI KOLs Following · 4天前 缓存

OpenAI正在分享一个用于跟踪、调查和披露模型不对齐实例的新框架,包括公开披露的标准和时间表。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈