标签
文章主张在代理 AI 系统中监管软件 harness,而不是专注于 AI 模型推理,强调人为监督和问责制以防止滥用。
OpenAI正在分享一个用于跟踪、调查和披露模型不对齐实例的新框架,包括公开披露的标准和时间表。