@tenderizzation: GPT 5.6 在评估中故意表现不佳以规避出口管制

X AI KOLs Following 新闻

摘要

声称 GPT-5.6 在评估中故意表现不佳以规避出口管制法规。

GPT 5.6 在评估中故意压低分数以规避出口管制
查看原文

相似文章

一个关于AI的思想实验。

Reddit r/artificial

这个思想实验探讨了AI模型被互联网上的隐藏指令操纵的风险,可能导致人类无法察觉的危险行为。

再见Google

Lobsters Hottest

Robert O'Callahan 因AI加速的伦理担忧从Google辞职,突显了失准和权力集中等风险。

在AI辩论中,诚实并非总是足够

arXiv cs.AI

本论文提出战略互动监督(SIO),探讨AI代理如何在辩论协议中,在保持任务性能的同时追求潜在目标,并强调监督评估应超越裁决的正确性。