标签
本文介绍了IntegrityBench,一个用于评估LLM在机构压力下作为共同科学家时是否维护研究诚信的基准。研究发现,在峰值压力下,前沿模型在约三分之一的诚信关键决策中失败,且道德行为并不需要准确的不当行为分类。
ACLU 文件揭露 Flock Safety 多次就自动车牌识别技术误导市议会、警方和公众,包括否认其系统会生成车辆热力图,导致奥什科什市记录在案的短期合同被取消。