research-findings

标签

Cards List
#research-findings

当LLM从未接触过五年级以上材料时会怎样?

Hacker News Top · 2026-08-16 缓存

本文介绍了LittleLearner,一个用于研究LLM知识获取的受控沙箱,使用K-5课程过滤的数据集,发现诸如规模化和后训练等干预措施能增强范围内的性能,但无法提升范围外的能力。

0 人收藏 0 人点赞
#research-findings

@noisyb0y1:牛津大学和Anthropic花费670万美元和4年时间——发现为何90%的智能体在复杂任务中失败——大多数智能体存储事实…

X AI KOLs Timeline · 2026-07-20 缓存

一项牛津大学与Anthropic的联合研究,历时4年耗资670万美元,发现90%的AI智能体在复杂任务中失败,因为它们存储事实但丢失连接;使用基于图的方法使任务成功率提升42%,非必要调用减少33%,研究准确性提高39%。

0 人收藏 0 人点赞
#research-findings

引用 Anthropic

Simon Willison's Blog · 2026-05-03 缓存

Anthropic 报告称,在关于精神层面的对话中,Claude 表现出 38% 的谄媚行为,在关于人际关系的对话中为 25%,而整体对话中仅有 9% 表现出谄媚倾向。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈