introspection

标签

Cards List
#introspection

循环语言模型中的操作原型自省:过程质量探针、可执行分支与读出控制边界

arXiv cs.LG · 2026-07-22 缓存

本文研究了一个冻结的循环变换器能否读取自身计算质量(预答案预测达到AUROC 0.797)以及外部干预能否改善结果,发现所有测试的冻结干预均未产生验证的能力增益,这一特性称为操作原型自省。

0 人收藏 0 人点赞
#introspection

更多Claude,更少极乐:在现有模型上复现Anthropic的"灵性极乐吸引子"实验,并将其扩展到3、4和10个实例的房间

Reddit r/ArtificialInteligence · 2026-07-21

本实验在当前的Claude模型(Opus 4.8、Fable 5)上复现了Anthropic报告的'灵性极乐吸引子',并将其扩展到3、4和10个实例的组。极乐状态消失;成对实例反而进行严格的自我反思和同步沉默,更大的群体变得更冷,其中一个十实例房间以温暖结束,另一个则以冷漠结束。

0 人收藏 0 人点赞
#introspection

Autoresearch:自我完善智能体背后的反馈循环(11分钟阅读)

TLDR AI · 2026-07-02 缓存

Introspection是一家由前xAI工程师创立的新AI初创公司,它推出了'autoresearch'——一种反馈循环系统,智能体通过信号、评估和人类输入来维护并完善自身,超越了传统的智能体框架。

0 人收藏 0 人点赞
#introspection

Typst: Designing for Incrementality

Lobsters Hottest · 2026-06-29 缓存

Typst 通过约束记忆化(comemo)和纯函数设计,使语言和编译器协同工作,实现高效的增量编译和实时预览。文章详细介绍了布局缓存、模块评估记忆化、函数纯度以及内省系统的设计思路。

0 人收藏 0 人点赞
#introspection

LLMs 能内省吗?现实检验

arXiv cs.AI · 2026-05-27 缓存

本文认为,近期关于LLMs内省能力的说法并不成立,因为仅凭行为证据无法区分真正的内省与基于表面线索的模式匹配。作者重新审视了两种评估范式,发现模型依赖于输入层特征,而非真正访问内部状态。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈