@rohanpaul_ai: 冻结的LLM在其隐藏状态深处仍携带可读的行为信号。Proprioceptive AI已创建了Cy…
摘要
Proprioceptive AI发布了Cygnus,这是一款为冻结的LLM配备自感知适配器的工具,通过gl(4,R)李代数读取内部隐藏状态以隔离暗模式,将Qwen-32B在ARC-Challenge上的分数从82.2%提升到94.97%,仅使用一张RTX 3090且无需重新训练。
冻结的LLM在其隐藏状态深处仍携带可读的行为信号。Proprioceptive AI创建了Cygnus,让LLM能够感知自身的内部思维模式,从而显著提高准确性。这使得Qwen-32B在ARC-Challenge上的分数从82.2%跃升至94.97%,仅需一张RTX 3090。因此,Cygnus为冻结的LLM配备了自感知适配器,能够读取其内部认知几何结构。这些适配器将隐藏状态投射到由gl(4,R)李代数定义的数学空间中,以隔离暗模式。那些暗模式包含了被标准归一化抹去的大部分与准确率相关的信号。这种设计带来了显著的基准性能提升,且无需任何模型再训练。令人惊叹的是,对激活几何结构的数学洞察能够在不进行完整再训练的情况下提高可靠性。他们目前在其droplet上支持多达50,000名并发用户。
相似文章
在Strix Halo上运行的Qwen3.8-27B Q8_0令人印象深刻
作者在配备Ryzen AI Max+ 395的ROG Flow Z13上测试了Qwen3.8-27B Q8_0 AI模型,使用Lemonade Server和llama.cpp进行推测解码,实现了令人印象深刻的本地推理性能,生成了一个飞行模拟器。
@TheAhmadOsman: 我当前的LLMs很稳定 - GLM 5.3 Flash - DeepSeek V4.1 Flash - Qwen 3.8 Next Flash - Qwen 3.8 27B 仅一年前你…
推文突显了GLM、DeepSeek和Qwen等LLMs的性能,指出过去一年AI能力的飞速进展。
@leopardracer: https://x.com/leopardracer/status/2055341758523883631
一位用户分享了他们搭建双GPU本地AI实验室的经验,使用了RTX 4080 Super和5060 Ti,通过llama.cpp和llama-swap运行Qwen 3.6模型,以降低API成本并实现无限制的实验。
PYTHALAB-MERA:面向冻结LLM代码代理的验证驱动记忆、检索与接受控制
本文介绍了 PYTHALAB-MERA,这是一种用于冻结本地大语言模型(LLM)的外部控制器,通过基于验证的记忆和检索机制来提升代码代理的性能。与自我修正基线方法相比,该方法利用执行反馈和时间差分学习,在严格验证任务中展现出更高的成功率。
Onnes:一种基于物理的多智能体LLM模拟器,用于量子计算基础设施的低温故障诊断
介绍了Onnes,一种基于物理的多智能体LLM模拟器,用于量子计算基础设施的低温故障诊断。通过精心策划的少样本演示和自一致性投票,零样本LLM智能体面板实现了0.990的故障分类准确率,与监督式分类器相当,且无需参数更新。