frozen-model

标签

Cards List
#frozen-model

Spatial Memory Agent:基于经验的过程记忆用于空间智能

Hugging Face Daily Papers · 3天前 缓存

本文介绍了 Spatial Memory Agent (SMA),一种运行时框架,通过验证器引导的反思和可复用记忆,在不进行参数更新或使用外部工具的情况下提升冻结视觉语言模型的空间推理能力,在五个基准和四个基础 VLM 上取得了强劲的结果。

0 人收藏 0 人点赞
#frozen-model

Show HN:单个46GB GPU上的600万token可移动窗口

Hacker News Top · 2026-07-28 缓存

本文介绍了一个冻结的12B模型,该模型利用已验证解决方案的持久内存,在已解决问题族上以零生成token实现100%准确率,并在单个46GB GPU上展示了600万token的可移动窗口。

0 人收藏 0 人点赞
#frozen-model

冻结的12B模型在已验证任务上超越前沿模型:100%准确率、零Token、精确比特、永久有效

Hugging Face Daily Papers · 2026-07-26 缓存

一个冻结的120亿参数模型,结合了已验证解决方案的持久记忆,在九个问题家族超过180个实例上实现了100%准确率,使用零生成token,精确比特的确定性输出,在已解决任务上超越前沿模型,且计算消耗可忽略不计。

0 人收藏 0 人点赞
#frozen-model

@akshay_pachaar: 不要训练模型,而要进化工具层。

X AI KOLs Following · 2026-07-03 缓存

文章讨论了 Hugging Face 的一个实验:一个自动循环仅重写冻结模型周围的代码(工具层),在不改变模型权重的情况下,将其基准分数从 0% 提升到接近 Sonnet 4.6 的水平,且成本更低。这证明许多基准测试失败源于工具层,而非模型本身。

0 人收藏 0 人点赞
#frozen-model

@dair_ai: // δ-mem: LLM的高效在线记忆 // 这是我本月看到的最优雅的记忆机制之一。大多数长…

X AI KOLs Following · 2026-05-13 缓存

本文介绍了δ-mem,一种轻量级在线记忆机制,它通过delta规则学习更新的紧凑型关联记忆状态来增强冻结的LLM,在记忆密集型基准测试中取得了显著改进,无需微调或上下文扩展。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈