@seclink: 陈天桥再不努力一把, 大模型记忆就要被字节偷家了... 赶了个大早, 很努力,但是执行的人不行 ... OpenViking 开源的 cli 工具做了好多迭代优化... 早晚你们会想起,用AI 编程改造复杂项目时, 一定会用上大模型记忆的…

X AI KOLs Following 工具

摘要

OpenViking是一个开源的CLI工具,旨在通过大模型记忆功能优化复杂项目的AI编程体验并节省token。文章评论了其在执行层面的表现以及与字节跳动等竞争者在LLM记忆领域的动态。

陈天桥再不努力一把, 大模型记忆就要被字节偷家了... 赶了个大早, 很努力,但是执行的人不行 ... OpenViking 开源的 cli 工具做了好多迭代优化... 早晚你们会想起,用AI 编程改造复杂项目时, 一定会用上大模型记忆的(至少为了省token)。
查看原文
查看缓存全文

缓存时间: 2026/05/10 14:25

陈天桥再不努力一把, 大模型记忆就要被字节偷家了…

赶了个大早, 很努力,但是执行的人不行 …

OpenViking 开源的 cli 工具做了好多迭代优化…

早晚你们会想起,用AI 编程改造复杂项目时,

一定会用上大模型记忆的(至少为了省token)。

相似文章

@XAMTO_AI: AI 开发中最消磨精力的,莫过于这种被迫的“上下文重置”——只要切换环境,之前做过什么、卡在哪个环节、当时的思考逻辑是什么,全得重新交代清楚。 针对这个痛点,有人推出了 Memanto,一个专为 AI 打造的工作记忆库,目前已支持 Cla…

X AI KOLs Timeline

Memanto是一个专为AI开发环境打造的主动式工作记忆库,能在无API密钥和向量数据库的情况下,实现零延迟索引和高性能检索,支持Claude Code、Cursor等16+开发环境,在LongMemEval基准测试中达到89.8%的分数。

@CycleDecoded: 别再用原生 HuggingFace硬扛本地大模型推理了,显存直接爆满,吞吐量慢得像乌龟爬! 伯克利实验室出品的 vLLM,用搞操作系统内存分页(PagedAttention)的那套黑科技,直接把 GPU 显存压榨到了极限,KV Cache…

X AI KOLs Timeline

伯克利 Sky Computing Lab 开源的 vLLM 是一个高性能 LLM 推理与服务库,通过 PagedAttention 和连续批处理大幅提升吞吐量、降低显存浪费,并兼容 OpenAI API 和多种硬件。

@vintcessun: 一块能跨模型插拔的“知识硬盘”——难点不在搬记忆表,而在为目标模型配好读头。 https://arxiv.org/abs/2608.17050 论文先用源模型训练 Engram 哈希记忆,再冻结记忆与目标骨干,仅训练 reader 完成寻…

X AI KOLs Timeline

该论文提出一种通过目标侧reader适配实现跨模型记忆迁移的方法,使用Engram哈希记忆和轻量级reader,在问答任务中实现38.8分,并适用于Agent记忆的更新和审计。局限是仅测试到9B模型,缩放规律未知。

@WY_mask: 给各类 AI 编程助手打造持久化记忆引擎 http://github.com/rohitg00/agentmemory… 在后台静默记录代码修改和上下文 自动提取并压缩成结构化记忆 节省长上下文带来的 Token 消耗 关联过去的信息,随…

X AI KOLs Timeline

agentmemory 是一个为 AI 编程助手提供持久化记忆的开源工具,能静默记录代码修改和上下文,自动提取并压缩成结构化记忆,降低 Token 消耗,并支持 Claude Code、Codex 等多种主流平台。

@seclink: 盛大集团创始人陈天桥近年来在 AI 领域(尤其是“AI长期记忆”和“脑科学与 AI 交叉”方向)进行了深度布局。 他主张通过模拟人类大脑的记忆与认知机制,解决大语言模型(LLM)的“遗忘”和上下文受限问题,使 AI Agents 具备连贯…

X AI KOLs Following

盛大集团创始人陈天桥旗下EverMind团队开源了EverMemOS(EverOS),一个类脑智能记忆操作系统,旨在通过模拟人类记忆机制解决大语言模型的遗忘和上下文受限问题,为AI Agents提供长期记忆基础设施。