continual-learning

标签

Cards List
#continual-learning

@TheAhmadOsman: 预测:到2027年底,持续学习将在本地AI中准备就绪。Markdown工具是臃肿的……

X AI KOLs Timeline ↗ · 2026-09-15 缓存

一项预测表明,持续学习将在2027年之前为本地AI系统做好采用准备,批评了当前的方法如Markdown工具和上下文学习。

0 人收藏 0 人点赞
#continual-learning

Homeostatic Continual Learning

arXiv cs.AI ↗ · 2026-09-15 缓存

本文提出了Homeostatic Continual Learning,一种使AI代理在变化环境中持续学习而不发生灾难性遗忘的方法,通过检测离群点并逐步扩展世界模型来实现。

0 人收藏 0 人点赞
#continual-learning

ScienceBuddy: 面向交互式科学代理的递归中递归自我改进

Hugging Face Daily Papers ↗ · 2026-09-15 缓存

ScienceBuddy 引入了一种递归中递归的自我改进范式,用于交互式科学代理,通过研究员合作与反馈实现持续演进。

0 人收藏 0 人点赞
#continual-learning

并非所有语音都是意图:用于ASR后误唤醒的自适应自校正推理层

arXiv cs.CL ↗ · 2026-09-14 缓存

本文介绍了ASCIL,一个后ASR框架,它根据用户反馈和上下文信号进行调整,以纠正AI助手中的误唤醒激活,在低延迟下实现了显著的错误减少。

0 人收藏 0 人点赞
#continual-learning

当验证停止学习时:审计持续实体代理的更新准入

arXiv cs.AI ↗ · 2026-09-12 缓存

本文提出了一种用于持续实体代理更新准入的审计协议,强调需要在错误控制与保留学习机会之间取得平衡,以防止有害更新并促进有用学习。

0 人收藏 0 人点赞
#continual-learning

衡量世界模型更新的价值:一种用于持续适应的反事实效用协议

arXiv cs.LG ↗ · 2026-09-11 缓存

本文介绍了一种分叉账本协议,用于衡量持续适应中世界模型更新的反事实效用,表明总是应用更新会降低CartPole和Walker等控制任务的性能。

0 人收藏 0 人点赞
#continual-learning

用于可塑性的贝尔曼最优方程

arXiv cs.LG ↗ · 2026-09-11 缓存

本文提出了一种贝尔曼最优方程,用于在持续强化学习中优化可塑性,将稳定性-可塑性权衡构建为赋能-可塑性权衡。

0 人收藏 0 人点赞
#continual-learning

AhaBench:智能体是否从先前经验中学习?一个用于长期持续学习的基准

arXiv cs.LG ↗ · 2026-09-10 缓存

AhaBench 是一个基准测试套件,通过测试探索、知识转移和延迟反馈处理,评估语言智能体在长期任务中是否从先前经验中改进。

0 人收藏 0 人点赞
#continual-learning

@kordelfrance: 这太棒了。没有足够的模拟工具来教机器人通过气味导航,这是一个很好的方式去…

X AI KOLs Following ↗ · 2026-09-09 缓存

Fly Escape Room 被介绍为全球首款由真实果蝇大脑驱动NPC的游戏,模拟嗅觉智能并为持续学习实验提供平台。

0 人收藏 0 人点赞
#continual-learning

@supermemory:智能体需要持续学习。在supermemory,我们正在加倍投入并推动记忆和上下文学习的前沿……

X AI KOLs Timeline ↗ · 2026-09-07 缓存

Supermemory强调了AI智能体持续学习的重要性,并介绍了learner-1,这是一个旨在为各种用例推动记忆和上下文学习的新模型。

0 人收藏 0 人点赞
#continual-learning

持续学习机制组合以实现长期记忆

Hugging Face Daily Papers ↗ · 2026-09-07 缓存

本文表明,结合互补的持续学习机制可以增强语言模型中的长期记忆,通过数据、功能和权重锚点以及合并的LoRA,将保留率提升28倍。

0 人收藏 0 人点赞
#continual-learning

@VraserX:GPT-6 Astra Aeon 可能是真正的变革。一个拥有持久记忆的AI代理,基本上可以无限期地持续工作……

X AI KOLs Following ↗ · 2026-09-03 缓存

文章推测,GPT-6 Astra Aeon——一个拥有持久记忆的AI代理——可能实现持续学习,并代表AI能力超越基准测试改进的重大转变。

0 人收藏 0 人点赞
#continual-learning

人工神经网络中纤维化、压缩和对称性破缺的涌现

arXiv cs.LG ↗ · 2026-09-03 缓存

本文提出一个理论框架,表明神经网络中的学习会产生图对称性(纤维化和覆盖),从而能够显著压缩模型并提升持续学习性能。

0 人收藏 0 人点赞
#continual-learning

SkillGLoW:用于长时任务流中自我改进代理的程序族技能整合

arXiv cs.AI ↗ · 2026-09-03 缓存

SkillGLoW 是一种用于LLM代理的方法,它将技能组织成程序族,以增强在长时任务上的自我改进,相比基线展示了显著的性能提升。

0 人收藏 0 人点赞
#continual-learning

MASkills:多智能体LLM系统的持续技能优化

arXiv cs.AI ↗ · 2026-09-03 缓存

MASkills 提出了一个持续学习框架,通过智能体技能优化多智能体LLM系统,使用基于技能的信用分配和层次聚合来提升在 HotpotQA 和 GAIA 等任务上的性能。

0 人收藏 0 人点赞
#continual-learning

EVOHARNESSBENCH: 你的代理能否跟上不断演进的框架?

Hugging Face Daily Papers ↗ · 2026-09-03 缓存

本文介绍了EVOHARNESSBENCH,一个用于评估在工具、技能和代理框架不断演进下的LLM代理的基准测试,揭示了在保持和适应方面的差距。

0 人收藏 0 人点赞
#continual-learning

Test Time Training(3分钟阅读)

TLDR AI ↗ · 2026-09-03 缓存

本文讨论了Test Time Training作为AI开发中潜在的新扩展轴,分析了一篇将其定位为线性注意力形式的论文,并探讨了其对模型训练和持续学习的影响。

0 人收藏 0 人点赞
#continual-learning

@LangChain: 今日举办!与 @PrimeIntellect 和 @baseten 一起的技术讲座、会见开发者及夏末氛围晚间活动。

X AI KOLs Timeline ↗ · 2026-09-02 缓存

LangChain 将在旧金山举办一场晚间活动,内容包括持续学习的技术讲座、Prime Intellect 和 Baseten 的演讲嘉宾,以及面向 AI 智能体工程社区的社交机会。

0 人收藏 0 人点赞
#continual-learning

假设引导的自蒸馏用于持续个性化

arXiv cs.AI ↗ · 2026-09-02 缓存

HypReflect 是一个用于大语言模型助手持续个性化的框架,它从用户信号中推断显式偏好假设,并使用自蒸馏来适应,优于基线并泛化到未见过的用户和跨领域设置。

0 人收藏 0 人点赞
#continual-learning

关于AI实验的提案

Reddit r/ArtificialInteligence ↗ · 2026-08-28

本文提出了一项长期实验,旨在保持具身AI智能体数十年的发展连续性,以研究意识和个体性,并将其与新初始化的智能体进行比较。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈