continual-learning

标签

Cards List
#continual-learning

SkillEvoReg: 正则化智能体技能演化以防止过拟合

arXiv cs.AI ↗ · 19小时前 缓存

SkillEvoReg引入了一个正则化框架,以防止语言模型代理的技能演化中的过拟合,结合了dropout、局部正则化和因果验证,以在控制技能增长的同时保持性能。

0 人收藏 0 人点赞
#continual-learning

大型语言模型持续微调中的未知预训练梯度估计与正交化

arXiv cs.CL ↗ · 19小时前 缓存

本文介绍EoupCT,一种通过估计并正交化未知预训练梯度来缓解大型语言模型持续微调中灾难性遗忘的新颖框架。

0 人收藏 0 人点赞
#continual-learning

@VraserX:OpenAI开发者日可能是年度最大、最重要的AI事件之一。一个永不下线的智能体……

X AI KOLs Timeline ↗ · 昨天 缓存

OpenAI开发者日预计将是一场重磅AI活动,届时可能发布具备持久记忆与持续学习能力的永在线AI智能体,并公布新硬件。

0 人收藏 0 人点赞
#continual-learning

超越类别边际:无需冻结类别共现的重演间隙约束

arXiv cs.LG ↗ · 5天前 缓存

本文提出了随机通道重演 (RPR) 以约束在线持续学习中的重演间隙,展示了在像ER-ACE这样的经验回放方法中,其准确性优于独立类别平衡检索。

0 人收藏 0 人点赞
#continual-learning

仿脑分层模块化通用持续学习

arXiv cs.LG ↗ · 5天前 缓存

本文提出一种仿脑分层模块化持续学习方法,能处理在线不确定的数据流,利用预训练基础模型,在具身操作等任务中取得显著性能提升。

0 人收藏 0 人点赞
#continual-learning

基于Sheaf SyncMap的稳定无监督连续分块

arXiv cs.LG ↗ · 5天前 缓存

本文引入sheaf正则化以稳定去中心化SyncMap用于无监督连续分块,实现更高的归一化互信息和对输入分布偏移的更好适应。

0 人收藏 0 人点赞
#continual-learning

@PyTorch:前沿模型是启动AI产品的最快速途径,但当使用规模扩大时会怎样?在我们最新的案例研究中…

X AI KOLs Following ↗ · 6天前 缓存

Shopify 利用 PyTorch 和 vLLM 打造了持续学习闭环,用于优化其 GraphQL 智能体,通过生产环境驱动的更新,实现了成本降低96%,并超越了前沿模型的表现。

0 人收藏 0 人点赞
#continual-learning

用于持续文档编写的知识拉取请求

Hugging Face Daily Papers ↗ · 6天前 缓存

知识拉取请求(KPRs)是一个用于持续文档编写的框架,通过提取主张、过滤它们并生成更改日志来集成新知识,使更改可解释。在保留内容和添加信息方面,它优于现有方法,这在维基百科修订和RAGTIME任务中得到评估。

0 人收藏 0 人点赞
#continual-learning

50多小时和1亿多token后,开源自主智能体在解决开放数学问题上越来越近

Reddit r/LocalLLaMA ↗ · 2026-09-21

一个开源自主智能体在一项实验中已经运行超过50小时,处理了超过1亿token,旨在解决C(25,15,5)覆盖设计问题,目标是实现在数学上的突破。

0 人收藏 0 人点赞
#continual-learning

Designer-RSI:从用户流量中演化程序性记忆用于代理式图形设计

arXiv cs.AI ↗ · 2026-09-21 缓存

该持续适应框架通过用户流量演化程序性记忆以用于代理式图形设计,在无需权重更新和人工标签的条件下提升执行成功率。

0 人收藏 0 人点赞
#continual-learning

mini-AGI - 动态增长的(目前530M参数且仍在增长)持续学习模型,从头在8GB显存笔记本上从批次1数据流训练。

Reddit r/LocalLLaMA ↗ · 2026-09-21 缓存

mini-AGI 是一个动态增长其架构的持续学习字节级语言模型,从头在8GB显存笔记本上训练,展示了个人AI持续学习而无灾难性遗忘的可能性。

0 人收藏 0 人点赞
#continual-learning

ACLArena:多阶段后训练中的智能体持续学习

Hugging Face Daily Papers ↗ · 2026-09-21 缓存

本文介绍了ACLArena,这是一个用于评估多阶段后训练中智能体持续学习的框架,分析了遗忘和泛化机制,并提出了使用离线重放和LoRA专家的改进ACL方案。

0 人收藏 0 人点赞
#continual-learning

动态系统中的持续企业世界模型发现

arXiv cs.AI ↗ · 2026-09-18 缓存

本文介绍了持续企业世界模型发现,其中智能体在动态系统中学习并适应不断变化的业务规则,使用EnterpriseWorldShift基准进行评估,并展示了比先前方法更高的预测准确性。

0 人收藏 0 人点赞
#continual-learning

长时智能体架构:层级、滴答与级联智能

arXiv cs.AI ↗ · 2026-09-18 缓存

本文提出了一种面向长时AI智能体的层级架构,结合了层级、滴答和级联智能,以实现持续运行而无遗忘,并在十天的活动中进行了验证。

0 人收藏 0 人点赞
#continual-learning

在标签空间演化下的开放世界意图发现中基于不确定性感知的持续学习

arXiv cs.LG ↗ · 2026-09-17 缓存

本文提出一个统一的不确定性感知概率框架,用于在演化标签空间中进行持续新意图发现,采用自适应β-VAE和多信号决策机制,以实现可控的标签扩展,同时减轻灾难性遗忘。实验展示了高新颖性精度和稳定的适应性,遗忘程度有限。

0 人收藏 0 人点赞
#continual-learning

我刚刚解决了持续学习

Reddit r/artificial ↗ · 2026-09-16

本文提出了一种人工智能中的持续学习方法,模型自主决定学习内容并实时更新其权重,可能实现向AGI的连续自我进化。

0 人收藏 0 人点赞
#continual-learning

ReDraft,不要只蒸馏:用于持续VLLM后训练的参考驱动修订

arXiv cs.AI ↗ · 2026-09-16 缓存

ReDraft 是一种参考驱动修订方法,用于大型视觉语言模型的持续后训练,平衡新任务的学习和旧任务的保留,比SFT等标准方法实现更高的准确性和更少的遗忘。

0 人收藏 0 人点赞
#continual-learning

实时智能:环境驱动的动态策略助力持续LLM改进

arXiv cs.CL ↗ · 2026-09-16 缓存

本文提出动态检索策略生成(DRPG)框架,该框架利用记忆检索和环境反馈动态生成策略,以在多种任务中实现大型语言模型的持续改进。

0 人收藏 0 人点赞
#continual-learning

CERA-MoA:协同进化路由机制与持续学习的LLM代理

Hugging Face Daily Papers ↗ · 2026-09-16 缓存

CERA-MoA介绍了一个协同进化框架,用于混合代理系统,该框架使用强化学习动态路由查询并调整代理能力,从而提升任务性能和效率。

0 人收藏 0 人点赞
#continual-learning

果蝇大脑持续学习机制被破解,真正AGI的缺失环节

Reddit r/singularity ↗ · 2026-09-15

研究人员破解了果蝇大脑中的持续学习机制,这可能为实现真正的人工通用智能提供关键见解。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈