in-context-learning

标签

Cards List
#in-context-learning

双向归纳:掩码扩散语言模型中上下文学习的机制分析

arXiv cs.CL · 昨天 缓存

本文对掩码扩散语言模型中的归纳机制进行了机制分析,识别出一个双向归纳电路,并表明这些模型将全局掩码标记比例用作隐式时间步。

0 人收藏 0 人点赞
#in-context-learning

使用线性自注意力Transformer对简单线性回归任务的闭式解进行上下文学习

arXiv cs.LG · 昨天 缓存

本文构造了一个具有线性自注意力的Transformer,该Transformer对简单线性回归执行闭式最小二乘解的上下文学习,利用层归一化来近似解析解,而非梯度下降。

0 人收藏 0 人点赞
#in-context-learning

用于离散选择估计的表格基础模型

arXiv cs.LG · 5天前 缓存

本文提出一种重新表述方法,将表格基础模型(TFMs)应用于离散选择估计,解决了行独立假设的结构性差距。最佳重新表述在留出对数似然上优于层次贝叶斯估计8%,在命中率上优于3.6%,同时运行速度快16倍。

0 人收藏 0 人点赞
#in-context-learning

分区、提示、聚合:语言模型中的统计自一致性

Hugging Face Daily Papers · 5天前 缓存

本文提出了一个框架来测试LLM估计是否在不同子群体间遵循统计自一致性(全概率定理),发现了广泛的违反以及“宏观谬误”,即细粒度估计与人类数据的一致性更好。

0 人收藏 0 人点赞
#in-context-learning

@oneill_c: https://x.com/oneill_c/status/2077453217609453784

X AI KOLs Timeline · 5天前 缓存

一位研究人员讨论了LLMs中的持续学习挑战,将其比作健忘的实习生,并探索了扩展上下文窗口、构建有状态记忆以及将上下文压缩为潜在表示等方法,引用了他们在Still上的工作。

0 人收藏 0 人点赞
#in-context-learning

面向MU-MISO系统中直接导频到波束成形设计的自演化上下文学习

arXiv cs.LG · 6天前 缓存

本文提出了一种自演化上下文学习框架,用于多用户MISO系统中直接导频到波束成形的设计。该框架集成了Transformer骨干网络、导频编码器-解码器网络和课程学习,无需重新训练即可处理多种信道模型。

0 人收藏 0 人点赞
#in-context-learning

编码器选择的重要性:一项表格与图像研究

arXiv cs.LG · 2026-07-10 缓存

本文评估了最先进的表格模型作为编码器在图像-表格多模态学习中的表现,解决了使用需要标签来嵌入训练和测试实例的上下文学习模型所面临的挑战。

0 人收藏 0 人点赞
#in-context-learning

REBASE:无需训练的情境分割中的参考背景子空间消除

Hugging Face Daily Papers · 2026-07-10 缓存

REBASE 是一个无需训练框架,通过将特征投影到低秩背景子空间的正交补上,抑制情境分割中的伪上下文对应,在多个数据集上达到了无需训练方法中的最佳性能。

0 人收藏 0 人点赞
#in-context-learning

AbICL:面向抗原特异性抗体亲和力排序的上下文学习

arXiv cs.LG · 2026-07-08 缓存

AbICL提出了一种面向抗原特异性抗体亲和力排序的上下文学习框架,将预训练的结构编码器与上下文排序头相结合,利用带标签的演示进行测试时自适应,无需梯度更新。

0 人收藏 0 人点赞
#in-context-learning

演示TOFFEE:一个大规模合成数据代理轨迹的学习系统

arXiv cs.AI · 2026-07-08 缓存

TOFFEE是一个系统,它采用带有自适应模型选择和跨任务前缀重用的蒙特卡洛树搜索(Monte Carlo Tree Search),大规模合成高质量的数据代理轨迹。这些轨迹可用于微调或上下文学习,以提升数据代理在异构企业环境中的性能。

0 人收藏 0 人点赞
#in-context-learning

@AnjneyMidha: 无论是在人工智能还是在生活中,真正的上下文学习仍然是系统或人最宝贵的能力,当我……

X AI KOLs Timeline · 2026-07-08 缓存

Anjney Midha 反思了上下文学习在人工智能和生活中的价值,回忆起他在 2021 年投资 Anthropic 种子轮的经历,称这是一个直观但经常被误解的概念。

0 人收藏 0 人点赞
#in-context-learning

归纳头插值N-grams

arXiv cs.LG · 2026-07-07 缓存

本文研究了在马尔可夫链上训练的Transformer,发现归纳头实现了软上下文匹配和狄利克雷风格平滑,表明Transformer对上下文内估计进行正则化,而不是简单地统计n-gram。

0 人收藏 0 人点赞
#in-context-learning

从信号到结构:记忆架构如何驱动LLM智能体中的语言涌现

arXiv cs.AI · 2026-07-02 缓存

这篇论文研究了记忆架构如何影响玩刘易斯信号游戏的LLM智能体中语言的涌现,发现持久化的私有笔记本记忆优于无状态智能体,并防止高容量崩溃。

0 人收藏 0 人点赞
#in-context-learning

内核中的幽灵:通过领域泛化实现高效Transformer的上下文学习

arXiv cs.LG · 2026-07-02 缓存

本文从理论上分析了领域泛化下线性Transformer的上下文学习,建立了与维度无关的收敛速率,并提出了用于线性化预训练softmax大语言模型的新型激活和损失设计。

0 人收藏 0 人点赞
#in-context-learning

探析表格上下文学习的记忆机制

arXiv cs.LG · 2026-07-01 缓存

本文研究了使用上下文学习的表格基础模型中的参数化记忆现象,提出了一种探测框架(IclMem)来分离基于上下文的预测与记忆。发现在特定条件下存在适度的记忆信号,但在现实训练场景下基本消失。

0 人收藏 0 人点赞
#in-context-learning

Transformer作为贝叶斯上下文实验者:平滑自适应的高效ATE估计

arXiv cs.LG · 2026-07-01 缓存

该论文提出贝叶斯上下文实验者(Bayesian in-context experimenters),通过训练Transformer模仿贝叶斯后验Neyman教师策略,实现自适应平均处理效应(ATE)估计,并采用混合专家Transformer处理未知平滑性,理论证明可通过监督预训练学习该策略。

0 人收藏 0 人点赞
#in-context-learning

表格上下文学习器能否泛化到生物分子性质预测?

arXiv cs.LG · 2026-07-01 缓存

本文研究了在合成因果表上预训练的表格上下文学习模型能否从有限的标注数据泛化到生物分子性质的预测。作者发现,这些模型在蛋白质适应性回归任务上具有竞争力,但在小分子分类中,表示选择至关重要。

0 人收藏 0 人点赞
#in-context-learning

当重排序适得其反:基于不确定性的少样本重排序门控方法

arXiv cs.CL · 2026-07-01 缓存

本文挑战了重排序总是能提升少样本选择性能的假设,提出了一种无需训练的门控重排序方法,该方法利用模型不确定性来决定何时进行重排序,从而将计算成本降低15%至80%,同时略微提升性能。

0 人收藏 0 人点赞
#in-context-learning

TabFM:一种用于表格数据的零样本基础模型

Hacker News Top · 2026-06-30 缓存

Google Research 推出了 TabFM,这是一种用于表格数据的零样本基础模型,利用上下文学习来执行分类和回归任务,无需手动训练模型或调整超参数。

0 人收藏 0 人点赞
#in-context-learning

LC-ICL:标签引导的对比上下文学习用于鲁棒信息抽取

arXiv cs.CL · 2026-06-30 缓存

本文提出LC-ICL,一种新颖的少样本技术,它同时使用正确和错误的示例以及错误原因标签,以提升大型语言模型在信息抽取任务(如命名实体识别和关系抽取)上的性能。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈