in-context-learning

标签

Cards List
#in-context-learning

当上下文误导时:大型语言模型中的 Jurisdiction 上下文学习

arXiv cs.CL ↗ · 昨天 缓存

本文介绍了 FakeContext-bench,用于评估大型语言模型区分上下文信息和事实知识的能力,并提出了 Jurisdiction In-Context Learning (J-ICL) 以增强上下文学习性能和对误导性上下文的抵抗力。

0 人收藏 0 人点赞
#in-context-learning

评估Devanagari OCR后校正的上下文学习和检索策略

arXiv cs.CL ↗ · 4天前 缓存

本文首次对大规模语言模型在印地语和马拉地语的OCR后校正进行系统性评估,比较上下文学习的检索策略,并展示CharBM25的有效性。

0 人收藏 0 人点赞
#in-context-learning

@huang_biwei: 很高兴分享CausalWM,我们的因果世界模型v1,基于因果链式思考(CoT)构建。它目前排名…

X AI KOLs Timeline ↗ · 6天前 缓存

CausalWM是一个因果世界模型,使用链式思考通过逐步捕捉物理依赖关系来预测未来帧,在像TriWorldBench和PAI-Bench这样的基准测试中排名第一。

0 人收藏 0 人点赞
#in-context-learning

将视觉语言模型的智能迁移至机器人控制

Hugging Face Daily Papers ↗ · 6天前 缓存

本文提出了RoboDawn,一种将视觉语言模型智能迁移至机器人控制的方法。该方法通过零样本和单样本学习在基准测试中取得了先进结果,并在真实世界应用中验证成功。

0 人收藏 0 人点赞
#in-context-learning

基于状态空间模型的长上下文示范选择

arXiv cs.LG ↗ · 2026-09-17 缓存

本文提出使用状态空间模型来高效选择用于长上下文语言模型提示的示范,从而降低计算成本并提升性能。

0 人收藏 0 人点赞
#in-context-learning

关于门控的重要性:State Space Models中的记忆与上下文学习

arXiv cs.LG ↗ · 2026-09-16 缓存

本文研究了门控机制在State Space Models中的作用,表明它们促进记忆而非上下文学习,但能提高对长序列的泛化能力。

0 人收藏 0 人点赞
#in-context-learning

少样本退化并非表面所见:行为证据、表示分析以及跨12个模型、2个任务和2种架构的随机文本控制

arXiv cs.CL ↗ · 2026-09-16 缓存

本文通过引入随机文本控制来挑战语言模型中少样本退化的扭曲假说,表明表示偏移主要由提示长度引起,而具有更高内容增量的模型从少样本提示中获益更多。

0 人收藏 0 人点赞
#in-context-learning

基于VLM智能体的上下文机器人学习

Hugging Face Daily Papers ↗ · 2026-09-16 缓存

本文介绍了GPT-Policy,一个用于使用视觉语言模型进行上下文机器人学习的框架,使机器人能够从演示中学习,无需梯度更新。在真实机器人试验中评估该框架显示,任务完成率得到提高。

0 人收藏 0 人点赞
#in-context-learning

表格基础模型还需要特征工程吗?

arXiv cs.LG ↗ · 2026-09-15 缓存

一项控制研究发现,对于更强的表格基础模型,特征工程的收益逐渐减少,而添加来自相关数据集的上下文信息仍能提升性能。

0 人收藏 0 人点赞
#in-context-learning

LimiX-2:一种面向通用结构化数据智能的上下文机制网络

Hugging Face Daily Papers ↗ · 2026-09-15 缓存

LimiX-2 是一个用于结构化数据的预训练基础模型,它使用上下文机制网络在主要表格基准测试中排名第一,支持多种任务而无需针对特定任务的参数更新。

0 人收藏 0 人点赞
#in-context-learning

@__Rhodium__: Astra是机器人技术的ChatGPT时刻吗?几点见解:1) 强大的上下文学习能力 在3次尝试中,它从学习…

X AI KOLs Timeline ↗ · 2026-09-14 缓存

本文探讨Astra是否代表了机器人技术中类似ChatGPT的突破,通过一条推特线程突出了其上下文学习和推理能力。

0 人收藏 0 人点赞
#in-context-learning

跨模态上下文学习的趋同涌现

Hugging Face Daily Papers ↗ · 2026-09-12 缓存

本文提出了 Convergent Emergence Hypothesis,指出少样本上下文学习在跨模态难度剖面上具有共同性,并通过六种模态的实验提供实证支持,显示其中五种模态存在相关性效应。

0 人收藏 0 人点赞
#in-context-learning

@VraserX: 这再次向我证明了GPT-6 Astra是AGI。向它展示一个人类执行全新的物理任务,告诉它去控制…

X AI KOLs Following ↗ · 2026-09-11 缓存

一条推文声称,GPT-6 Astra通过使机械臂在第一次尝试时就能根据人类演示执行新颖的物理任务,从而展示了AGI。

0 人收藏 0 人点赞
#in-context-learning

GPT-6 Astra 可在物理世界中执行上下文学习...

Reddit r/singularity ↗ · 2026-09-11

本文讨论了 GPT-6 Astra 模型在物理世界环境中进行上下文学习的能力,这代表了具身 AI 领域的重大进步。

0 人收藏 0 人点赞
#in-context-learning

超越表面模仿:多模态上下文学习中推理路径对齐的对比建模

arXiv cs.AI ↗ · 2026-09-11 缓存

本文介绍了一种用于多模态上下文学习的对比建模框架,旨在改进推理路径对齐,提升视觉问答等任务的性能。

0 人收藏 0 人点赞
#in-context-learning

Interspeech 2026 MLC-SLM 挑战赛任务2的Eloquence提交

arXiv cs.CL ↗ · 2026-09-11 缓存

本文详细介绍了Eloquence团队在Interspeech 2026 MLC-SLM挑战赛任务2中的方法,该任务涉及使用语音LLMs进行多语言多选问答,结合微调、上下文学习和检索系统。

0 人收藏 0 人点赞
#in-context-learning

@rohanpaul_ai: 这对机器人基础模型业务来说是一个极好的信号。上个月,Skild AI发布了一个能够…

X AI KOLs Following ↗ · 2026-09-10 缓存

Skild AI的S1模型使机器人无需重新训练即可从视频演示中学习,在10个月内实现了1亿美元的ARR,并在多个行业中部署。

0 人收藏 0 人点赞
#in-context-learning

MOAE:多目标智能体进化的帕累托保留搜索

arXiv cs.AI ↗ · 2026-09-10 缓存

MOAE 提出了一种帕累托保留的进化搜索方法,能够在搜索过程中无需固定标量化,同时优化 LLM 代理的多个目标,包括任务性能、轨迹质量和安全性。

0 人收藏 0 人点赞
#in-context-learning

MUCnoHARM@GermEval Shared Task 2026: 基于检索的上下文内学习用于诽谤罪,及其不足之处

arXiv cs.CL ↗ · 2026-09-10 缓存

本文评估了基于检索的上下文内学习方法,用于检测德国社交媒体帖子中与犯罪相关的仇恨言论,发现少样本提示优于零样本,但检索方法仅提供边际增益,模型更适合用于分诊而非自主审核。

0 人收藏 0 人点赞
#in-context-learning

@supermemory:智能体需要持续学习。在supermemory,我们正在加倍投入并推动记忆和上下文学习的前沿……

X AI KOLs Timeline ↗ · 2026-09-07 缓存

Supermemory强调了AI智能体持续学习的重要性,并介绍了learner-1,这是一个旨在为各种用例推动记忆和上下文学习的新模型。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈