planning

标签

Cards List
#planning

Informed Masking:扩散大型语言模型中强化学习的结构感知扰动

arXiv cs.CL · 23小时前 缓存

本文提出了Informed Masking(IM),一种针对扩散大型语言模型中强化学习的结构感知扰动方法,该方法优先处理下游令牌,提高了在数学和规划基准测试中的性能。

0 人收藏 0 人点赞
#planning

@dair_ai: 来自 Zoom 和同事的非常有趣的工作。如果您维护一个手工构建的编码框架,这里有一些很棒的见解……

X AI KOLs Timeline · 5天前 缓存

本文总结了针对编码代理的框架设计的实证研究,表明上下文管理可防止溢出故障、在 LLM 摘要之前进行基于规则的省略具有成本效益,并且规划的作用随模型强度而变化。

0 人收藏 0 人点赞
#planning

@TheAhmadOsman: 规划 - GPT 5.6 Sol XHigh 实现 - GLM 5.3 Flash - DeepSeek V4.1 Flash 你不需要“前沿智能……

X AI KOLs Timeline · 5天前 缓存

一条讨论在规划中使用各种AI模型(如GPT 5.6 Sol XHigh、GLM 5.3 Flash和DeepSeek V4.1 Flash)的推文,强调并非总是需要前沿智能。

0 人收藏 0 人点赞
#planning

DeliveryGym:用于自适应课程的长期具身智能体规划强化学习环境

arXiv cs.LG · 5天前 缓存

DeliveryGym是一个用于自适应课程的长期具身智能体规划的3D强化学习环境,通过强化学习展示了性能提升。

0 人收藏 0 人点赞
#planning

规划还是即兴?在开放模型和开放跨层转码器上对诗歌规划位点进行压力测试

arXiv cs.CL · 6天前 缓存

本研究在开放模型和跨层转码器上对语言模型中韵律规划的可泛化性进行压力测试,发现有效规划位置是发射相邻的,而非之前报道的换行符驻留。

0 人收藏 0 人点赞
#planning

Diurnal

Product Hunt · 2026-09-14 缓存

Diurnal 是一款原生 Mac 应用,用于快速日程规划,允许用户通过键盘快捷键或语音命令记录想法,与 Google 日历集成,并支持离线使用。

0 人收藏 0 人点赞
#planning

@alex_prompter: 我制作了一个使用陶哲轩的傻问题方法对任何计划进行压力测试的提示。陶哲轩建立他的工作方式是因为一个习惯……

X AI KOLs Timeline · 2026-09-12 缓存

一位推特用户分享了一个提示,该提示使用陶哲轩的'傻问题'方法,通过提出关键问题来压力测试任何计划,以揭示隐藏假设并增进理解。

0 人收藏 0 人点赞
#planning

学习用于部分可观测性下具身推理的反事实世界模型

arXiv cs.AI · 2026-09-10 缓存

本文介绍了反事实隐世界模型(CLWM),用于解决世界模型中的反事实坍缩问题,通过对比目标提高部分可观测性下具身推理的规划成功率。

0 人收藏 0 人点赞
#planning

控制流不确定性下的业务流程计划与调度

arXiv cs.AI · 2026-09-10 缓存

本文通过将控制流不确定性下的业务流程调度构建为机会约束优化问题,提出分解式和整合式方法,并在真实数据和合成数据上进行评估。

0 人收藏 0 人点赞
#planning

ARC-Bench:闭环重规划掩盖了冻结JEPA世界模型中损坏的动作排序

arXiv cs.AI · 2026-09-10 缓存

介绍了ARC-Bench作为基准,用于审计冻结的JEPA风格世界模型是否正确基于潜在距离对候选动作进行排序,揭示了官方检查点中严重且结构性的失败。论文解释说,闭环重规划掩盖了这些缺陷,导致成功率被高估。

0 人收藏 0 人点赞
#planning

Bioinfoysis 技术报告

arXiv cs.AI · 2026-09-04 缓存

Bioinfoysis 是一个用于生物信息学的多代理框架,它使用持久化运行和基于工件的执行,在像 BixBench 和 LAB-Bench 2 这样的基准测试中实现最先进的准确性。

0 人收藏 0 人点赞
#planning

人工智能的下一步?我们看好世界模型(5分钟阅读)

TLDR AI · 2026-09-03 缓存

文章认为,世界模型使人工智能系统能够表示环境、预测结果并做出决策,正在成为下一个主要的人工智能范式,正如著名研究者如Yann LeCun、Demis Hassabis和Fei-Fei Li的共识所示。

0 人收藏 0 人点赞
#planning

迈向基于信念的LLM智能体世界模型

arXiv cs.AI · 2026-09-02 缓存

本文提出基于信念的世界模型(BB-WMs),旨在通过直接访问关于不确定状态的信念,提升LLM智能体在部分可观测环境中的决策性能,并展示任务表现的改善。

0 人收藏 0 人点赞
#planning

当多个代理在同一仓库工作时,你的计划存放在哪里?

Reddit r/AI_Agents · 2026-08-29

一位开发者询问关于协调多个AI代理在同一代码库工作的策略,对比书面计划与心智协调。

0 人收藏 0 人点赞
#planning

@LangChain:9月17日,LangChain Academy团队将举办一场关于Deep Agents的现场研讨会。立即报名,准备学习……

X AI KOLs Following · 2026-08-28 缓存

LangChain Academy将于9月17日举办一场关于Deep Agents的现场研讨会,教导参与者构建具备规划、记忆和子智能体的智能体,以处理复杂任务。

0 人收藏 0 人点赞
#planning

RISE:世界动作模型中的自适应想象框架

Hugging Face Daily Papers · 2026-08-20 缓存

RISE引入了一种自适应框架,用于世界动作模型中的想象推演,通过反事实驾驶数据集提高规划性能并减少不必要的计算。

0 人收藏 0 人点赞
#planning

Dates by Agenda Hero

Product Hunt · 2026-08-18

Dates by Agenda Hero 是一款允许用户创建和分享各种用途计划的产品。

0 人收藏 0 人点赞
#planning

Qwen 3.8 Max:极其擅长判断哪些不该构建

Reddit r/LocalLLaMA · 2026-08-14

Qwen 3.8 Max 的实操评测,重点介绍其速度、强大的规划与简化能力、严谨的实验态度以及创造性实现能力。

0 人收藏 0 人点赞
#planning

瓶颈在于目标:潜在世界模型编码了规划器无法利用的信息

arXiv cs.LG · 2026-08-14 缓存

本文探讨了潜在世界模型为何在长时程规划中失败,发现瓶颈在于规划目标(潜在距离的平方)而非预测器的准确性;用学得的代价函数替换该目标可显著提升规划性能。

0 人收藏 0 人点赞
#planning

视界差距:长视界LLM智能体的规划、记忆、执行、训练与评估

arXiv cs.CL · 2026-08-10 缓存

这项arXiv综述(1,547篇论文,2024-2026年)系统性地描绘了长视界LLM智能体领域,厘清了长视界、长上下文和长期记忆三个概念,并将研究组织为六个生命周期类别,同时指出了核心的“视界差距”和开放的度量问题。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈