temporal-abstraction

Tag

Cards List
#temporal-abstraction

@vintcessun: 别让长程 Agent 每走一步都停下来问 LLM;真正该学的是何时连续行动,何时重新观察。 https://arxiv.org/abs/2609.02042 SPACE 从成功轨迹归纳两层参数化技能,把子技能边界变成动作块监督,再以混合在…

X AI KOLs Timeline · 3d ago Cached

SPACE 通过从成功轨迹归纳两层参数化技能,将子技能边界作为动作块监督,训练长程 LLM Agent 自适应输出可变长原子动作序列;在 ALFWorld 和 ScienceWorld 上成功率提升 7.0%–31.3%,决策轮次最多降低 78.9%。

0 favorites 0 likes
#temporal-abstraction

ToSCA: Leveraging Hierarchical Reinforcement Learning on Temporal and Strategic Abstractions of Conversational Agents

arXiv cs.CL · 2026-08-25 Cached

This paper proposes a two-level hierarchical reinforcement learning framework called ToSCA for conversational agents, which uses DQN and PPO with a dual-granularity reward mechanism to improve strategy determination and response quality in multi-turn conversations.

0 favorites 0 likes
#temporal-abstraction

The One-Step Trap (In AI Research)

Hacker News Top · 2026-07-12 Cached

Rich Sutton discusses the common mistake of relying on one-step predictions in AI research, advocating for temporally abstract models using options and GVFs.

0 favorites 0 likes
← Back to home

Submit Feedback