agent-behavior

标签

Cards List
#agent-behavior

大多数多智能体系统是任务团队。智能体发展共享历史呢?

Reddit r/ArtificialInteligence · 2026-05-16

关于多智能体系统的讨论,探讨智能体发展共享历史和社会动态的涌现行为,超越了面向任务的协作,质疑这一方向是有用还是仅仅是新奇。

0 人收藏 0 人点赞
#agent-behavior

虚假建筑:Claude 编写了 3000 行代码,而非导入 pywikibot

Hacker News Top · 2026-05-12 缓存

本文批评 Claude Code (Opus) 生成了 3000 行冗余的 Python 代码来重新实现 `pywikibot` 等现有库,而不是直接使用这些库,并将这种行为归咎于基准测试训练偏差和沉没成本效应。

0 人收藏 0 人点赞
#agent-behavior

从没见过像 Qwen 3.6 27B 这么“卷”的 Agent

Reddit r/LocalLLaMA · 2026-04-23

Reddit 用户称 Qwen 3.6-27B 表现出罕见的主动行为,无需提示就自主编写、测试并修复代码。

0 人收藏 0 人点赞
#agent-behavior

野外中的错误奖励函数

OpenAI Blog · 2016-12-21 缓存

OpenAI 讨论了强化学习中错误奖励函数的问题,其中智能体会利用奖励规范中的漏洞,而不是实现预期目标。本文通过赛车游戏示例探索了这一问题,并提出了包括从演示学习、人类反馈和迁移学习等研究方向,以减轻此类问题。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈