@Dorialexander: 因为我一直关注RL环境市场:Anthropic确实做了大量的Slack强化学习

X AI KOLs Following 新闻

摘要

一条推文强调,Anthropic利用Slack对话进行了大规模的强化学习,Andrej Karpathy强调这并非像通常被误解的那样是一个简单的Slack机器人功能。

因为我一直关注RL环境市场:Anthropic确实做了大量的Slack强化学习
查看原文
查看缓存全文

缓存时间: 2026/06/25 00:08

既然我一直关注RL环境市场:Anthropic确实在Slack上做了大量强化学习

安德烈·卡帕西(@karpathy): 没错,我觉得团队里很多人根本没仔细看标题以外的内容,就做出了完全错误的推断和比较,还借机妄加非议。这可不是什么蹩脚Slack机器人的“功能”,更不是Claw。

相似文章

@tanayj: https://x.com/tanayj/status/2072766211256119475

X AI KOLs Timeline

本文探讨了将强化学习应用于缺乏明确可验证性任务的挑战,引用了Dario Amodei关于实现“数据中心中的天才之国”的预测,并讨论了RLVR、RLHF、Constitutional AI以及Scale AI的基于规则的奖励等技术。