@ClementDelangue:我们需要开放追踪数据,让每个人都能训练开放的智能体模型!cc @steipete @badlogicgames @thdxr @matanSF @hwchase17
摘要
Clement Delangue 呼吁开放追踪数据,以普及开放智能体模型的训练。
我们需要开放追踪数据,让每个人都能训练开放的智能体模型!cc @steipete @badlogicgames @thdxr @matanSF @hwchase17
查看缓存全文
缓存时间: 2026/04/22 19:06
我们需要开放 traces,让每个人都能训练开放的 agent 模型!cc @steipete @badlogicgames @thdxr @matanSF @hwchase17
相似文章
@ClementDelangue: 我们是否应该尝试训练一个开源AI构建模型?我们显然有有趣的数据集,如HF、MLintern、tran…
Clement Delangue 询问是否应该训练一个开源AI构建模型,并指出有可用的数据集和工具,如HF、MLintern、transformers和trl。
@julien_c:今天我要发布一个名为 SynthTraces 的新项目,它是一个极简的代码库,用于生成合成编码智能体会话轨迹…
Julien Chaumond 发布了 SynthTraces,这是一个极简的代码库,通过让一个开放模型(通过 HF Inference Providers)与一个本地小模型(通过 llama.cpp)在真实开源代码库上交互,生成合成编码智能体会话轨迹,已产出超过 2,000 个 Pi 会话轨迹,可用于训练和微调大语言模型。
@adithya_s_k: 你现在可以直接用 TRL 对模型在智能体轨迹上进行微调:Claude Code 轨迹、Codex 轨迹、OpenClaw 轨迹、Pi 轨迹……
TRL 现在支持对来自各种来源(如 Claude Code、Codex、OpenClaw 和 Pi)的智能体轨迹进行模型微调,这正朝着训练智能体模型的标准化栈迈进。
@ClementDelangue: 如何?与其让闭源的前沿实验室秘密且孤立地运行相同的训练,开放科学和开放…
Clement Delangue 认为,开放科学和开源AI可以让AI支出更高效,对比了美国和中国的人工智能投资策略。
@martin_casado:这解决了一个非常困难且重要的人工智能系统问题。本质上,如何大规模地向AI智能体暴露你的追踪数据。
马丁·卡萨多的一条推文,强调了一种解决方案,该方案解决了大规模向AI智能体暴露追踪数据这一难题,并平衡了成本与AI的杠杆作用。