@lhoestq: 未来是将代理轨迹转换为SFT数据集。为此有一个很棒的库:pip install teich
摘要
一个名为teich的库可以将代理轨迹转换为有监督微调(SFT)数据集,简化了AI训练的数据集准备。
未来是将代理轨迹转换为SFT数据集。为此有一个很棒的库:pip install teich https://t.co/pdFvSdXLmn
查看缓存全文
缓存时间: 2026/05/21 13:32
未来是将代理追踪转换为SFT数据集。有一个很棒的库可以实现:pip install teich https://t.co/pdFvSdXLmn
相似文章
如何将轨迹转化为训练数据集?
本文介绍了一个将AI代理轨迹转化为带标签训练数据集的过程,详细说明了自动捕获、策略采样和基于标准的明确标记等步骤。
ProCUA-SFT 技术报告
ProCUA-SFT 是一个大规模合成数据集,包含 310 万个步骤级别的 SFT 样本,用于训练计算机使用代理。该数据集通过使用单一 VLM(Kimi-K2.5)的自动化流程生成。在其上微调 UI-TARS 7B 在 OSWorld 上达到 45.0%,比基础模型提高了 18.7 个百分点。
@Vtrivedy10: 有一个非常令人兴奋的未来智能体配方,用于构建低成本到无需计量的智能,应用于提取信…
该帖子概述了一个未来智能体配方,通过微调高效、专业化的开源模型,在LLM-as-a-judge任务上超越前沿性能,并将其应用于从追踪数据中提取信号以实现持续学习。LangChain Labs 和 FireworksAI 发布了展示这一方法的新工作。
@adithya_s_k: 你现在可以直接用 TRL 对模型在智能体轨迹上进行微调:Claude Code 轨迹、Codex 轨迹、OpenClaw 轨迹、Pi 轨迹……
TRL 现在支持对来自各种来源(如 Claude Code、Codex、OpenClaw 和 Pi)的智能体轨迹进行模型微调,这正朝着训练智能体模型的标准化栈迈进。
@martin_casado:这解决了一个非常困难且重要的人工智能系统问题。本质上,如何大规模地向AI智能体暴露你的追踪数据。
马丁·卡萨多的一条推文,强调了一种解决方案,该方案解决了大规模向AI智能体暴露追踪数据这一难题,并平衡了成本与AI的杠杆作用。