@neural_avb: 我最好的新习惯是让我的代理记录我在训练模型时使用的所有技巧和秘籍。我有日志……
摘要
作者分享了一个习惯:使用代理记录所有训练技巧和秘籍,包括超参数调整和数据集升级,以保持事实日志供日后参考和教程制作。
查看缓存全文
缓存时间: 2026/06/18 20:21
我最近养成的最好习惯是让智能体记录下我训练模型时使用的所有技巧和捷径。
我记录了每次超参数调整、数据集升级及其结果。
这是一条非常有教育意义的事件链,以后可以随时回顾。而且在制作YouTube教程时,也能让内容保持真实客观。
AVB (@neural_avb): 我逐步构建了这个135M参数的小型推理SLM,依次经历了CPT、SFT、DPO,现在正在做RL。
在这个数据和模型流程上投入了好几天。它居然真的有效!能以300 tok/s的速度执行研究文本的窄域目标任务。
好了,如果你们不介意,我要去制作超棒的YouTube内容了!
相似文章
@omarsar0: 关于自我改进代理的非常好的建议。(收藏)这是我正在自己的实验中观察到的现象,关于编码...
推文讨论了关于自我改进代理的建议,并分享了在长期任务中使用编码代理的实验观察,指出更强的模型并不总是能产生更好的代理。
@reach_vb: 你真的应该定期更新你的 agents md!这是我的:- 向用户解释某些内容时,使用 …
一条推文分享了针对 AI 代理的个人指南,涵盖简洁沟通、证据依据、任务执行和安全实践。
@KingBootoshi: 我的新AI工作流程搞乱了我的作息,但太值了。我感觉我的工程生产力又提升了一个层次……
作者分享了自己采用单一Codex智能体配合/goal模式的新编码工作流程的个人经历,他认为这比使用GPT-5.5和Opus 4.8等新模型的多智能体设置更优越。
@ashpreetbedi: https://x.com/ashpreetbedi/status/2084301728363462919
作者演示了如何为AI智能体构建一个递归自动改进循环:编码智能体挖掘使用数据来创建探针,在实时智能体上运行这些探针,并更新智能体的指令和工具,直到所有探针通过。该教程以Agno/AgentOS平台和Radar智能体为例。
@reach_vb: 一个好(定期更新)的 AGENTS md 就是你所需要的一切,你还可以在项目级别自定义指令与全局…
该推文强调,一个定期更新的 AGENTS.md 文件可以用来定制 AI 代理行为,无需构建自定义工具,特别是像 GPT 5.6 这样的指令跟随模型。