标签
WikiSkill通过持久化维基来进化和转移技能,显示拥有此类技能的小模型在基准测试中优于无此技能的大模型,引发了关于AI代理中哪些知识应持久化的疑问。
@mtasic85 证明了仅通过提示编程,无需微调,LFM2.5 2.6B 在工具调用和技能系统应用中可以表现接近 Qwen3.8 27B。
本文认为,工具调用的可靠性往往不与模型能力成正比;较小的模型在遵循模式和格式规范方面可能超越较大的模型,这表明原始能力并非选择工具调用模型的唯一因素。