标签
SAAG提出了一种级联诊断框架,用于评估LLM智能体函数调用,通过将评估分解为注册一致性、结构完整性和参数基础验证三个阶段,实现可解释的诊断和迭代自我修复。在sub-4B模型上的实验表明,与单次评估相比,参数精度得到提升,值幻觉减少。
一个用Rust构建的新智能体规范框架,具有小巧的二进制体积、集成Vuepress用于文档展示、问题持久化以改进代码评审上下文、以及自修复能力。兼容多种智能体工具,目前仍在开发中。