@rohanpaul_ai: 非常及时的文章。MCP 服务器需要清晰的设计模式,因为当工具过多或描述模糊时,LLM 会感到困惑……
摘要
本文提出了 MCP 服务器的设计模式,以提升 LLM 工具选择的准确性,并发现可见工具过多会降低性能,尤其是对较弱的模型而言。
查看缓存全文
缓存时间: 2026/07/02 02:16
这是一篇非常及时的论文。
MCP 服务器需要清晰的设计模式,因为当显示的工具过多或描述模糊时,LLM 会感到困惑。
本文阐述了如何构建 MCP 服务器,以确保 LLM 工具保持实用、安全且易于管理。
MCP 服务器设计并非普通的 API 设计,因为客户端是一个通过阅读纯语言描述来选择工具的 LLM。
它将真实的 MCP 服务器归纳为 5 种实用模式,例如暴露数据的服务器、运行工作流的服务器、维护会话状态的服务器、组合多个服务器的服务器,或者转换混乱领域 API 的服务器。
作者还警告了 4 个常见错误,尤其是功能过于通用的万能工具、模糊的工具描述、不安全的第三方内容,以及应该返回任务 ID 而不是等待的慢速工具。
他们在另外 54 个服务器上测试了这些模式标签,测量了传输延迟,并研究了当显示更多工具时工具准确率的变化。
关键结果是,可见工具过多会损害准确率,较弱的模型在显示 10 到 15 个工具时准确率会降至 90% 以下。
良好的 MCP 设计主要在于让工具列表保持精简、清晰、安全且足够稳定,以便 LLM 能够选择正确的操作。
链接 – arxiv.org/abs/2606.30317
标题:“面向 LLM 集成应用的 MCP 服务器架构模式”
相似文章
@omarsar0: 如果你使用MCP构建,这篇值得一读。(收藏它)论文涵盖了五个反复出现的MCP服务器模式……
本文对在十五个独立开发的服务器中观察到的五个反复出现的MCP服务器架构模式进行了分类,提供了一个包含上下文、问题、解决方案和后果的分类法。还记录了反模式、横切关注点以及定量评估,包括评分者间信度和传输开销。
MCP工具选择实际在哪里失效:基于检索的修复最多只能挽回约23%的失败
最近的分析表明,针对LLM智能体的基于检索的工具选择最多只能挽回约23%的失败,而针对注意力偏差的读取侧干预措施则可以挽回59-91%的失败,这表明真正的瓶颈在于模型的输出处理,而非输入过滤。
@alex_prompter: 我的智能体每次我给它们更多工具时,它们都变得更笨了。原因是机械性的。你连接的每个 MCP 服务器…
Ratel 是一个开源工具,通过使用 BM25 索引仅加载所需的工具(而不是所有可用工具),将输入令牌减少 79%,并提高了 AI 智能体的工具选择准确性。
利用智能体编写高效的工具——借助智能体本身
Anthropic 分享了为 AI 智能体设计、评估和优化工具的工程最佳实践,特别介绍了如何利用模型上下文协议(MCP)和 Claude Code 来提升智能体的性能。
PrologMCP:面向LLM代理的标准化Prolog工具接口
介绍了PrologMCP,这是一个开源服务器,通过模型上下文协议(MCP)将Prolog暴露为有状态工具,使LLM代理能够将推理委托给符号求解器。评估表明,在前沿推理LLM中,该工具在演绎推理任务上具有竞争力或更高的准确性。