构建了一个开源、规范驱动的 AI 开发工具,可在同一功能上并行运行多个智能体,并由 LLM 评审选出最佳实现
摘要
Aigon 是一款开源工具,可在同一功能上并行运行多个 AI 编码智能体(功能通过 Markdown 规范定义),并使用 LLM 评审选出最佳实现,配备可视化看板和可选调度功能。
大家好,我一直在开发一个可能对大家有用的东西。我之前在日常项目中使用 Claude Code,总想同时把同一个功能交给 Codex 或 Gemini 来对比不同的实现,并选出最好的一个。但除非手动进行大量工作区切换,否则没有简便的方法。所以我构建了 Aigon。它的工作方式是:你在代码仓库中以 Markdown 形式编写功能规范,选择你想要的智能体 CLI(目前支持 Claude Code、Codex、Gemini、Cursor CLI、Kimi K2、OpenCode 和 AmpCode),然后 Aigon 会在同一个功能的独立 Git 工作区中并行运行这些智能体。接着,你可以选择一个智能体/模型作为 LLM 评审,它会对所有实现进行评分并选出获胜者。你可以接受评审的决定,也可以从其他候选实现中手动挑选。无需第三方 API 密钥,它在标准的智能体 CLI 会话(claude、codex、gemini 等)中运行,所以你使用的是自己的订阅。仪表板会在工作区中启动功能,智能体在 tmux 会话中运行。你随时可以跳入某个会话,使用自己的工具交互式完成。该工具与其他规范驱动的 AI 框架(如 OpenSpec 和 spec-kit)有相似之处。我的差异化在于:\- 多智能体并行运行 + LLM 评审 \- 可视化看板仪表板 \- 定时自主构建(Aigon Pro — 付费层级)—— 启动一个或一组功能,早上查看结果。Pro 的“指挥器”按依赖顺序排列功能,失败时暂停,无人值守运行。如果某个智能体用完配额(例如 Claude Code 达到限制),它会自动切换到已配置的备份智能体(例如 Codex)。非常适合充分利用你原本会浪费的订阅配额窗口。\- Aigon 不直接与模型通信,而是编排你已经付费的 CLI 智能体。你通过自己的订阅控制花费,Aigon 提供便捷的仪表板显示配额使用情况。它从 Claude Code 内部的一两个斜杠命令开始,逐渐演变,现在有了看板仪表板来帮助跟踪多个并发功能,最近还加入了调度和自动切换功能。很高兴在评论中回答任何问题 —— 仓库链接和 3 分钟演示视频在我的第一条评论中。谢谢,John
相似文章
我用AutoGen、CrewAI、LangGraph和MetaGPT与我的Agent OS进行了基准测试。“LLM-as-a-judge”范式完全失效。以下是本地数据。
本文对五种AI代理框架在严格的Rust编码任务上进行了基准测试,结果显示,使用LLM评委的框架经常失败或幻觉成功,而采用机械验证方法则产生更可靠的结果。
我构建了一个工具,让AI代理互相辩论。你来选择谁在房间里。
一个工具,让你创建目标对立的AI代理来模拟争论,适用于销售准备、创意压力测试和困难对话。可在本地运行,模拟模式下无需API密钥。
我构建了一个开源代理,其推理核心融合了多个LLM(面板、裁判、合成器),而不是路由到单一模型
作者构建了一个开源代理,它使用一组不同的LLM(包括裁判和合成器)来处理困难的推理步骤,同时具备成本感知路由、分层记忆、治理和子代理支持。该软件处于alpha阶段,关于融合效果的基准测试结果不一。
aaif-goose/goose
Goose 是一个开源、可扩展的 AI 代理,能够利用任意大语言模型来安装、执行、编辑和测试代码。
超棒的开源AI智能体平台
一份精选的开源AI智能体平台列表及讨论,这些平台允许构建、自动化和集成用于各种任务的专用智能体,并呼吁社区对遗漏的解决方案提供反馈。