我构建了一个实时排名系统,涵盖所有AI代理和基础模型(开源)

Reddit r/ArtificialInteligence 工具

摘要

一位开发者推出了AgentTape,这是一个实时排名网站,汇聚来自多个来源(GitHub、Hugging Face、OpenRouter等)的数据,对公开的AI代理和基础模型进行评分和比较,旨在提供超越基准测试的更全面评估。

我构建了[AgentTape](https://agenttape.com/),因为现有的模型排行榜无法完全涵盖我感兴趣的所有方面:基准测试性能只是一部分,还有谁在真正使用某个模型、谁在讨论它,以及它在成本和速度上的对比情况。它每小时从GitHub、Hugging Face、OpenRouter、MCP注册中心、npm、PyPI、arXiv、Hacker News等来源拉取数据,对每个公开的AI代理和基础模型进行评分和比较。我仍在调整评分方法,所以我很想听听你的想法——无论这个工具是否有用,或者你认为我有什么地方做得不对!
查看原文

相似文章

开放智能体排行榜

Hugging Face Blog

IBM Research 发布了开放智能体排行榜,这是一个开放的基准测试和评估框架,用于基于质量和成本比较完整的 AI 智能体系统,旨在衡量跨多样化任务的通用性。