适合各种预算的最佳LLM,每日更新
摘要
一款每日更新的工具,通过可视化和比较大语言模型的性能与API成本,帮助用户根据预算选择最优模型。
暂无内容
查看缓存全文
缓存时间: 2026/09/24 16:09
# 哪个大语言模型值得选择
来源:https://bestmodelforyourbudget.terrydjony.com/
图中每个模型在**人工智能分析智能指数**中的得分与其综合API价格的关系。位于**价值前沿**的模型意味着:不存在价格更低且更智能的替代品;其余所有模型都会被该线上的某一点在价格和智能两方面同时超越。默认仅显示每个模型的最佳版本,并隐藏低分模型;可通过筛选条件扩大选择范围。
正在加载数据...
最低分数30每个模型一行制造商仅显示前沿为每个点添加标签
## 性能与价格
每百万Token综合成本(3:1输入输出比例,对数标度)与智能指数的关系。悬停或按Tab键查看点的详细信息。
位于价值前沿被支配:更便宜的模型性能持平或更优价值前沿
## 最佳预算模型
前沿线数据的速查表。找到符合您预算的行数;选择项是该价格下能获得的最高分模型,候补模型是同样符合预算的次优选择。
每百万Token预算选择分数价格候补
## 原始能力
完全忽略成本因素。
## 变化情况
每日数据抓取之间的差异:新增模型、移除模型以及重新评分或调价的模型。
## 所有数据
点击列标题排序。名称链接至该模型的人工智能分析页面。
模型制造商智能编程数学综合成本($/百万Token)输入成本($/百万Token)输出成本($/百万Token)处理速度(tokens/s)首Token延迟(秒)
## 阅读指南
- **价值前沿**按价格升序排列,保留所有得分高于所有更便宜模型的条目。价格相同时优先选择得分更高者;得分相同时优先选择价格更低者。
- **综合价格**指人工智能分析采用的3:1输入输出比例的每百万Token综合成本。未包含缓存输入折扣、批量定价及快速模式成本。
- **"每个模型一行"**保留每个模型名称中得分最高的版本(如遇平分则选择价格更低者)。取消勾选可查看所有基准测试的不同变体,例如低、中、高、超高及最大算力版本。
- **"最低分数"**会在图表和前沿计算中隐藏低于该指数的模型,避免老旧的小型超低价模型干扰整体曲线。
- **分数动态变化**人工智能分析会在版本间重新校准指数,因此请仅与当前页面对比,勿使用旧版快照。
来源:人工智能分析 (https://artificialanalysis.ai/) 免费数据API,通过GitHub Actions定时任务每日抓取。代码与数据:github.com/terryds/bestvaluemodel (https://github.com/terryds/bestvaluemodel)
相似文章
我比较了2026年18个主要LLM API价格——相同的工作负载费用从0.018美元到2美元不等
比较了主要提供商的18个LLM的API标价,强调相同工作负载下100倍的成本差异,并推荐使用模型路由以提高成本效率。
@tut_ml: 最佳大型语言模型课程 - https://mltut.com/best-large-language-models-courses/…
一篇博客文章列出了10个最佳大型语言模型(LLM)课程和培训资源,包括来自Coursera、DataCamp、Udacity以及Vanderbilt等大学的课程。
LLM基准测试
一项关于大语言模型基准测试的研究或报告,可能比较了各种任务上的表现。
LLM规划器 - 根据你的用例/模型/预算选择设备,或根据你的设备选择模型。60+配置方案,50+模型,130+引用t/s来源,150+评测YouTube视频,待机+运行功耗,多区域价格,定期更新。
一个全面的网络工具和公共数据集,帮助用户选择适合运行LLM的硬件,包含60+配置方案、50+模型、性能基准测试和评测视频,支持模型与硬件的双向匹配。
@tom_doerr: 本地LLM工具和硬件精选列表 https://github.com/0xSojalSec/LLMs-local…
一份精选列表,包含用于本地运行大语言模型的平台、工具、模型、硬件和资源,托管在GitHub上。