适合各种预算的最佳LLM,每日更新

Hacker News Top 工具

摘要

一款每日更新的工具,通过可视化和比较大语言模型的性能与API成本,帮助用户根据预算选择最优模型。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/09/24 16:09

# 哪个大语言模型值得选择 来源:https://bestmodelforyourbudget.terrydjony.com/ 图中每个模型在**人工智能分析智能指数**中的得分与其综合API价格的关系。位于**价值前沿**的模型意味着:不存在价格更低且更智能的替代品;其余所有模型都会被该线上的某一点在价格和智能两方面同时超越。默认仅显示每个模型的最佳版本,并隐藏低分模型;可通过筛选条件扩大选择范围。 正在加载数据... 最低分数30每个模型一行制造商仅显示前沿为每个点添加标签 ## 性能与价格 每百万Token综合成本(3:1输入输出比例,对数标度)与智能指数的关系。悬停或按Tab键查看点的详细信息。 位于价值前沿被支配:更便宜的模型性能持平或更优价值前沿 ## 最佳预算模型 前沿线数据的速查表。找到符合您预算的行数;选择项是该价格下能获得的最高分模型,候补模型是同样符合预算的次优选择。 每百万Token预算选择分数价格候补 ## 原始能力 完全忽略成本因素。 ## 变化情况 每日数据抓取之间的差异:新增模型、移除模型以及重新评分或调价的模型。 ## 所有数据 点击列标题排序。名称链接至该模型的人工智能分析页面。 模型制造商智能编程数学综合成本($/百万Token)输入成本($/百万Token)输出成本($/百万Token)处理速度(tokens/s)首Token延迟(秒) ## 阅读指南 - **价值前沿**按价格升序排列,保留所有得分高于所有更便宜模型的条目。价格相同时优先选择得分更高者;得分相同时优先选择价格更低者。 - **综合价格**指人工智能分析采用的3:1输入输出比例的每百万Token综合成本。未包含缓存输入折扣、批量定价及快速模式成本。 - **"每个模型一行"**保留每个模型名称中得分最高的版本(如遇平分则选择价格更低者)。取消勾选可查看所有基准测试的不同变体,例如低、中、高、超高及最大算力版本。 - **"最低分数"**会在图表和前沿计算中隐藏低于该指数的模型,避免老旧的小型超低价模型干扰整体曲线。 - **分数动态变化**人工智能分析会在版本间重新校准指数,因此请仅与当前页面对比,勿使用旧版快照。 来源:人工智能分析 (https://artificialanalysis.ai/) 免费数据API,通过GitHub Actions定时任务每日抓取。代码与数据:github.com/terryds/bestvaluemodel (https://github.com/terryds/bestvaluemodel)

相似文章

LLM基准测试

Reddit r/AI_Agents

一项关于大语言模型基准测试的研究或报告,可能比较了各种任务上的表现。