@gdb: 我们的模型旨在为任何给定任务提供最佳价格。如果你能在任何工作负载上获得更好的性价比……
摘要
OpenAI的Greg Brockman通过电子邮件邀请对模型定价和性能提供反馈。
我们的模型旨在为任何给定任务提供最佳价格。
如果你能在任何工作负载上获得更好的性价比,我们很乐意听取细节并一同探讨 — [email protected]。
查看缓存全文
缓存时间: 2026/07/15 17:56
我们的模型旨在为任何给定任务提供最佳价格。
如果你能在任何工作负载上获得更好的性价比,我们很乐意听取细节并一起审视——[email protected]。
相似文章
旨在为我们的客户提供市场上任何任务的最低价格,以及最高的能力上限。
OpenAI 宣布在接下来的三个月内,将 GPT-5.6 Sol 的 API 和信用额度定价降低 20%,旨在为客户提供更低的成本和更高的能力上限。
又一个基准测试:解决相同任务,0.34美元对比27.60美元
Archestra分享了他们通过在实际客户工作流中运行弱模型来调试产品缺陷,从而对AI智能体进行基准测试的方法。结果显示,像开放权重模型这样更便宜的模型可以以极低的成本(0.34美元对比27.60美元)获得类似的结果。
模型越多越好。一个昂贵模型输给三个廉价模型,而且有篇论文探讨了这一点。
一篇关于混合智能体的论文(arxiv 2406.04692)表明,一组廉价开放模型利用去相关误差,在AlpacaEval 2.0上超越了GPT-4o。作者还分享了类似的真实世界发现:多个廉价模型比单个昂贵模型能发现更多漏洞。
质量差距不到2%但成本相差10倍:在相同的工具调用任务上测试5个模型[D]
一位开发者在工具调用任务上测试了五个AI模型,发现廉价模型的表现与Opus等昂贵模型相差不到2%,腾讯混元(Tencent's Hunyuan)成本低于1.50美元,而Opus为15美元,通过将简单任务路由到廉价模型,每日成本从40美元降至9美元。
@rohanpaul_ai: 令人惊讶的好消息,开源编码模型,而且还有很多隐藏的机会可以降低成本……
Databricks 测试了开源编码模型 GLM-5.2,发现它在真实企业代码任务中可与 Claude Opus 4.8 等顶级闭源模型竞争,同时成本更低(每任务 1.28 美元对 1.94 美元)。评估还强调了 Pi 这个框架,它通过减少每轮发送的上下文来降低成本。