@pvncher: 虽然你说得完全正确,这些路由器确实没有意义,但我已经对运行那些仅仅……的基准测试完全失去了兴趣。
摘要
作者讨论了OpenRouter推出的缓存感知模型路由器,该路由器针对质量、速度和成本优化模型选择,同时批评了那些孤立评估AI工具而非真实场景的基准测试。
@theo 虽然你说得完全正确,这些路由器确实没有意义,但我已经对运行那些仅仅测试一堆小任务以孤立评估此类想法的基准测试完全失去了兴趣。
在现实世界中,用户运行提示可能需要一小时以上。模型必须
查看缓存全文
缓存时间: 2026/09/28 03:29
@theo 虽然你说得完全正确——这些路由器确实没太大意义——但我已经受够了那种仅通过测试一堆独立小任务来评估这类方案的基准测试。
现实世界中,用户运行的提示可能需要一小时以上才能完成。模型必须…
OpenRouter@OpenRouter·9月26日: 推出 typesafe/jev-router:由 Jev 和 @typesafeai 提供支持的缓存感知模型路由器
Jev Router 为每个请求选择最佳模型和推理力度,平衡质量、速度和成本。
工作原理如下 👇🏻
相似文章
@mckaywrigley:看好模型路由器。相同性能更低成本是显而易见的,但通过创建“更平滑”…
一条推文强调了模型路由器和“模型融合”的前景,提到Not Diamond Code的发布,这是一种面向编码智能体的智能模型路由器,可将成本降低20-65%。
基准测试将开放模型与封闭产品进行比较,而非封闭模型。我们可能忽略了真正付费的部分。
认为将开放模型与封闭API产品进行比较的基准测试具有误导性,因为它们衡量的是原始推理能力,而非隐藏的工具和预处理,暗示实际模型质量差距可能比报告的要小。
(吐槽;)) 让你的基准测试更贴近现实
社区吐槽:呼吁AI模型基准测试应更贴近现实,考虑上下文大小、多模态特性、具体硬件配置和并行处理,而不仅仅是原始速度。
@mattshumer_: 每次有VC发给我一家自动路由公司进行尽职调查时,我都会回复类似这样的内容。如果缓存不是个事儿……
这篇帖子批评了AI中的自动路由公司,强调频繁切换模型会使提示缓存失效,导致更高的token成本和效率低下。
为什么MoE模型如此被轻视?
讨论了一种常见观点,即低活跃参数量的MoE模型不如密集模型,并认为路由器的有效性和架构细节才是关键。