model-selection

标签

Cards List
#model-selection

我选择模型的经验法则

Reddit r/LocalLLaMA · 昨天

作者分享个人经验,展示像 Qwen 27B 这样的大语言模型如何大幅缩短编程任务时间,并提供了模型选择的经验法则。

0 人收藏 0 人点赞
#model-selection

SCX Router: 流式零样本模型选择——基于解码器-KV分类器和现实世界任务本体

arXiv cs.AI · 昨天 缓存

SCX Router 引入了一个基于GLiClass的轻量级模型选择工具,该工具使用解码器-KV分类器和任务本体来路由LLM任务,优化速度、成本和质量,无需自回归生成。

0 人收藏 0 人点赞
#model-selection

为AI代理构建性能分析引导优化

Reddit r/AI_Agents · 2天前

作者正在开发Agent-PGO,这是一个工具,可以分析AI代理的执行,动态地为不太关键的任务替换更便宜的模型,同时通过评估基准保持质量。

0 人收藏 0 人点赞
#model-selection

EEG-AS:通过行为重建实现EEG基础模型的实例级选择

arXiv cs.LG · 2天前 缓存

本文提出EEG-AS,一种算法选择框架,通过重建行为实现在多个EEG基础模型之间的实例级选择,从而提高神经解码性能。

0 人收藏 0 人点赞
#model-selection

具有聚类结构的向量的随机复杂性

arXiv cs.LG · 2天前 缓存

本文提出一种递归公式,用于使用 Normalized Maximum Likelihood 模型高效计算具有聚类结构的向量的随机复杂性,将时间复杂度从多项式降低到线性。

0 人收藏 0 人点赞
#model-selection

理解 ChatGPT Work

Simon Willison's Blog · 4天前 缓存

本文详细介绍了 ChatGPT Work 的功能和特点,这是 OpenAI 开发的一款强大AI工具,仅面向付费用户,重点介绍了其基于云的服务,例如代码执行和模型选择。

0 人收藏 0 人点赞
#model-selection

使用多个AI模型是否值得额外的复杂性?

Reddit r/ArtificialInteligence · 2026-08-25

本文探讨了为不同任务使用多个AI模型所带来的好处是否足以抵消增加的复杂性和管理负担。

0 人收藏 0 人点赞
#model-selection

@svpino: 使用此工具,你会意识到对于你试图解决的99.9%的任务,你实际上并不需要Fable。

X AI KOLs Timeline · 2026-08-18 缓存

Atlas Cloud的Creator Central包含Model Explorer,这是一个工具,可同时在多个AI模型上运行提示,以简化开发者在模型选择和测试方面的工作。

0 人收藏 0 人点赞
#model-selection

@OpenAIDevs: 初创公司从使用GPT-5.6构建经济高效的代理中学到了什么?我们与各行业的团队合作,……

X AI KOLs Timeline · 2026-08-17 缓存

初创公司通过利用更智能的模型选择、推理和工具调用,学习如何使用GPT-5.6构建经济高效的AI代理来处理复杂工作。

0 人收藏 0 人点赞
#model-selection

我们是否默认过度配置了AI智能体?

Reddit r/AI_Agents · 2026-08-12

文章认为,许多AI智能体工作流将每个任务都路由到前沿模型,浪费了资金,并建议对简单、结构化的任务使用更便宜的模型层级,同时将更困难的任务升级。文章提供了一个成本比较,显示分层方法可节省高达75%的费用。

0 人收藏 0 人点赞
#model-selection

UpliftBench: Revealing Outcome-Regime and Objective Mismatch in Uplift Evaluation

arXiv cs.LG · 2026-08-04 缓存

UpliftBench is a benchmark paper showing that disagreements between uplift modeling evaluations often stem from metric choice rather than model quality, identifying specific mismatches between ranking metrics and deployment objectives across several dataset families.

0 人收藏 0 人点赞
#model-selection

我现在(主要)根据速度而非智能来挑选模型

Lobsters Hottest · 2026-08-02 缓存

作者认为前沿大语言模型已经达到了“足够好”的智能门槛,因此现在选择模型时更看重速度而非原始智能,并举例说像GLM5.2和DeepSeek V4 Flash这样快速的开源权重模型已成为日常主力。

0 人收藏 0 人点赞
#model-selection

大家都在构建LLM路由器,我们却弃用了自己的

Hacker News Top · 2026-07-31 缓存

Manifest解释了为何弃用其LLM路由器,认为模型路由会引入不可预测性、破坏行为一致性,且无法仅凭提示词推断其复杂性,因此对大多数用例而言,缓存和审慎的模型选择更为有效。

0 人收藏 0 人点赞
#model-selection

EEG情绪识别中的评估协议与跨受试者泛化

arXiv cs.LG · 2026-07-31 缓存

本文以SEED和SEED-IV数据集上的DGCNN为例,研究了评估协议如何影响EEG情绪识别中报告的准确率。研究表明,受试者相关(subject-dependent)、跨受试者(subject-disjoint)和跨会话(cross-session)评估回答的是不同问题,而检查点选择(checkpoint selection)和测试集重用可能会虚增准确率。

0 人收藏 0 人点赞
#model-selection

Gemini API 托管代理:3.6 Flash、钩子等更多功能

Google AI Blog · 2026-07-28 缓存

谷歌宣布了 Gemini API 中托管代理的更新,包括默认使用 Gemini 3.6 Flash 模型、用于工具调用审计的环境钩子、预算控制、定时触发器和免费层级访问。

0 人收藏 0 人点赞
#model-selection

@github: 每次 Copilot 会话中更多部分用于有效工作,因此你的积分更耐用,使用方式不变。Prom…

X AI KOLs Timeline · 2026-07-27 缓存

GitHub Copilot 现在使用提示缓存、工具搜索和自动模型选择(HyDRA)来降低成本并提高效率,实现了 3.3 倍的节省,同时与 OpenRouter Auto 的解决率相匹配。

0 人收藏 0 人点赞
#model-selection

Runway 推出生成式媒体 AI 路由器(2 分钟阅读)

TLDR AI · 2026-07-24 缓存

Runway 发布了 Media Router,这是一款偏好优化路由器,可根据用户定义的成本、质量或延迟标准自动选择最佳视频、图像或音频模型,无需手动挑选模型。该产品已在 Runway Dev 中上线。

0 人收藏 0 人点赞
#model-selection

Ramp Router 声称可将AI成本降低高达30%

Reddit r/ArtificialInteligence · 2026-07-21

Ramp 正在开源其内部 LLM 路由器,该路由器能根据每个请求自动选择最佳模型,以优化成本和性能。

0 人收藏 0 人点赞
#model-selection

@pvncher: https://x.com/pvncher/status/2077708372363624894

X AI KOLs Following · 2026-07-16 缓存

本文讨论了在Codex中针对不同任务类型选择GPT-5.6 Sol、Terra或Luna变体的方法。

0 人收藏 0 人点赞
#model-selection

大多数独立开发者只用一个模型处理所有事情。这真的是正确的选择吗?

Reddit r/AI_Agents · 2026-07-14

探讨独立开发者是否应该依赖单一AI模型处理所有任务,或者考虑使用多个专用模型。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈