model-selection

标签

Cards List
#model-selection

你被录用了:LLM协作中的战略性模型选择

arXiv cs.CL ↗ · 昨天 缓存

本文提出了一种针对多LLM协作的9种模型选择算法的分类体系,研究表明,在数学、编程、问答和推理任务中,基于能力感知的选择策略相比随机或启发式的团队组建方式,性能提升最高可达36.1%。

0 人收藏 0 人点赞
#model-selection

让AI成为资产,而非开支

MIT Technology Review ↗ · 2天前 缓存

本文探讨了企业将AI从实验阶段转向生产阶段时的经济策略,重点在于根据工作负载需求和成本可预测性,评估所有权与消费模式。

0 人收藏 0 人点赞
#model-selection

路由应当自养其身:面向经济高效LLM路由的稀疏监督

Hugging Face Daily Papers ↗ · 3天前 缓存

论文提出了SaveRouter,一个稀疏监督的LLM路由框架,它有选择性地获取查询-模型反馈,并在相关查询之间共享能力信息,在保持具有竞争力的路由质量的同时降低监督成本,并将盈亏平衡部署量减少1.9-9.5倍。

0 人收藏 0 人点赞
#model-selection

SeLMRoute:基于概率化语义证据的大语言模型路由

Hugging Face Daily Papers ↗ · 4天前 缓存

SeLMRoute 提出了一种大语言模型路由框架,将与候选模型无关的语义证据抽取与性能学习解耦。在 LLMRouterBench 上,跨越 15 个数据集和 20 个候选模型,该框架取得了 72.08% 的平均准确率,超越了最强的固定候选模型(69.23%),并同时支持面向性能和成本感知的路由决策。

0 人收藏 0 人点赞
#model-selection

一个学习的LLM路由器得分为0.84 AUC。在每个任务内打乱标签后,得分仍为0.838 [R]

Reddit r/MachineLearning ↗ · 5天前

一项研究发现,一个训练用于在模型之间进行选择的LLM路由器学会了任务识别而非难度评估,导致在保留任务上泛化能力差,但基于廉价模型输出的延迟策略带来了更好的性能。

0 人收藏 0 人点赞
#model-selection

Rank Portability 并不意味着 Feasibility Portability:针对特定目标的联合硬件约束评估

arXiv cs.LG ↗ · 2026-09-22 缓存

本文挑战了在跨设备硬件评估中,rank portability 意味着 feasibility portability 的假设,通过基准测试表明,高秩相关性在联合硬件约束下并不能保证安全部署决策。

0 人收藏 0 人点赞
#model-selection

@GergelyOrosz: 与一家公司交谈,一年前他们的AI预算是无限的,CEO是技术背景且对AI非常乐观 “我们现在…

X AI KOLs Timeline ↗ · 2026-09-20 缓存

一家专注于AI的公司已经对最先进模型实施了每日预算限制,将大多数任务转向更便宜的模型,表明了AI成本管理的趋势。

0 人收藏 0 人点赞
#model-selection

真诚提问:更小的量化模型是否正在成为本地AI的最佳选择?

Reddit r/LocalLLaMA ↗ · 2026-09-19

文章探讨了更小的量化模型是否正在成为本地AI应用的首选,强调了它们在VRAM使用、性能和功能(如工具调用)之间的平衡。

0 人收藏 0 人点赞
#model-selection

FedFIbOS:基于Fisher重要性的异构联邦学习最优子建模

arXiv cs.LG ↗ · 2026-09-18 缓存

FedFIbOS提出了一种基于Fisher重要性的方法,用于异构联邦学习中的最优子模型选择,该方法具有理论基础,并在非独立同分布设置下比现有最先进方法准确率提高约10%。

0 人收藏 0 人点赞
#model-selection

@eve:由 @typesafeai 的 Jev 提供支持的自动工具审批。https://eve.dev/docs/guides/evaluate#evaluate-tool-approvals…

X AI KOLs Timeline ↗ · 2026-09-17 缓存

Eve 引入了使用 TypeSafe AI 的 Jev 实现自动工具审批和模型选择,通过 AI SDK 评估 API 为不同任务动态选择 AI 模型。

0 人收藏 0 人点赞
#model-selection

大型语言模型推理网络的最优模型激活策略

arXiv cs.CL ↗ · 2026-09-16 缓存

本文介绍了推理网络,一个基于图的框架,用于优化多个LLMs在推理中的使用,具有最优激活策略,可在满足性能目标的同时最小化成本。

0 人收藏 0 人点赞
#model-selection

通过自动路由 LLM 选择实现自动省钱

Reddit r/AI_Agents ↗ · 2026-09-12

作者构建了一个基于成本和性能数据自动路由 LLM 选择的系统,旨在优化 AI 支出,并计划将该工具开源。

0 人收藏 0 人点赞
#model-selection

anypick - 用于过滤和选择大型语言模型的库

Reddit r/AI_Agents ↗ · 2026-09-08

一个Python和TypeScript库,用于下载大型语言模型目录,并构建管道以根据价格、延迟和基准测试等标准过滤和选择模型。

0 人收藏 0 人点赞
#model-selection

我选择模型的经验法则

Reddit r/LocalLLaMA ↗ · 2026-09-03

作者分享个人经验,展示像 Qwen 27B 这样的大语言模型如何大幅缩短编程任务时间,并提供了模型选择的经验法则。

0 人收藏 0 人点赞
#model-selection

SCX Router: 流式零样本模型选择——基于解码器-KV分类器和现实世界任务本体

arXiv cs.AI ↗ · 2026-09-03 缓存

SCX Router 引入了一个基于GLiClass的轻量级模型选择工具,该工具使用解码器-KV分类器和任务本体来路由LLM任务,优化速度、成本和质量,无需自回归生成。

0 人收藏 0 人点赞
#model-selection

为AI代理构建性能分析引导优化

Reddit r/AI_Agents ↗ · 2026-09-02

作者正在开发Agent-PGO,这是一个工具,可以分析AI代理的执行,动态地为不太关键的任务替换更便宜的模型,同时通过评估基准保持质量。

0 人收藏 0 人点赞
#model-selection

EEG-AS:通过行为重建实现EEG基础模型的实例级选择

arXiv cs.LG ↗ · 2026-09-02 缓存

本文提出EEG-AS,一种算法选择框架,通过重建行为实现在多个EEG基础模型之间的实例级选择,从而提高神经解码性能。

0 人收藏 0 人点赞
#model-selection

具有聚类结构的向量的随机复杂性

arXiv cs.LG ↗ · 2026-09-02 缓存

本文提出一种递归公式,用于使用 Normalized Maximum Likelihood 模型高效计算具有聚类结构的向量的随机复杂性,将时间复杂度从多项式降低到线性。

0 人收藏 0 人点赞
#model-selection

理解 ChatGPT Work

Simon Willison's Blog ↗ · 2026-08-30 缓存

本文详细介绍了 ChatGPT Work 的功能和特点,这是 OpenAI 开发的一款强大AI工具,仅面向付费用户,重点介绍了其基于云的服务,例如代码执行和模型选择。

0 人收藏 0 人点赞
#model-selection

使用多个AI模型是否值得额外的复杂性?

Reddit r/ArtificialInteligence ↗ · 2026-08-25

本文探讨了为不同任务使用多个AI模型所带来的好处是否足以抵消增加的复杂性和管理负担。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈