model-selection

标签

Cards List
#model-selection

@_markfenner: 今天的 Devinmaxxing: 从口袋里挑选模型。DevinX 现在支持本地会话的完整模型选择…

X AI KOLs Following · 2026-07-12 缓存

DevinX 现在支持本地会话的完整模型选择,包括 Sol、Fable 5、GLM、Kimi 以及自适应成本平衡选项,外加推理努力控制。

0 人收藏 0 人点赞
#model-selection

通过切换到思考更少的模型,将我的智能体响应延迟降低1.7倍——而不是解码更快的模型

Reddit r/AI_Agents · 2026-07-11

一篇文章描述如何通过切换到需要更少推理时间的模型,而不是专注于解码速度,将AI智能体响应延迟降低1.7倍

0 人收藏 0 人点赞
#model-selection

开发们 - 你有64GB显存 - 你用什么模型写代码?

Reddit r/LocalLLaMA · 2026-06-30

一位拥有64GB显存的开发者分享了他使用unsloth版Qwen 3.5 122b-a10b模型进行编码的偏好,并向社区征求推荐。

0 人收藏 0 人点赞
#model-selection

Qwen 3.6 27B 还是 Qwen 3.5 35B 用于 AI 智能体?

Reddit r/AI_Agents · 2026-06-30

比较了 Qwen 3.6 27B 和 Qwen 3.5 35B 模型在 AI 智能体应用中的使用情况,讨论了它们的性能和适用性。

0 人收藏 0 人点赞
#model-selection

@snowboat84: 你有没有发现,AI里模型的诞生其实相当随意?拿语言模型举例子:先是RNN,再到LSTM,某天突然说Transformer效果好就全换上,后来又拆成Encoder和Decoder,一会儿说BERT一桶浆糊,一会儿又说GPT可以有涌现能力,S…

X AI KOLs Timeline · 2026-06-26 缓存

文章讨论了AI模型诞生的随意性,提出从物理学模型中获得灵感并建立备选模型资料库,将选模型过程工程化的想法。

0 人收藏 0 人点赞
#model-selection

我几个月前就不再比较模型了。我的输出质量反而提升了。

Reddit r/AI_Agents · 2026-06-24

作者分享说,他不再比较AI模型,转而专注于工作流设计,结果输出质量反而提升了。他认为对于大多数实际用例,工作流比模型选择更具杠杆效应。

0 人收藏 0 人点赞
#model-selection

有没有人真正有效地解决了每提示词模型路由问题,还是我们都在靠直觉判断?

Reddit r/AI_Agents · 2026-06-18

本文探讨了AI智能体中每提示词模型路由的挑战,质疑是否有人真正有效解决了这个问题。文章指出,当前实践依赖直觉,固定费率计划降低了优化压力,而分流层本身也可能带来额外成本。

0 人收藏 0 人点赞
#model-selection

ARIADNE:推理时适配器动态选择的无关路由

arXiv cs.AI · 2026-06-18 缓存

提出ARIADNE,一种无需训练、适配器无关的路由框架,通过在嵌入空间中测量输入与适配器特定质心的接近度,在推理时选择最优的PEFT适配器,在23个任务上恢复了97.44%的上限性能。

0 人收藏 0 人点赞
#model-selection

模型选择在因果推断中的关键作用:基于InferBERT框架的药物警戒分类模型比较分析

arXiv cs.LG · 2026-06-17 缓存

本文系统评估了InferBERT框架中分类模型选择对因果不良药物事件检测的影响,发现领域特定预训练(BioBERT)优于简单模型及Med-LLaMA等大型语言模型。

0 人收藏 0 人点赞
#model-selection

你最强的模型可能不是最佳的工具调用者

Reddit r/AI_Agents · 2026-06-17

本文认为,工具调用的可靠性往往不与模型能力成正比;较小的模型在遵循模式和格式规范方面可能超越较大的模型,这表明原始能力并非选择工具调用模型的唯一因素。

0 人收藏 0 人点赞
#model-selection

我厌倦了在OpenRouter、Artificial Analysis和Design Arena标签页之间切换来选择模型,于是把它们整合到一个可筛选的表格中

Reddit r/LocalLLaMA · 2026-06-15

一位开发者构建了ModelGrep,这是一款免费工具,将来自OpenRouter、Artificial Analysis和Design Arena的AI模型数据聚合到一个可搜索的表格中,支持按价格、基准测试、吞吐量等进行筛选。

0 人收藏 0 人点赞
#model-selection

真正的AI生产力秘诀不是新工具——而是模型匹配与商业判断

Reddit r/AI_Agents · 2026-06-12

文章认为,AI生产力的关键在于不盲目追求新工具,而是为每个任务选择合适的模型,并将其与深刻的商业判断相结合。它强调并行运行多个模型,并利用人类专业知识来纠正AI的缺陷。

0 人收藏 0 人点赞
#model-selection

MedicalRec: 用于图像分类的医疗推荐系统,无需重新训练

arXiv cs.LG · 2026-06-09 缓存

本文介绍了MedicalRec,一个基于Transformer的推荐系统,可为医学图像分类任务推荐最优模型,无需重新训练。该系统构建于从3000篇文章中编译的数据集(MedicalRec-Bench)之上,包含超过5000条记录。

0 人收藏 0 人点赞
#model-selection

@tomas_hk: 是的,我们在此分享了我们的经验:

X AI KOLs Following · 2026-06-08 缓存

这是一份全面指南,解释了模型路由技术,该技术能够智能地为每个请求选择最合适的AI模型,以优化成本、质量和延迟。文章将模型路由与AI网关进行了对比,并强调了其在代理型AI工作负载中的重要性。

0 人收藏 0 人点赞
#model-selection

从采样结果到能力分布:重新思考LLM路由的监督

arXiv cs.LG · 2026-06-08 缓存

本文提出DARS,一个从模型行为的分布视角构建路由监督的框架,旨在解决LLM路由中单次标签不可靠的问题。

0 人收藏 0 人点赞
#model-selection

TorchKM:面向GPU的核学习与模型选择库

arXiv cs.LG · 2026-06-08 缓存

TorchKM是一个开源的GPU加速核机器库(支持向量机、核逻辑回归等),采用scikit-learn风格的API。通过重用矩阵运算加速训练和模型选择,相比标准基线实现了显著的加速比。

0 人收藏 0 人点赞
#model-selection

不确定性下的证据引导神经架构选择用于个体化血糖预测

arXiv cs.LG · 2026-06-05 缓存

提出EVIDENT框架,该框架整合贝叶斯训练与基于证据的排序进行神经架构选择,并在1型糖尿病的个体化血糖预测中演示,系统地选择泛化可靠的轻量模型。

0 人收藏 0 人点赞
#model-selection

离线选择器为何无法胜过最佳单一模型:基于edX辍学预测的诊断性研究

arXiv cs.LG · 2026-06-04 缓存

本文提出了一个三阶段诊断框架,用于识别离线模型选择器为何无法胜过最佳单一模型,并将其应用于edX点击流数据上的辍学预测。研究发现瓶颈在于局部表征歧义,而非学习器选择或分布偏移,建议重新设计状态或收集新数据,而非进一步调优算法。

0 人收藏 0 人点赞
#model-selection

MOSAIC:结构化代理智能与组合的模块化编排框架

arXiv cs.AI · 2026-06-02 缓存

MOSAIC 提出了一种用于自动化数据科学的结构化代理框架,该框架基于记忆驱动的模型选择和工作流构建,并在金融时间序列任务上得到验证。其性能优于 AutoML 及其他基于代理的基准方法。

0 人收藏 0 人点赞
#model-selection

从罗生门理论到PRAXIS:高效决策树罗生门集合

arXiv cs.LG · 2026-06-02 缓存

PRAXIS是一种新算法,能够高效近似接近最优决策树的罗生门集合,在运行时间和内存使用上实现数量级的改进,同时保持近乎完美的召回率。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈