trustworthy

标签

Cards List
#trustworthy

AutoTuneBench: 用于LLM服务引擎代理自动调优的可信度量

arXiv cs.AI · 13小时前 缓存

AutoTuneBench 提出了一个基准和测量协议,用于LLM服务引擎的可信代理自动调优,解决了诸如稻草人基线和基础设施缺陷等故障模式,以确保可靠的结果。

0 人收藏 0 人点赞
#trustworthy

Qwen3.8-27b 是第一个我能够盲目信任的本地模型

Reddit r/LocalLLaMA · 2026-09-04

一位用户赞扬了 Qwen3.8-27b 本地 AI 模型在连续代理工作中表现出的可靠性,连续运行超过8小时而没有任何错误,称这是第一个他们可以盲目信任的本地模型。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈