SciOrch:学习编排专家级大语言模型以解决前沿多模态科学推理任务
摘要
SciOrch 提出了一种基于 MCTS 训练的 8B 视觉语言模型,用于协调多个专家级大语言模型进行多模态科学推理,在降低 API 成本的同时实现了更优性能。
查看缓存全文
缓存时间: 2026/06/18 07:55
论文页面 - SciOrch:学习编排专家LLM以解决前沿多模态科学推理任务
来源:https://huggingface.co/papers/2606.15872 我们很高兴分享我们的最新工作:SciOrch:学习编排专家LLM以解决前沿多模态科学推理🧬
科学推理常常需要阅读复杂的图表、整合不同领域的知识,并逐步解决问题。不同的LLM在这一过程中各有所长——因此,与其依赖单一模型,我们提出一个问题:一个小模型能否学会协调多个专家LLM?
为了回答这个问题,我们提出了SciOrch🎼,一个8B视觉语言模型,它学习分解科学问题、调用合适的专家模型并综合它们的答案。
由于调用商业模型成本高昂,我们使用基于MCTS的高效流水线 🌳 来训练SciOrch。
我们的结果表明,SciOrch在降低API成本的同时,超越了强大的单模型和多智能体基线。我们希望这是迈向更高效、更协作的科学推理AI系统的一步 🚀
相似文章
SciR:用于LLMs科学推理的可控基准
SciR是一种新的可控基准,用于评估LLMs在科学推理方面的能力,包括演绎、归纳和因果溯因,并通过参数控制提取难度和推理难度。测试表明,两个难度轴都会降低所有模型的性能,推理模型(如DeepSeek-R1)在推理方面优于指令模型。
当大型语言模型发展语言:用于高效多智能体推理的符号通信
本文提出通信语言符号路由(CLSR),多个LLM智能体自主发明并演化紧凑的符号语言进行推理,相比思维链(CoT)实现3-6倍的令牌减少,同时保持准确性。
学习如何让大语言模型进行推理
OpenAI 发布了一篇文章,通过密码破译示例探索大语言模型的推理技术,展示了语言模型的逐步问题求解和模式识别能力。
Agora:通过基于拍卖的任务分配增强LLM智能体推理
Agora引入了一种基于拍卖的任务分配机制,用于LLM智能体,将推理步骤视为可交易物品,并使用校准后的置信度将任务路由到最有能力的专家模型,从而在多个基准测试中提升推理性能。
@mdeng34: 前沿LLM正汇聚于高效、自适应推理。Opus 4.7让模型自行决定推理深度。GPT…
新研究引入了SR²AM,这是一种自调节何时使用模拟推理的配置器,提升了LLM的效率和性能。