Qwen3.7:智能代理前沿(15分钟阅读)

TLDR AI 模型

摘要

阿里巴巴Qwen团队发布了Qwen3.7-Max,这是一款专有智能代理基础模型,在Terminal-Bench 2.0、SWE-Pro、GPQA Diamond等多个基准测试中取得最高分,并在多种代码环境中表现一致。

阿里巴巴Qwen团队发布了Qwen3.7-Max,这是一款专有智能代理基础模型,在Terminal-Bench 2.0-Terminus、SWE-Pro、SciCode、MCP-Mark、GPQA Diamond、HMMT Feb 2026以及IMOAnswerBench上取得最高分,并在Claude Code、OpenClaw、Qwen Code以及自定义测试框架中表现一致。
查看原文

相似文章

Qwen3.7-Max:智能体前沿

Hacker News Top

Qwen3.7-Max 是一个专注于智能体能力的新 AI 模型发布,推动了自主 AI 智能体的边界。

Qwen 3.6 27B 在 DeepSWE 上的表现

Reddit r/LocalLLaMA

Qwen 3.6 27B 在 DeepSWE 基准测试中获得了 2% 的分数,排名 18/20,高于 Haiku 4.5 和 Minimax M2.7,突显了本地模型与前沿模型之间的差距。