@aimlapi: Qwen3.7-Max on AI/ML API - 为智能体时代打造 GPQA Diamond (92.4), HMMT (97.1), Apex (44.5) 可持续运行35小时以上…
摘要
Qwen3.7-Max 是一款为智能体时代打造的新AI模型,在基准测试中取得优异成绩(GPQA Diamond 92.4, HMMT 97.1, Apex 44.5),可自主运行超过35小时,并支持与Claude Code和Qwen Code集成。
查看缓存全文
缓存时间: 2026/05/22 04:08
Qwen3.7-Max 在 AI/ML API 上——专为智能体时代打造
GPQA Diamond(92.4)、HMMT(97.1)、Apex(44.5) 可持续自主执行 35 小时以上 兼容 Claude Code、Qwen Code 等
评论 Qwen 即可获取免费促销码 https://t.co/knScrnAlvV
相似文章
Apple为中国市场训练自有AI模型,有望成为首家获准在中国提供自家AI模型的外国公司
据报道,Apple正在为中国市场训练自己的AI模型,这可能使其成为首家获准在中国提供自家AI模型的外国公司。
@elonmusk: Grok 4.6 在与 Grok Build 工具链配合使用时效果最佳。没有它,体验会显著变差,因此最好……
埃隆·马斯克宣布,Grok 4.6 针对 Grok Build 工具链进行了优化,没有它性能会显著下降。
Qwen 30B MoE - 30tps - 6GB显存 - 搞定!
一位用户分享了在RTX 3050 6GB上成功运行Qwen 30B MoE的经验,支持90k上下文,速度达到每秒30-35个token,庆祝低端硬件的出色表现。
等待Qwen 3.8 27B就像等待《星球大战》第一集吗?
作者对尝试即将推出的Qwen 3.8 27B模型感到兴奋又焦虑,将这种等待比作对《星球大战》第一集的失望。
@no_stp_on_snek: Qwen3.8 lands in tomorrw, so I went back and finished the 3.6-27B card first. No point measuring a successor against a …
The author presents an off-label evaluation card for Qwen3.6-27B, covering quantization, reasoning mode effects, bias probes, and jailbreak resistance, and compares reasoning effects with Nemotron 3.5 Lightning, finding that thinking mode is net-negative for Qwen but positive for Nemotron.