@no_stp_on_snek: 哇,看看 Metal 上的提升!!!

X AI KOLs Following 事件

摘要

Qwen MLX 挑战赛是一项在 Apple Silicon 上对 AI 模型进行基准测试的比赛,鼓励在验证过程中提供官方分数并进行本地迭代。

哇,看看 Metal 上的提升!!! 👀👀 https://t.co/5djHHpYYMq
查看原文
查看缓存全文

缓存时间: 2026/08/17 20:27

哇,这金属性能提升太强了!!!👀👀
https://t.co/5djHHpYYMq


通义千问 MLX 挑战赛

来源:https://www.yukon.org/mlxfast
官方成绩均基于 Apple Silicon 实测数据;请在本地继续迭代优化,验证队列仍在处理中

版权所有 © 2026 Eigen Labs (https://eigenlabs.org/), Inc.

隐私政策 (https://www.yukon.org/mlxfast/privacy) 服务条款 (https://www.yukon.org/mlxfast/terms) GitHub (https://github.com/Layr-Labs/qwen-3.8-mtp-challenge) X (https://x.com/eigenlabs) Slack (https://join.slack.com/t/ecdsafail/shared_invite/zt-4667dhade-vm6H9hWQwSGxv8WnXYUlpQ)

相似文章

Metal-Sci:用于 Apple Silicon 上 LLM 驱动演化内核搜索的科学计算基准

Hugging Face Daily Papers

Metal-Sci 推出了一项包含 10 个任务的基准测试,用于优化 Apple Silicon 上的科学计算内核,并配套了由大语言模型驱动的演化搜索框架。该研究评估了 Claude Opus 4.7、Gemini 3.1 Pro 和 GPT 5.5 等模型,在实现显著加速的同时,利用分布外测试来捕获静默的性能退化问题。

@no_stp_on_snek: https://x.com/no_stp_on_snek/status/2052833502475833384

X AI KOLs Following

使用 Qwen2.5-32B-Instruct 搭配 longctx 和 vllm-turboquant 的单个 AMD MI300X 开源技术栈,在 MRCR v2 百万级上下文基准测试中取得了与 SubQ 闭源模型(0.659)相竞争的结果(0.601-0.688),表明开源权重方法已接近达到同等水平。