@no_stp_on_snek: 哇,看看 Metal 上的提升!!!
摘要
Qwen MLX 挑战赛是一项在 Apple Silicon 上对 AI 模型进行基准测试的比赛,鼓励在验证过程中提供官方分数并进行本地迭代。
查看缓存全文
缓存时间: 2026/08/17 20:27
哇,这金属性能提升太强了!!!👀👀
https://t.co/5djHHpYYMq
通义千问 MLX 挑战赛
来源:https://www.yukon.org/mlxfast
官方成绩均基于 Apple Silicon 实测数据;请在本地继续迭代优化,验证队列仍在处理中
版权所有 © 2026 Eigen Labs (https://eigenlabs.org/), Inc.
隐私政策 (https://www.yukon.org/mlxfast/privacy) 服务条款 (https://www.yukon.org/mlxfast/terms) GitHub (https://github.com/Layr-Labs/qwen-3.8-mtp-challenge) X (https://x.com/eigenlabs) Slack (https://join.slack.com/t/ecdsafail/shared_invite/zt-4667dhade-vm6H9hWQwSGxv8WnXYUlpQ)
相似文章
Metal-Sci:用于 Apple Silicon 上 LLM 驱动演化内核搜索的科学计算基准
Metal-Sci 推出了一项包含 10 个任务的基准测试,用于优化 Apple Silicon 上的科学计算内核,并配套了由大语言模型驱动的演化搜索框架。该研究评估了 Claude Opus 4.7、Gemini 3.1 Pro 和 GPT 5.5 等模型,在实现显著加速的同时,利用分布外测试来捕获静默的性能退化问题。
@neural_avb:我正在将SAM模型及其工具套件移植到Apple silicon上。已经在mlx上看到1.25倍推理速度提升……
将SAM 2.1模型移植到Apple silicon上(使用MLX),在小模型上实现了1.25倍推理速度提升,计划推出量化版。
Qwen3.8-27B 在 Apple Silicon 上借助 mlx-dspark 速度提升至约3倍
mlx-dspark v0.10.0 新增了对 Apple Silicon 上 Qwen3.8-27B 的支持,通过无损验证的推测解码提供高达3倍的速度提升。
@no_stp_on_snek: https://x.com/no_stp_on_snek/status/2052833502475833384
使用 Qwen2.5-32B-Instruct 搭配 longctx 和 vllm-turboquant 的单个 AMD MI300X 开源技术栈,在 MRCR v2 百万级上下文基准测试中取得了与 SubQ 闭源模型(0.659)相竞争的结果(0.601-0.688),表明开源权重方法已接近达到同等水平。
我构建了mlx-Chronos——一个面向Apple Silicon上本地LLM引擎的社区基准测试排行榜(oMLX、Rapid-MLX、mlx-lm、Ollama)
一位计算机科学学生构建了mlx-Chronos,这是一个开源命令行工具,通过测量TTFT、吞吐量、内存使用和热状态,标准化Apple Silicon上MLX推理引擎的基准测试,并提供一个社区排行榜来分享结果。