M5 ultra AI 测试结果

Reddit r/LocalLLaMA 产品

摘要

M5 ultra AI 测试结果显示,提示处理速度比 M3 ultra 快 4 到 4.5 倍,令牌生成速度快 1.5 倍,但功耗翻倍,风扇噪音增大,温度更高。

所以我们有了结果:- 提示处理速度根据上下文长度比 M3 ultra 快 4 到 4.5 倍 - tok/s 大约快 1.5 倍。但:机器功耗翻倍(400W 对比 200W),风扇噪音更大,运行温度更高。 https://www.youtube.com/watch?v=c_58D7ixOQI&t
查看原文

相似文章

首个 M5 Ultra 基准测试

Reddit r/LocalLLaMA

M5 Ultra 芯片的非官方基准测试显示,使用 Qwen 3.8 27B q4 模型时推理速度令人期待,在 8k 上下文中,线程处理速度达到每秒 50 个 token,预填充速度达到每秒 1800 个 token。

M5 Ultra Mac Studio 评测:本地 AI 智能体的梦幻 Mac

Hacker News Top

M5 Ultra Mac Studio 被评为用于运行本地 AI 智能体的顶级机器,提供令人印象深刻的性能并实现无需云的 AI 工作流程。它与 M3 Ultra 和 RTX 5090 进行比较,评测者赞扬其速度、热效率以及与 Qwen3.8-Flash-Next 等 AI 模型的集成。