M5 ultra AI 测试结果
摘要
M5 ultra AI 测试结果显示,提示处理速度比 M3 ultra 快 4 到 4.5 倍,令牌生成速度快 1.5 倍,但功耗翻倍,风扇噪音增大,温度更高。
所以我们有了结果:- 提示处理速度根据上下文长度比 M3 ultra 快 4 到 4.5 倍 - tok/s 大约快 1.5 倍。但:机器功耗翻倍(400W 对比 200W),风扇噪音更大,运行温度更高。 https://www.youtube.com/watch?v=c_58D7ixOQI&t
相似文章
首个 M5 Ultra 基准测试
M5 Ultra 芯片的非官方基准测试显示,使用 Qwen 3.8 27B q4 模型时推理速度令人期待,在 8k 上下文中,线程处理速度达到每秒 50 个 token,预填充速度达到每秒 1800 个 token。
M5 Ultra 和 M6 芯片基准测试结果揭示图形性能
Apple的M5 Ultra和M6芯片的基准测试结果显示GPU性能显著提升,其中M5 Ultra在Geekbench上的Metal得分比M3 Ultra高出多达59%,而M6芯片得分比M5高出34%。
M5 Ultra Mac Studio 在我们的基准测试中表现出色
M5 Ultra Mac Studio 展现了出色的基准测试性能,针对 AI 开发者和高要求工作负载,配备强大规格和高端定价。
M5 Ultra Mac Studio 评测:本地 AI 智能体的梦幻 Mac
M5 Ultra Mac Studio 被评为用于运行本地 AI 智能体的顶级机器,提供令人印象深刻的性能并实现无需云的 AI 工作流程。它与 M3 Ultra 和 RTX 5090 进行比较,评测者赞扬其速度、热效率以及与 Qwen3.8-Flash-Next 等 AI 模型的集成。
@ashxhart: 一直在给我的 M3 Ultra Studio 精心调校,并摆弄 MLX。下午开始时速度为 42 tok/s。现在:73 tok/s,而且…
一位作者改进了 M3 Ultra Studio 上的 MLX 性能,使 4 位量化的 Qwen3.8-Flash-Next 模型达到 73 tok/s,其智能评分与 GPT-5.6 Sol 相当,凸显了本地 AI 日益增长的潜力。