ai-local-inference

标签

Cards List
#ai-local-inference

@ashxhart: 一直在给我的 M3 Ultra Studio 精心调校,并摆弄 MLX。下午开始时速度为 42 tok/s。现在:73 tok/s,而且…

X AI KOLs Timeline · 2026-09-08 缓存

一位作者改进了 M3 Ultra Studio 上的 MLX 性能,使 4 位量化的 Qwen3.8-Flash-Next 模型达到 73 tok/s,其智能评分与 GPT-5.6 Sol 相当,凸显了本地 AI 日益增长的潜力。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈