@akazwz_: 准备用起来了,qwen3.8 27b,现在 ollama 直接支持 mac 的 mlx 很舒服。

X AI KOLs Following 新闻

摘要

用户表示准备使用 Qwen 3.8 27b 模型,现在 Ollama 直接支持 Mac 的 MLX,使用起来很舒适。

准备用起来了,qwen3.8 27b,现在 ollama 直接支持 mac 的 mlx 很舒服。 https://t.co/yQrYTGS19R
查看原文
查看缓存全文

缓存时间: 2026/08/17 00:13

准备用起来了,qwen3.8 27b,现在 ollama 直接支持 mac 的 mlx 很舒服。 https://t.co/yQrYTGS19R

相似文章

@cevenif: 用苹果电脑跑本地大模型的朋友,有个工具值得盯上——Rapid-MLX。它在 M 系列芯片上的推理速度比 Ollama 快 2 到 4 倍,因为它是直接基于苹果的 MLX 框架开发的,对芯片架构的压榨更彻底。 几个关键点: KV 缓存裁剪加…

X AI KOLs Timeline

Rapid-MLX 是一个针对苹果 M 系列芯片优化的本地大模型推理工具,基于 MLX 框架开发,推理速度比 Ollama 快 2 到 4 倍,支持多种模型、工具调用及 OpenAI API 兼容接口。