omlx

标签

Cards List
#omlx

@ashxhart: @apple HomePod Mini 已被改造成一个有趣的周末项目。Apple 很好心地送了我这台 HomePod Mini 一台……

X AI KOLs Timeline · 2026-09-01 缓存

一位用户改造了一台 HomePod Mini,通过 Spark 集群和 oMLX 将其连接到本地 AI 模型 GLM 5.3 Flash,以实现流畅的 AI 对话,并提到大型 AI 公司不会支持这个项目。

0 人收藏 0 人点赞
#omlx

Qwen3.8-27B 思考模式 xhigh 与关闭思考模式 - Apple M5 Max

Reddit r/LocalLLaMA · 2026-08-29

在MacBook Pro M5 Max上的基准测试显示,禁用Qwen3.8-27B的思考模式会严重降低输出质量,而xhigh思考模式则使用5.5倍更多的令牌并运行6倍更长时间。

0 人收藏 0 人点赞
#omlx

我让Codex优化了oMLX上的DeepSeek V4 Flash 8-bit MLX,实现了约1.6倍的预填充速度和3倍的解码加速。

Reddit r/LocalLLaMA · 2026-07-05

作者使用Codex优化了oMLX上的DeepSeek V4 Flash 8-bit MLX,实现了约1.6倍的预填充速度和3倍的解码加速。

0 人收藏 0 人点赞
#omlx

@zhixianio: 这两天新机器到了之后,我开始了「苦行僧」式的强迫自己使用本地模型来完成常见任务的修行 本以为会非常痛苦,没想到无论是速度还是质量都大大超出我的预期: 模型: Qwen3.6-35B-A3B-oQ6-fp16-mtp 运行:oMLX,开 N…

X AI KOLs Timeline · 2026-06-03 缓存

作者在本地新机器上使用Qwen3.6-35B-A3B模型和oMLX工具进行日常任务,发现速度和效果远超预期,甚至在PA和Coding场景下优于远程LLM,体现了端侧AI能力的显著提升。

0 人收藏 0 人点赞
#omlx

MLX引擎对比…oMLX是最佳选择。

Reddit r/LocalLLaMA · 2026-05-18

一篇博客文章,对比了MLX推理引擎,结论是oMLX是最佳选择,评测在M5 Max 64GB上使用Qwen3.6-35B-A3B-4bit。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈