mlx

标签

Cards List
#mlx

@Nativ_AI:在本地运行 Qwen 3.5 9B,使用完全可定制的系统提示词。让它唱歌,让它押韵,让它头脑风暴、写作,……

X AI KOLs Timeline · 2天前 缓存

Nativ 是一款开源的 macOS 应用,可在 Apple Silicon 上本地运行 Qwen 3.5 9B 及其他开源模型,提供可定制的系统提示词、遥测功能以及与编程代理的集成,无需云服务或订阅。

0 人收藏 0 人点赞
#mlx

Nvidia 的 Nemotron Omni 在 Mac 上只能加载文本部分,所以我用 MLX 编写了视觉和音频塔

Reddit r/LocalLLaMA · 3天前

作者为 Nvidia 的 Nemotron Omni 模型的视觉和音频塔编写了一个纯 MLX 运行时,使完整的多模态模型能够在 Apple Silicon Mac 上本地运行。所有 23 项测试均通过 PyTorch 参考验证,在 M5 Max 上实现了 67-152 tok/s 的速度。

0 人收藏 0 人点赞
#mlx

@ddalcu: 过去4天本地AI真是疯狂……太不可思议了…… https://github.com/ddalcu/mlx-serve/releases/tag/v26.8.2… @liquidai ……

X AI KOLs Timeline · 5天前 缓存

一位开发者更新了 MLX-Serve(一个面向 Apple Silicon 的快速本地推理服务器),以支持近期模型,如 LiquidAI 2.6B、MiniMax H3 视频生成和 DeepSeek V4 Flash,AntLing 3.0-flash 即将推出。

0 人收藏 0 人点赞
#mlx

PipeNetwork/minimax-h3-mlx

Simon Willison's Blog · 5天前 缓存

Simon Willison 重点介绍了 PipeNetwork/minimax-h3-mlx,这是一个将 MiniMax-H3 移植到 Apple Silicon 上的 MLX 的 Python 包,并演示了在 M5 Max MacBook Pro 上运行它,从文本提示生成视频。

0 人收藏 0 人点赞
#mlx

@no_stp_on_snek: https://huggingface.co/thetom-ai/DeepSeek-V4-Flash-ConfigI-MLX… Fyi. Fits on 128GB of ram for metal. GGUF is coming jus…

X AI KOLs Following · 2026-08-01 缓存

TheTom releases an MLX quantized version of DeepSeek V4 Flash (284B MoE, 21B active) at 3.05 bpw, fitting in 101 GiB to run on 128GB Apple Silicon, with GGUF sibling also available.

0 人收藏 0 人点赞
#mlx

Show HN: Qwen Scribe – 适用于 Apple Silicon 的本地转录与听写工具

Hacker News Top · 2026-07-29 缓存

Qwen Scribe 是一款开源工具,专为 Apple Silicon Mac 提供隐私、设备本地的转录和听写功能,通过 MLX 使用 Qwen3-ASR 模型。它支持拖放式音视频转码、语言检测、SRT 导出以及带有 HUD 的系统级听写。

0 人收藏 0 人点赞
#mlx

@eisokant: 激动地宣布今天与@eigenlabs共同推出http://MLX.fast。这是一个开放的自动研究竞赛,旨在使Laguna XS 2.1在…

X AI KOLs Following · 2026-07-28 缓存

Eigen Labs 发起了一项名为 MLX.fast 的开放自动研究竞赛,旨在优化 Laguna XS 2.1 模型在消费级 Mac 上的推理速度,通过社区贡献使其尽可能快。

0 人收藏 0 人点赞
#mlx

@Raullen:Rapid-MLX 0.11.0 发布!让 Apple Silicon 上的本地模型可靠到足以运行你的代理工作流程,而不仅仅是演示…

X AI KOLs Following · 2026-07-24 缓存

Rapid-MLX 0.11.0 带来了显著的性能提升,包括前缀缓存和响应缓存,支持新的模型家族,如 HY3 295B MoE 和 Qwen3-Coder-Next 80B,引入了结构化输出,确保有效的工具调用,并添加了与 MCP 服务器的无缝集成,用于自主代理工作流程。

0 人收藏 0 人点赞
#mlx

Apple M5 尚未充分利用其矩阵乘法核心

Reddit r/LocalLLaMA · 2026-07-23

Apple M5 芯片支持矩阵乘法中的 INT8 激活,但 MLX 和 Llama.cpp 等推理后端目前仍使用 16 位;自定义 w8a8 内核在 Gemma4 预填充任务上实现了高达 1.4 倍的加速。

0 人收藏 0 人点赞
#mlx

@jundotkim: oMLX 0.5.2 已发布。(很抱歉沉默了这么久!)https://github.com/jundot/omlx/releases… oMLX 是最方便的...

X AI KOLs Timeline · 2026-07-21 缓存

oMLX 0.5.2 版本新增了实时菜单栏活动、重新组织的模型菜单、Bonsai 低位内核,以及通过自定义 Metal 内核和原生推测解码实现的性能提升,使其成为在 Mac 上运行 MLX 模型的最快方式。

0 人收藏 0 人点赞
#mlx

Nativ:在您的Mac上本地运行AI模型

Simon Willison's Blog · 2026-07-21 缓存

Nativ是一款新的macOS桌面应用,它封装了MLX以在本地运行AI模型,提供聊天界面和API服务器。

0 人收藏 0 人点赞
#mlx

在政治动荡前值得获取的模型

Reddit r/LocalLLaMA · 2026-07-21

一份精选的推荐AI模型列表(例如Qwen3.5、Gemma 4、Mistral Medium),适用于统一内存最高256GB的系统,涵盖创意、编程、智能体及通用聊天等使用场景。

0 人收藏 0 人点赞
#mlx

Nativ: 在您的 Mac 上本地运行前沿开源模型

Hacker News Top · 2026-07-20 缓存

Nativ 是一款免费开源的 macOS 应用,可让您在 Apple Silicon 上本地运行前沿开源 AI 模型,无需账户或订阅。

0 人收藏 0 人点赞
#mlx

@Prince_Canuma: 很高兴介绍Nativ。在Mac上本地运行前沿开源模型。无需账户,无需订阅,无需云端。构建于…

X AI KOLs Timeline · 2026-07-20 缓存

Nativ是一款免费开源的macOS应用,让用户在Apple Silicon上本地运行前沿开源模型,无需账户、订阅或云端依赖。

0 人收藏 0 人点赞
#mlx

@no_stp_on_snek: 还有人谈论 mlx-swift-lm 吗?说我在休息一天……清理了鸡舍,锻炼了一下,然后…

X AI KOLs Following · 2026-07-16 缓存

作者描述了将 TurboQuant KV-cache 压缩集成到 Apple 的 mlx-swift-lm 中,实现了 2.7 倍压缩,质量与 8-bit 相当,并通过融合 Metal 内核将解码速度提升了 3-4 倍。

0 人收藏 0 人点赞
#mlx

在Mac Studio 96GB上运行Qwen3.5-122B:修复了3个使长上下文推理变得可用的bug

Reddit r/LocalLLaMA · 2026-07-13

修复了qMLX分支中运行Qwen3.5-122B的三个bug,将长上下文推理的预填充时间从几分钟降低到亚秒级;开源了该分支和基准测试脚本。

0 人收藏 0 人点赞
#mlx

@jun_song: MLX 的新引擎正处于开发的最后阶段。刚刚在一台 MacBook(116GB)上运行 GLM-5.2,达到 41.8…

X AI KOLs Following · 2026-07-09 缓存

Jun Song 宣布 MLX 新引擎进入最终开发阶段,在 MacBook 上以 256k 上下文窗口达到 41.8 tok/s,仅有约 4% 质量损失,代表着显著的性能提升。

0 人收藏 0 人点赞
#mlx

@_ARahim_: DeepSeek 的 DSpark 推测解码草稿模型,在 Mac(原生 Apple Silicon,MLX)上基准测试,无损;结果与基础模型完全一致……

X AI KOLs Timeline · 2026-07-07 缓存

mlx-dspark 将 DeepSeek 的 DSpark 和 z-lab 的 DFlash 推测解码草稿模型通过 MLX 引入 Apple Silicon,实现无损加速(约 1.4–1.6 倍,代码/数学任务可达 2 倍),并提供兼容 OpenAI 的 API 用于本地推理。

0 人收藏 0 人点赞
#mlx

@Youssofal_: 在搭载M5 Max的Macbook Pro上,Qwen 3.6 27B模型达到72+ TPS。MTPLX V2现已发布!在MLX上运行模型的最快方式。

X AI KOLs Following · 2026-07-07 缓存

MTPLX V2已发布,声称在搭载M5 Max的Macbook Pro上通过MLX运行Qwen 3.6 27B模型时每秒可处理72+ tokens。

0 人收藏 0 人点赞
#mlx

@Prince_Canuma: mlx-vlm v0.6.4 来了!今天开始使用:> uv pip install -U mlx-vlm 5个新模型系列 — MiniMax M3、Kimi K2.5、Un…

X AI KOLs Timeline · 2026-07-06 缓存

mlx-vlm v0.6.4 已发布,支持5个新模型系列、TTS/STT端点,以及包括 TurboQuant 和连续批处理在内的重大性能改进。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈