@_ARahim_: DeepSeek 的 DSpark 推测解码草稿模型,在 Mac(原生 Apple Silicon,MLX)上基准测试,无损;结果与基础模型完全一致……

X AI KOLs Timeline 工具

摘要

mlx-dspark 将 DeepSeek 的 DSpark 和 z-lab 的 DFlash 推测解码草稿模型通过 MLX 引入 Apple Silicon,实现无损加速(约 1.4–1.6 倍,代码/数学任务可达 2 倍),并提供兼容 OpenAI 的 API 用于本地推理。

DeepSeek 的 DSpark 推测解码草稿模型,在 Mac 上进行基准测试 原生 Apple Silicon(MLX),无损;输出与基础模型完全相同,速度提升约 1.4–1.6 倍,代码/数学任务可达约 2 倍 最新版本将其转变为本地兼容 OpenAI 的服务器(支持连续批处理、前缀缓存) https://github.com/ARahim3/mlx-dspark… @googlegemma @deepseek_ai
查看原文
查看缓存全文

缓存时间: 2026/07/07 15:33

DeepSeek的DSpark与z-lab的DFlash推测解码——通过MLX原生支持Apple Silicon。为Qwen3和Gemma-4系列(以及任何匹配的DSpark/DFlash检查点)提供无损草稿模型(输出相同,仅加速)。可在命令行、Python中运行,或提供OpenAI兼容的API供LM Studio/任何本地工具使用。

相似文章