650多个Apache-2.0许可的生物医学NER/去标识化模型,在MLX中设备端运行。相同fp32权重,输出一致:临床NER模型在3年前的M3 Max上比PyTorch-CPU快30-40倍。内部可复现。

Reddit r/LocalLLaMA 模型

摘要

650多个Apache-2.0许可的生物医学NER和去标识化模型集合,通过MLX在设备端运行,在M3 Max上实现比PyTorch-CPU快30-40倍的推理速度,且输出一致。

暂无内容
查看原文

相似文章

LiquidAI/LFM2.5-2.6B

Hugging Face Models Trending

Liquid AI released LFM2.5-2.6B, a 2.6B-parameter hybrid model optimized for on-device deployment with 128K context, agentic post-training, and fast inference (220 tok/s on Apple M5 Max) under 2.5GB memory.

@Phoenixyin13: 这是全新的最佳美国开源模型。 Thinking Machines Lab 直接放出一个 975B 参数MoE 多模态巨兽,Apache-2.0 完全开源!在常规基准上,它甚至干掉了 NVIDIA 的 Nemotron 强项模型。 它的核心…

X AI KOLs Timeline

Thinking Machines Lab 发布了全新的 975B 参数 MoE 多模态开源模型,Apache-2.0 许可,在常规基准上超越 NVIDIA Nemotron,支持文本、图像、音频全模态,激活参数仅 41B,高效且友好部署。