@antirez:在 DwarfStar 中首次实现了 GLM 5.2 的基本工作版本。还需要一些时间才能变得足够好,但这只是一个有前景的开始……
摘要
Antirez 报告了在 DwarfStar 中首次实现 GLM 5.2 的工作版本,使用了 433 GB 的 GGUF 文件,运行于配备 512GB 内存的 M3 Ultra 上,不过还需要进一步优化。
查看缓存全文
缓存时间: 2026/06/22 11:34
在 DwarfStar 中初步实现了 GLM 5.2 的工作版本。要达到足够好的效果还需要一些时间,但这是一个有希望的开端。GGUF 文件大小为 433 GB。M3 Ultra 512GB。https://t.co/WSKjhJ19xH
相似文章
@antirez: 基于我在DwarfStar中实现GLM 5.2的说法,有90%的概率我会合并该分支…
Antirez宣布合并实现GLM 5.2的分支可能性很高,这可能成为运行在512GB Mac Studio上的最佳模型,并可能通过2位量化在分布式128GB MacBook上运行。
GLM 5.2 在首次迭代中生成了这个可玩3D游戏的大部分内容
通过 Jarvis Code 编程代理使用的 GLM 5.2,在首次迭代中生成了一个可玩 3D 版《几何战争》风格游戏的大部分内容,仅需少量后续调整。
@UnslothAI: GLM-5.2 现在可以本地运行!2-bit 模型在从 1.51TB 缩小到 238GB(-84% 大小)后保留了约 82% 的准确率…
UnslothAI 宣布 GLM-5.2,Z.ai 的最强开源模型,拥有 744B 参数,现在可以通过动态 GGUF 量化在本地运行,将大小减少约 84% 至 239GB,同时保留约 82% 的准确率。它适用于 256GB Mac 以及 RAM/VRAM 配置,并支持长上下文、推理和代理任务。
Show HN: 在慢速电脑上运行GLM 5.2
Colibrì是一个纯C推理引擎,通过从磁盘流式加载专家,在约25GB RAM的消费级硬件上运行744B参数的GLM-5.2 MoE模型,配合推测解码可实现约2.2-2.8 token/秒的速度。
@ErickSky: 忘掉vLLM、llama.cpp和昂贵的GPU吧。[colibri] 这个工具用纯C语言在约25GB RAM上运行GLM-5.2 (744B MoE)…
colibri 是一个纯C语言推理工具,通过从磁盘流式传输专家模型,在约25GB RAM上运行GLM-5.2 744B MoE模型,无需昂贵的GPU。