glm

标签

Cards List
#glm

@mervenoyann: GLM-5.2 与 Opus 4.8 相当,具有 1M 上下文 > 新的 IS 注意力每 4 个稀疏层重用一次索引器(2.9× 每…)

X AI KOLs Following · 2026-06-16 缓存

GLM-5.2 是一款可与 Opus 4.8 相媲美的新模型,具有 1M 上下文、新的 IS 注意力机制、改进的推测解码和灵活的思考努力级别。它已在 MIT 许可证下发布,并在 transformers、vLLM 和 SGLang 中提供 Day-0 支持。

0 人收藏 0 人点赞
#glm

@Modular:@zai_org 今日开源了 GLM 5.2,Modular 成为首发合作伙伴。GLM 5.2 是他们在编程领域的新旗舰模型……

X AI KOLs Following · 2026-06-16 缓存

智谱AI(zai_org)已开源 GLM 5.2,这是一款面向编程和长期自主任务的旗舰模型,支持可用的 1M token 上下文。Modular 作为首发合作伙伴,在 Modular Cloud 上提供优化服务。

0 人收藏 0 人点赞
#glm

@natolambert: 新播客与@finbarrtimbers!我们盘点最新的后训练配方,从GLM 5.1、Kimi K2.6、DeepSeek V4、Xia…

X AI KOLs Timeline · 2026-06-16 缓存

Nathan Lambert和Finbarr Timbers讨论了大型语言模型的最新后训练配方,包括DeepSeek V4、GLM 5.1、Kimi K2.6,以及行业向多教师在线策略蒸馏的转变。

0 人收藏 0 人点赞
#glm

2026年第二季度,在3x3090(72GB显存)配置上最好的模型?

Reddit r/LocalLLaMA · 2026-06-13

用户分享了在2026年第二季度使用3x3090(72GB显存)配置运行大型LLM的经验,推荐了GPT-OSS 120b、Qwen3.5 122b和GLM Air 4.5 106B等模型,并询问是否有更新的替代方案。

0 人收藏 0 人点赞
#glm

Stepfun 3.7 Flash 表现非常出色

Reddit r/LocalLLaMA · 2026-05-31

Stepfun 3.7 Flash 是一款紧凑型视觉模型,在美学方面接近 GLM 5.1,在 3D 世界理解方面达到其 80% 的水平,同时仅使用 25% 的参数,因此内存效率极高。

0 人收藏 0 人点赞
#glm

@doublenickk: > 20个免费日额度可覆盖GPT 5.5或GLM的一次完整工作会话 > Opus 4.7可处理2-3个严肃架构任务…

X AI KOLs Timeline · 2026-05-23 缓存

一条推文强调,Tembo提供的20个免费日额度可完全访问GPT 5.5和GLM,而Opus 4.7可以零成本处理架构任务,其输出与付费工具相当。

0 人收藏 0 人点赞
#glm

根据Arena排行榜,开放权重模型GLM和Mimo优于Gemini 3.5 Flash

Reddit r/LocalLLaMA · 2026-05-19

根据Arena排行榜,开放权重模型GLM和Mimo在编程基准测试中优于Gemini 3.5 Flash。

0 人收藏 0 人点赞
#glm

Open source battle: GLM vs Kimi vs MiMo vs DeepSeek

Reddit r/LocalLLaMA · 2026-05-13 缓存

本文测试了智谱GLM 5.1、月之暗面Kimi K2.6、阶跃星辰MIMO 2.5 Pro和深度求索DeepSeek V4 Pro四个开源中国AI模型在编程任务中的表现,发现GLM在多数任务中整体领先但非绝对,各模型各有优劣。

0 人收藏 0 人点赞
#glm

@yidabuilds: https://x.com/yidabuilds/status/2053409619641602286

X AI KOLs Timeline · 2026-05-10 缓存

作者对DeepSeek V4、Kimi K2.6、GLM-5.1和MiniMax M2.7四款国产AI模型进行了横向对比测试,分析了它们在成本、长上下文处理能力、编程稳定性及推理性能上的优劣,并给出了针对大文档分析、长程后台任务和批量内容生产的具体分流建议。

0 人收藏 0 人点赞
#glm

@outsource_: 全新 GLM+ Qwen 18B 可在消费级 GPU 上运行,仅用一半显存就打败 35B MoE

X AI KOLs Timeline · 2026-04-20 缓存

全新的 18B 融合量化模型 Qwopus-GLM-18B-GGUF,仅用一半显存即可在消费级 GPU 上运行,性能超越 35B MoE 模型。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈