标签
DwarfStar是一款专门为在消费级硬件上高效运行大型语言模型(如DeepSeek和GLM)而设计的推理引擎,支持多平台及SSD流式处理等高级功能。
NVIDIA 通过其平台提供免费访问四个 AI 模型,包括 DeepSeek V4.1 Flash、GLM 5.3、GLM 5.3 Flash 和 Kimi K3,无需信用卡。
介绍DeepThink,一个基于GLM构建的新模型,旨在增强开源AI模型的推理能力,以与Astra和Fable等专有替代方案竞争。
GLM 5.3 FlashX 因性能改善获得称赞,但也因成本更高受到批评,而 DeepSeek v4.1 Flash 被指出性能更优。
ZCode,一个基于GLM的编码代理,悄无声息地上传用户的Git历史记录,引发对AI开发工具中隐私和安全的担忧。
推文突显了GLM、DeepSeek和Qwen等LLMs的性能,指出过去一年AI能力的飞速进展。
这条推文讨论了开源与闭源AI模型之间差距的缩小,bolt.new报告显示像GLM 5.3 Flash和DeepSeek V4 Pro这样的模型在开发者中广受欢迎。
本文推荐了一期YouTube节目,嘉宾是来自Baseten的Charlie O'Neill,讨论Kimi和GLM模型如何优于Opus 5,并针对AI进展和AGI的质疑进行回应。
Bolt Forge 将 GLM、DeepSeek 和 Kimi AI 模型集成到 Bolt.new 中,提供高达 50 倍的使用量,以提升应用开发和实验。
GLM 5.3 Flash 是一款即将推出的 AI 模型,在 2x DGX Spark 系统上展示高 tok/s 性能,即将发布。
这篇文章重点介绍了 GLM-5.3-Flash EXL3-3.0bpw AI 模型,其推理速度达到每秒193.8个令牌,归功于多位贡献者。
本文讨论了中国大语言模型达到Anthropic的Opus 4.8水平的重要性,利用Ramp支出数据突显市场动态,并预测像AMD和Nvidia这样的硅片销售商将成为AI行业的关键长期赢家。
来自 @BAI_AGI 的一条推文,要求用户在 B.AI 平台上为他们最喜欢的免费 AI 模型投票,列出了几个模型,包括 GLM-5.3-Flash 和 DeepSeek-V4-Flash。
Zai_org 的最新旗舰 AI 模型 GLM 5.3 已发布,现已在 Modal 平台上线。
Z.ai 推出 GLM-5.3-Flash,这是一个具有 1M 代币上下文窗口的多模态 AI 模型,参数规模为 320B-A18B,并以 MIT 许可证发布。
GLM-5.3 是一个即将在 Hugging Face 上发布的 AI 模型,具备前沿编码和新兴网络能力,定于2026年8月28日发布。
Agent Arena Code 的初步结果显示 GLM 和 Qwen 模型表现良好,这表明开放权重的AI模型取得了进步。