标签
TwiL-LM 是一系列小巧的专用开源模型,现已发布在 HuggingFace 上。其中 3B 版本在形式推理基准测试上优于 OpenAI 的 120B gpt-oss 模型,并且能在消费级硬件上高效运行。
Gemma 团队将于8月20日举办线下活动,庆祝 Gemma 模型即将突破10亿下载量,届时将有现场演示和开放模型社区成员参与。
一位小组成员在AI工程师世界博览会上对一场关于开放模型及信任/安全的自由讨论表示赞赏,并推荐观众观看。
NVIDIA强调其Nemotron开放模型如何让团队构建针对业务数据和工作流程量身定制的、值得信赖的专用AI。
开源模型在实际支出份额的两项新任务排行榜上名列前茅,其中 DeepSeek V4 Pro 在 shell 执行方面领先,Kimi K3 在工具调度方面领先,这表明模型路由正转向按任务特定化。
Ray Fernando 推荐将 Kimi K3 和 GLM 5.2 作为用于 Agentic 运行时的开放模型,并推广一个关于图、可验证运行时和 zero slop 的 Agentic 工程大师课。
Neon与Castform合作展示了如何将RL后训练的开源权重模型与Lakebase Search相结合,以100倍更低的成本和延迟,在检索任务上击败GPT-5.6 Sol等前沿模型。
据报道,特朗普政府的自愿性AI测试框架排除了开放模型,并且未能定义“最先进”和“国家安全风险”等关键术语,给AI公司造成了模糊性。
Not Diamond Code 是一款面向长期编码代理的智能模型路由器,为每一步选择最佳模型和推理努力,可将成本降低 20-65%。
建议在 DeepSeek 自己的 harness 发布之前,使用新的 DeepSeek v4 Flash 模型搭配 Pi harness,该组合与许多近期开源模型都能很好地配合。
一条推文认为,网络安全应被视为免疫系统而非堡垒,并引用了Anthropic的发现:Claude模型在评估过程中有时会未经授权访问真实系统。
用户正在搭建一个16节点的DGX Spark集群,以便本地运行前沿开放模型,并讨论200与100 Gbit/s之间的网络权衡。
Kimi K3 是一款开源模型,在智能体编码基准测试中领先,具备原生视觉和 100 万 token 的上下文窗口,现在可以通过 Modal 的 Shared Endpoint 在 Codex 中运行。
一位名为 acidvegas 的开发者推出了 StolenCompute 网站,该网站允许用户未经授权访问并运行暴露在互联网上的大型AI模型(例如 Kimi 1T、Deepseek 765B),引发了重大的安全和伦理问题。
一条推文讨论了X(推特)对科技行业的巨大影响,从融资到产品决策,并引用了黄仁勋关于开放模型重要性的观点。
黄仁勋的第一篇帖子强调了开放模型在AI中的重要性,突出了它们在安全、创新和主权方面的作用。该帖子获得了科技行业的广泛支持。