标签
GPT-6 Sol 和 Luna 模型现已可在 Devin 中使用,其中 GPT-6 Sol 在成本降低61%的情况下达到与 GPT-5.6 Sol 相同的性能,而 GPT-6 Luna 以大约四分之一的成本表现更优。
Grok 4.7在法律工作和终端任务方面显示出显著改进,在Harvey Legal Agent Benchmark和Terminal-Bench 4.0等基准测试中超越竞争对手,同时保持代币价格不变。
一篇推文讨论了在配备24 GB RAM的MacBook上本地运行无审查版Ternary-Bonsai-27B AI模型,突出其在编码任务中的性能。
@Jackywine的帖子揭示了一种新的训练方法RLCD,并宣布发布前沿AI模型Jev Speed,该模型速度快20–200倍,成本低40–400倍,并且直接免费。
ChatGPT的共同发明者宣布发布名为Jev的新AI模型,采用RLCD训练,声称其速度快20-200倍,成本低40-400倍(输出代币免费),并针对可组合智能进行了优化,作为通往AGI的路径。
该推文推测了GPT-6 Sol和Luna的潜在发布,这可能会显著提升性能价格比并降低高级人工智能的成本。
来自比哈尔邦的20岁独立开发者Abhinav Anand发布了Arcle V1,这是一个开源权重的5.84B参数统一全能AI模型,在包括MATH-500在内的多个基准测试中优于Apple的AFM 3B模型。
Mercury 2.5 被宣布为最强大的扩散语言模型,智能方面比 Mercury 2 提升 40%,在 NVIDIA GPU 上运行速度超过每秒 1,100 个令牌,并针对生产进行了优化,具有低延迟和低成本。
Anthropic 发布了 Claude Fable 5.1,这款AI模型正被用户迅速用于生成游戏、构建3D世界和创建各类模拟。
Z.AI 发布 GLM-5.3 Fast,这是一款先进的开放权重AI模型,针对代理编码和网络安全进行优化,采用744B-A40B MoE架构,基准测试有显著改进。
Google 推出 Gemini 3.8,这是他们迄今为止最好的推理和编码模型,具有两个利用长时间运行的智能体循环的新变体。
Anthropic推出了Fable 5.1,作为Claude模型的升级版,在编码、写作和知识工作方面表现出色,速度更快、token效率更高,并提升了商业适用性。
OrcaRouter 已发布针对 GLM-5.3-Flash AI 模型的无审查权重,具有原生 FP8 精度和集成拒绝移除功能,无需额外修改。
作者发布了兼容主线的Qwen3.8-Flash-Next模型的imatrix量化版本,提供比竞品小20-30GB的体积,同时保持竞争力的PPL,并为AMD硬件提供了单独的ROCm构建。
GLM 5.3 Flash 是一款 AI 模型,现已通过 Modal Auto Endpoints 在 Modal 平台上可用,方便用户访问和部署。
阿里巴巴的Qwen团队发布了Qwen3.8-Flash-Next,这是Qwen4架构的开源预览版,仅从125B参数中激活6B参数,以降低推理成本并解决硬件限制。
Liquid AI 发布了针对其 LFM 系列的 DSpark 草稿模型,结合推测解码,在设备上实现高达4倍的解码加速,同时保持输出质量。
该推文推测明早可能看到GPT 6或更智能的模型,并提及重置,表达了对模型发布的期待。
Koray Kavukcuoglu 宣布推出 Gemini 3.7 Flash,这是一款新的编码与智能体工作流模型,售价为 3.6 Flash 原价的一半。团队强调 CodeArena 得分 1588,并致力于改善编码体验。
谷歌推出Gemini 3.7 Flash,这是其主力模型的最新更新,在编程、知识工作和网页开发方面均有显著提升,初始定价仅为3.6 Flash原价的一半。