标签
OpenRouter 发布了一款名为 Ox Alpha 的新型隐身 AI 模型,该模型针对高效编码和代理任务进行了优化,具备 1M 令牌上下文窗口,并支持文本、图像和视频输入。
阿里巴巴 Qwen 和阿里云的 Qwen3.8-2.4T-A95B 现已登陆 Modal,配备基于工具调用密集型数据训练的自定义 DFlash 推测器和完整的 1M 上下文窗口。
Qwen3.7 开源权重即将发布的证据,其 flash 变体(很可能是小型 MoE)已出现在 OpenRouter 上,具有 100 万上下文窗口,且价格比 Qwen3.6 flash 更低。
Poolside 发布 Laguna S 2.1,这是一个 118B MoE 模型,每个 token 激活 8B 参数,针对智能体编码进行了优化。据称,其性能优于 DeepSeek V4 Pro,同时价格低于 DeepSeek V4 Flash,拥有 1M 上下文窗口和开源许可证。
Kimi K3 是一款全新AI模型,拥有2.8万亿参数和100万上下文长度,已在网页和App上发布,在编程、智能体任务、推理、视觉和智能体集群方面具备领先能力。
Thinking Machines AI发布了Inkling,这是一个开放权重的混合专家模型,总参数975B(41B活跃),支持文本、图像和音频,上下文窗口为100万token。它是一个广泛的基础模型,旨在通过其Tinker平台进行微调,同时还预览了较小的Inkling-Small变体。
MiniMax 开源了其原生多模态大模型 M3,参数约 428B(激活约 23B),支持 1M 上下文,并引入了 MiniMax Sparse Attention (MSA) 技术以提升长上下文效率。
LongCat-2.0 模型发布,具有万亿参数和1M超长上下文,支持原生工具调用与多步推理,代码能力突出,同时推出Token资源包和按量计费的API计费服务。
Empero发布了Qwythos-9B-Claude-Mythos-5,这是一个基于Fable-5和Mythos-5会话日志的合成思维链数据,使用1M上下文微调的全参数推理模型。
Z.AI推出GLM-5.2,这是一款专为长程任务设计的旗舰模型,拥有稳定的100万token上下文、改进的编码能力以及MIT开源许可证,在与Opus 4.8和GPT-5.5等领先模型的对比中展现了竞争力。
GLM-5.2 已以 MIT 许可证发布开放权重,拥有 100 万上下文窗口和两种推理努力模式。早期基准测试显示它在编程任务中表现出色,值得在基准截图之外进行测试。
GLM 5.2 作为一款753B参数的开源模型发布,拥有1M上下文长度,MIT许可证,在AIME 2026上达到99.2分,超越了GPT-5.5、Gemini 3.1 Pro和Claude Opus 4.8。
GLM-5.2 是新一代旗舰级编程模型,支持 100 万上下文并增强推理能力,现已面向 GLM 编程计划用户开放,将于下周以 MIT 许可证开源。
Modular 的内核团队正在优化对 MiniMax M3 的百万token上下文和原生多模态的服务,开放权重即将发布,可立即在 Modular 上部署。
MiniMax 通过 API 发布了 M3,这是一款拥有 100 万 token 上下文窗口并支持原生多模态输入的模型。该公司承诺在 10 天内发布开源权重和技术报告。
MiniMax 发布了 M3,这是一个开源权重模型,具备前沿编码能力、智能体能力、百万级上下文和原生多模态能力,在编码和智能体任务上取得了顶级基准成绩,并支持自主任务分解和长上下文。