标签
Nanbeige4.2-3B 是一款紧凑型智能体模型,采用循环Transformer架构,在3B规模下展现出强大的智能体任务和推理基准性能,超越了Qwen3.5-9B和Gemma4-12B等更大规模的模型。
本技术报告介绍了 Mach-Mind-4-Flash,一个拥有35B参数(3B激活参数)的混合专家(MoE)代理模型,仅通过后训练优化即可达到或超越100B参数级别的模型性能。它提出了一种新颖的训练基础设施,包括动态多教师调度、多教师在线策略蒸馏以及用于令牌效率的混合中位长度策略优化。
ModelScope推出Agents-A1,一个35B MoE智能体模型,支持256K上下文和函数调用,在长周期任务和指令遵循上达到SOTA。
Agents-A1 是 InternScience 推出的 35B 参数混合专家(MoE)智能体模型,通过长程轨迹缩放和多教师多领域蒸馏技术,在与 GPT-5.5 和 DeepSeek-V4-pro 等前沿规模系统的对比中展现出具有竞争力的性能。
介绍了Agents-A1,一个35B混合专家智能体模型,通过长视野轨迹缩放和三阶段训练方法(包括SFT、领域级教师和多教师蒸馏)实现了万亿参数级别的性能。在长视野智能体基准测试中,该模型表现优于或媲美更大规模的模型。
名为 Nex-N2-mini-ultra-uncensored-heretic 的 Nex-N2-mini 模型的新无审查版本已发布。它在保持低KL散度的同时,将拒绝率降低了93%,并提供了safetensors和GGUF格式。
Nex-AGI 发布并开源了 Nex-N2,这是一个具有统一框架的智能体模型,能够实现自适应和连贯的思考,在智能体和编程基准测试中取得了有竞争力的性能。
微软发布了Fara-7B,一个7B参数的小型语言模型,专攻纯本地桌面自动化,能直接接管鼠标键盘执行重复流程,成本低且无需联网。
Nex-AGI 发布了 Nex-N2,一个开源的智能体模型系列 (Nex-N2-Pro 和 Nex-N2-mini),采用 Agentic Thinking 框架,统一了推理、工具使用和环境执行,在智能体和编码基准测试中达到顶级性能。
Nex AGI 发布了 Nex-N2,这是一个开源智能体模型系列,用于编程、工具使用、深度研究和长时工作流,具备最先进的基准测试结果并采用 Apache 2.0 许可证。
H 公司发布了 Holo-3.1-35B-A3B-NVFP4,一款开源计算机使用模型,在单个 DGX Spark 节点上可实现每秒高达 195 个 token 的推理速度,性能超越 Qwen3.5-397B 和 Kimi-K2.5 等更大模型。
Nex-AGI 发布了 Nex-N2-Pro 与 Nex-N2-mini,这是一个开源的智能体模型,采用“智能体思维”框架,统一了推理、工具使用和环境执行。在智能体编程和长周期任务上展现出具有竞争力的性能。
微软发布了 Fara-7B,一个拥有70亿参数的用于计算机操作的智能小型语言模型,在其规模模型中实现了最先进的性能,并与大型系统竞争。
Kimi K2.6 作为开放权重模型发布,具备强大的智能体能力,可通过 FireworksAI 的高速推理 API 使用。
OpenAI 发布 ChatGPT agent,一个结合了深度研究和操作员功能的代理模型,具备终端访问和外部数据连接器,并在生物和化学领域配备了全面的安全防护措施和预防性控制。