@heyshrutimishra: 350亿参数模型在代理基准测试上几乎匹配1万亿参数模型,完全改变了成本计算方式。Apodex 1.1 mini 在 APEX-Agents 上得分27.7。…
摘要
Apodex 1.1 mini 在代理基准测试上取得了竞争性的性能,参数远少于像 Kimi K2.6 这样的大型模型,突出了部署成本优势。
查看缓存全文
缓存时间: 2026/08/25 14:11
35B 模型在智能体基准测试中几乎追平万亿参数模型,这彻底改变了成本计算逻辑。
Apodex 1.1 mini 在 APEX-Agents 上取得 27.7 分。
Kimi K2.6 采用约 1 万亿参数达到 27.9 分,其计算量约为前者的 30 倍。
部署成本才是真正的护城河。
Apodex (@Apodex_AI): 推出 Apodex 1.1:为复杂工作扩展智能体能力
开源工具集:https://t.co/hXoOuuWhlk 开放权重:https://t.co/tudzx5etWt
我们很高兴推出 Apodex 1.1——全新模型家族,专为专业工作构建可扩展的智能体智能。
🧠
相似文章
@heyshrutimishra: Apodex 1.0 发布,架构确实与众不同。它基于 Qwen3.5 进行后训练,成为一个自我进化的系统:…
Apodex 1.0 是一个基于 Qwen3.5 后训练的自我进化 AI 系统,在 BrowseComp、DeepSearchQA 和 HLE-text 上达到 SOTA。其 4B 迷你模型性能超越 30B 级别模型,并配有 AgentOS 运行时用于任务编排。开放权重可用。
发布 Apodex-1.0 Smol 模型(0.8B、2B、4B 开源权重),专为智能体验证优化 + AgentHarness 评估
Apodex 发布了开源权重的小型模型(0.8B、2B、4B),专为智能体验证任务优化,同时推出了用于本地智能体工作流的 AgentHarness 评估框架。
Apodex 1.1: 扩展智能代理以应对复杂工作
Apodex 1.1通过扩展可执行环境并训练智能代理进行长期协调,改善了在复杂现实任务中的持续、可验证进展,以更小的350亿参数模型实现了领先性能。
Kimi K2.6 vs Minimax M3:成本高出5倍,结果反而更差?我做了测试。
对Kimi K2.6和Minimax M3在实际工作流中的亲测比较表明,M3成本约低5倍,而质量几乎相同,使其在生成式系统中更具成本效益。
Apodex是什么?(AMA准备)
Apodex是一个开源的深度研究工具和AI模型,它是Qwen 3.5 35B A3B的微调版本,仅使用30亿活跃参数就达到了与前沿模型相当的性能。