@karminski3: 终于有好用的本地 DeepResearch 可以用了! 我给大家包了个skill, 开箱即用. 驱动模型是 Apodex 刚发的开放权重 DeepResearch 特调模型 Apodex-1.0-mini (now available a…
摘要
Apodex发布了开放权重的DeepResearch特调模型Apodex-1.0-mini,基于Qwen3.5-35B-A3B,在BrowseComp达到71.5分,接近旗舰模型,可以在本地高效运行,作者打包了开箱即用的skill。
查看缓存全文
缓存时间: 2026/07/07 13:31
终于有好用的本地 DeepResearch 可以用了! 我给大家包了个skill, 开箱即用.
驱动模型是 Apodex 刚发的开放权重 DeepResearch 特调模型 Apodex-1.0-mini (now available as Apodex deep research), 这个模型是直接霸榜FutureX榜单的(字节和斯坦福搞的大模型预测未来准确度的榜单)! 现在能直接本地用了.
模型基于 Qwen3.5-35B-A3B 后训练, BrowseComp (AIAgent网络浏览能力测试) 能到 71.5分, 接近旗舰模型的水平. 而且足够小, 我的 MacStudio 能跑跑到 70tps+.
我很好奇 DeepResearch 特调模型跟普通模型有什么区别, 于是我使用咱们这个skill接入了 Apodex 的单 Agent DeepResearch 框架, 专门测试了一下, 看看 DeepResearch 特调模型是不是噱头:
#Apodex #DeepResearch #ReAct #DiscoverativeIntelligence #FutureX
相似文章
@zhixianio: 这两天新机器到了之后,我开始了「苦行僧」式的强迫自己使用本地模型来完成常见任务的修行 本以为会非常痛苦,没想到无论是速度还是质量都大大超出我的预期: 模型: Qwen3.6-35B-A3B-oQ6-fp16-mtp 运行:oMLX,开 N…
作者在本地新机器上使用Qwen3.6-35B-A3B模型和oMLX工具进行日常任务,发现速度和效果远超预期,甚至在PA和Coding场景下优于远程LLM,体现了端侧AI能力的显著提升。
@RookieRicardoR: 国产模型再次突破,比肩 Claude 4.6,Gemini 3.1 Pro 等顶尖模型。 刚测完 Qwen3.7-Max,说几点真实感受。 昨晚 API 上线第一时间就充了值,选了三个题目(见视频)来测试 Qwen3.7-Max 的前端能…
用户测试了Qwen3.7-Max,认为其在前端、算力和Agent能力上比肩Claude 4.6和Gemini 3.1 Pro等顶尖模型,推理能力显著提升,且迭代速度月更,已成为国产第一梯队。
@yidabuilds: https://x.com/yidabuilds/status/2053409619641602286
作者对DeepSeek V4、Kimi K2.6、GLM-5.1和MiniMax M2.7四款国产AI模型进行了横向对比测试,分析了它们在成本、长上下文处理能力、编程稳定性及推理性能上的优劣,并给出了针对大文档分析、长程后台任务和批量内容生产的具体分流建议。
@kfk_ai: 穷鬼玩 Agent 的配置 主模型:deepseek-v4-flash(1M 上下文),用商汤的 free 额度,多注册几个 key,再用 9router 捏在一起防限流 视觉模型:Qwen3-VL-30B-A3B-Thinking,硅基…
一个用户分享了使用多个免费或低成本AI模型组合搭建Agent的配置方案,包括主模型、视觉模型、生图、视频和语音等模块。
@yibie: 推荐这个项目,shadcn(shadcn/ui 作者)做了一个 Agent Skill——让最贵的模型做审计和规划,让便宜的模型写代码。这个想法本身不新,但 shadcn 把它做成了一个可安装、可编排、带执行闭环的系统,每个设计决策都很实…
shadcn 发布了 Agent Skill 项目 improve,让高价模型进行代码审计和规划,低价模型执行,形成可安装、可编排、带执行闭环的系统。