标签
阿里巴巴发布了Qwen3.8-Max,这是一个2.4万亿参数的稀疏MoE模型,每个token激活950亿参数,支持100万token的上下文,并具有强大的智能体能力和基准测试结果,包括自主编码数天、电路设计,以及在Terminal Bench和PaperBench上超越竞争对手。
PyTorchCon North America 2026 将邀请 Agentic AI Foundation 的 Mazin Gilbert 发表主题演讲,聚焦开源 AI 与智能体生态系统。活动将于 10 月 20-21 日在加利福尼亚州圣何塞举行。
Andrew Ng 预测,传统提示工程将在六个月内过时,重心将转向自主智能体系统,这些系统只需极少的人工输入即可迭代并自我改进。
GitHub宕机凸显了AI智能体集中式控制平面的脆弱性,促使人们呼吁建立开放、去中心化、智能体原生的构建基础设施,gitlawb被引为新兴范例。
本文提出DoctorAgents,一种智能体AI框架,利用专门的LLM智能体对小型、异质性临床时序数据集进行端到端机器学习流程的迭代生成、验证与优化,性能优于成熟的AutoML基线方法。
本文介绍了一个基准测试与轨迹记录框架,用于评估控制显微镜的基于LLM的智能体,比较了105种智能体配置,发现基准测试有助于资格验证,但无法可靠预测智能体在未见任务上的表现。
本文提出了Agentic Nesting,一种多智能体协作框架,将现有企业应用封装为分层嵌套结构中的AI智能体,实现自然语言交互和跨应用编排,作为传统ESB/API/RPA集成方法的替代方案。
Jerry Liu 对 Explabs AI 表示认可,这是一家由 YC 支持的创业公司,将爬山法产品化为智能体任务的自动化服务,声称可节省高达 97% 的成本,并将质量提升 50%。
一条推文回应了马克·古尔曼的报道,称OpenAI正在开发一款售价300至400美元的甜甜圈形状智能音箱,并推测它可能成为具备Codex类似能力的智能体AI的物理界面。
微软在2026年Gartner Magic Quadrant AI增强代码现代化工具领域被评为领导者,突显了其Azure和Copilot驱动的现代化解决方案。
这篇文章强调,独立AI安全扫描器对相同的行为漏洞命名不同,造成追踪和审计开销。文章介绍了AVE,一个针对自主智能体AI漏洞类别的开放源码稳定ID分类法,并指出一个独立开发者的扫描器发现结果收敛到了相同的ID。
Google Maps 的 Ask Maps 功能获得智能体能力,用于订餐、预订酒店和查找活动门票,并集成 Personal Intelligence,与 Gmail 和 Calendar 结合,提供个性化推荐。
本文介绍了EmpaAva,据我们所知,这是首个开源的智能体3D虚拟形象共情聊天机器人,通过三智能体LLM架构实现实时的、面对面的多模态共情,在情感理解、响应质量和视听一致性方面超越了基线系统。
本文首次对智能体 AI 工作流进行架构特征分析,揭示了碎片化、异构化的执行模式与常规服务器设计不匹配的问题,并介绍了一个名为 Agora 的原型服务器以提高 CPU/GPU 利用率和吞吐量。
这篇文章论证了,智能体之间信任的关键问题在于付款方能否廉价地验证结果,并提出智能体应购买工件(查询、引用、种子)来让检查变得划算。
Meta 首席 AI 官 Alexandr Wang 在 Y Combinator Startup School 上表示,只要拥有正确的智能体循环和评估系统,一群智能体可以胜过一支100人的工程师团队。
安全研究员James Kettle在Black Hat上展示了研究结果,表明虽然智能体AI在自主设计新颖黑客攻击方面能力有限,但在人类引导下却能成为强大的合作伙伴,进而发现了一个名为“共享解析器混淆”的新漏洞类别。
VeriTrace 是一个用于自动化 Verilog RTL 生成的多智能体系统,它引入了智能体时间探索(Agentic Temporal Exploration),使调试智能体能够完全控制信号选择、时间窗口和迭代深度,在 VerilogEval-V2 上实现了 100% 的 Pass@1,并比基线模型高出 +5.1% 的性能。
Liquid AI 发布了 LFM2.5-2.6B,这是一款紧凑的智能体模型,设计为完全在设备端运行,从而实现免费推理、低延迟和隐私保护。文章详细介绍了其训练流程,包括 SFT、教师特化、蒸馏和智能体强化学习。
inclusionAI 发布了 Ling-3.0-flash,一款原生混合推理模型,总参数量124B,激活参数量5.1B,采用混合线性注意力架构(KDA+MLA)与稀疏MoE。其性能与上一代1T级模型 Ring-2.6-1T 相当或更优,同时计算效率大幅提升,并内置智能体与长上下文优化。