标签
Google指出,在漏洞挖掘中仅依赖大型语言模型是不够的,关键需结合代理式漏洞发现框架,例如其团队利用该工具在短时间内发现多个关键漏洞。
智谱AI发布了GLM-5.3,通过后训练强化学习在编程和网络安全能力上取得显著提升,成为开源模型中编程能力最强的模型,并意外发现大量真实漏洞。
智谱发布旗舰AI模型GLM-5.3,在编程和网络安全漏洞发现方面实现重大突破,旨在挑战Anthropic和OpenAI等领先企业。
@clearbluejar 在 DEF CON 上关于使用本地 AI 模型进行实战漏洞发现的演讲公告。
谷歌正在使用AI和大语言模型自动化Chrome漏洞的发现、分类和修复,使得6月份修复的漏洞数量超过了过去两年的总和,其中包括一个存在13年之久的沙箱逃逸漏洞。
谷歌报告称,AI工具帮助其在2026年6月修复了Chrome中的1072个安全漏洞,比过去两年的总和还多,凸显了向自动化漏洞发现的转变。
Anthropic 的 Mythos AI 模型一直在以超出微软修补能力的速度发现微软 SharePoint 及其他软件中的关键和重要漏洞,这引发了紧迫的安全担忧,即对手可能会利用同样的漏洞进行攻击。
Google DeepMind推出了Gemini 3.5 Flash Cyber,这是一款轻量级网络安全模型,针对漏洞发现与修复进行了微调,并面向政府和受信任合作伙伴提供有限访问试点。
本文提出了一种实用的评估协议,用于在现实复杂目标(而非简化基准)中评估AI渗透测试智能体。它采用基于LLM的语义匹配、二分图解析和持续真值来对发现的漏洞进行评分,并发布了专家标注的真值数据和代码。
本文探讨了《欧盟网络弹性法案》中关于人类速度漏洞管理的假设如何可能被日益强大的AI代理所削弱,并指出该法规哪些部分仍然稳健,哪些部分可能面临压力。
提出 SAGE 框架,通过生成漏洞假设并迭代验证,自动揭示基于 LLM 的 Text-to-SQL 生成中的潜在失效模式。实验表明,SAGE 揭示了模型的显著脆弱性,且发现的模式可在模型间迁移,初步微调显示出有前景的修复效果。
本研究论文提出了一种基于Transformer的强化学习框架,用于自动生成无人交通管理(UTM)系统的安全关键测试场景,在漏洞发现效率上比专家引导测试提高了8倍。
AISLE 利用其模型无关的 AI 系统在 curl 中发现了 6 个新 CVE,其中包括有史以来报告的最古老漏洞(超过 25 年)。所有发现均在 curl 8.21.0 中修复。
Flounder is an open-source AI agent-based tool that automates vulnerability discovery in codebases. Users describe the target and the tool autonomously downloads code, conducts deep code audits, tests vulnerabilities locally and online, and generates reports.
OpenAI宣布推出Patch the Planet计划,与Trail of Bits合作,帮助开源维护者利用AI模型识别和修复漏洞,从而加强安全性,减轻维护者的负担。
介绍一个基于Claude订阅运行的8阶段漏洞发现代理,复现了Cloudflare Project Glasswing论文的核心思路,通过多窄代理、故意分歧验证和可达性门控将漏洞利用分析拆解为精确步骤,无需API密钥。
基于AI的安全扫描在10周内在Perfetto的trace处理器中发现了17个漏洞,凸显了AI发现那些此前很少受到关注的长尾代码中漏洞的潜力。
来自depthfirst的自主AI代理在FFmpeg中发现了21个零日漏洞,其中包括一个可通过单个183字节数据包实现的网络可达远程代码执行漏洞,仅花费1000美元的计算成本;这一发现凸显了自动化漏洞发现与漏洞修复之间的差距。
Anthropic 发布了开源的漏洞发现与修复参考实现,基于 Claude 构建了一个包含七阶段管道的验证链,旨在减少误报并确保修复验证闭环。
Anthropic的Claude Mythos Preview模型在50家合作伙伴的使用中,已发现超过10,000个高严重性和关键严重性的软件漏洞,其中包括Cloudflare系统中的2,000个bug以及wolfSSL中的一个关键缺陷,这标志着软件安全领域的范式转变。