@ArizePhoenix: 它现在以84.5%领先CyberGym,https://Z.ai正在运行一个公开披露账本,用于2,400多个现实世界漏洞…

X AI KOLs Following 模型

摘要

一个AI模型在CyberGym上取得了84.5%的成绩,领先基准,Z.ai正在运行一个公开披露账本,用于该模型揭示的超过2,400个现实世界漏洞。

它现在以84.5%领先CyberGym,https://t.co/QVncYTK2WO正在运行一个公开披露账本,用于该模型揭示的2,400多个现实世界漏洞。
查看原文
查看缓存全文

缓存时间: 2026/09/03 18:12

它在CyberGym上以84.5%的准确率领跑,且 https://t.co/QVncYTK2WO 正在运行一个公开披露账本,记录该模型已发现的2400多个现实漏洞。

相似文章

Anthropic 新模型一个月内发现超一万个安全漏洞

Reddit r/ArtificialInteligence

Anthropic 的新 AI 模型 Claude Mythos 在一个月内识别出全球系统软件中超过一万个高危和严重安全漏洞,其误报率优于人类测试人员,显著推动了 AI 驱动的网络安全。

随着AI能力提升,强化网络防御能力

OpenAI Blog

OpenAI 发布了一套管理AI模型网络能力的综合框架,指出在 CTF 性能上取得了显著进步(从 GPT-5 的 27% 提升到 GPT-5.1-Codex-Max 的 76%),并概述了纵深防御措施,以确保先进模型主要造福防御方,同时限制恶意使用。