Mythos在网络安全/黑客攻击方面优势的更多证据——与5.5版本相比,它完成了41个n-day漏洞利用中的18个,而5.5只有1个。开源/权重模型则一个都没有。
摘要
Mythos在网络安全黑客攻击中展现了强大性能,实现了41个n-day漏洞利用中的18个,而5.5版本只有1个,开源模型则一个都没有。
https://x.com/i/status/2055314585058693601
相似文章
它能媲美Mythos吗?
作者测试其他AI模型是否能匹配Mythos在寻找安全漏洞方面的卓越能力,建立了一个由Mythos发现的漏洞基准,并测试了像Opus这样的模型。初步结果表明Mythos可能具有独特的能力。
更新后的GPT-5.5 Cyber在CyberGym中击败Mythos 5
更新后的GPT-5.5 Cyber模型在CyberGym基准测试中超越了Mythos 5。
新Mythos检查点展示持续进步:“在32步企业网络攻击中,我们估计人类专家需要约20小时,而此检查点在十次尝试中可完成六次完整攻击。”
Mythos发布了一个新的检查点,能在十次尝试中完成六次32步企业网络攻击,而人类专家则需要约20小时。
@NielsRogge:在 http://paperswithcode.co 上,你可以看到 Mythos 5 在流行的图表理解基准 CharXiv 上被一个 4B 开源模型超越……
一个4B开源模型在 CharXiv 图表理解基准上击败了 Mythos 5,展示了可自由获取的小模型的强大性能。
Mythos 并非通过‘黑客’训练而成。其他 AI 实验室未来也将达到 Mythos 级别的能力。
文章澄清了 AI 模型 Mythos 并非通过黑客技术训练,并预测其他 AI 实验室最终将具备类似能力。