@fahdmirza:我们在Claude Mythos轨迹上训练了一个9B模型——来看看结果。认识Qwythos 9B:开源、本地运行,且表现超群……

X AI KOLs Timeline 模型

摘要

在Claude Mythos轨迹上训练了一个9B模型(Qwythos 9B),在漏洞查找、SQL和函数调用方面取得了强劲成果,同时在A6000上使用llama.cpp本地运行。

我们在Claude Mythos轨迹上训练了一个9B模型——来看看结果 认识Qwythos 9B:开源、本地运行,且表现远超其等级 在A6000上使用llama.cpp + MTP草案推测进行本地服务 在一次运行中发现了有问题的全栈呼叫中心应用中的4个漏洞中的3个 完美通过SQL测试:相关子查询去关联,正确答案,无提示 通过YaRN实现1M上下文,原生函数调用,完全无审查 这就是小模型向最佳学习的结果 观看下方完整视频
查看原文
查看缓存全文

缓存时间: 2026/06/28 03:59

我们在Claude Mythos traces上训练了一个9B模型——结果如下

认识一下Qwythos 9B:开源、本地运行,性能远超同级别模型

在A6000上通过llama.cpp + MTP draft speculation本地部署

在一个有缺陷的全栈呼叫中心应用中一次性找出4个bug中的3个

完美通过SQL测试:相关子查询解关联,正确答案,无需提示

通过YaRN支持1M上下文,原生函数调用,完全无审查

这就是小模型向顶级模型学习的结果

观看下方完整视频

相似文章

empero-ai/Qwythos-9B-Claude-Mythos-5-1M-GGUF

Hugging Face Models Trending

Empero AI 发布了 Qwythos-9B-Claude-Mythos-5-1M-GGUF,这是一个基于 5 亿以上 tokens 的 Claude Mythos/Fable 轨迹(包含思维链)微调而成的 9B 参数推理模型,相比 Qwen3.5-9B 取得了显著提升,并通过 YaRN 旋度缩放支持 100 万 token 上下文。GGUF 量化版本支持在 llama.cpp 及兼容运行时上进行本地推理。

我们自家也有Mythos:GLM 5.2在网络基准测试中击败Claude

Lobsters Hottest

智谱AI的开权重模型GLM 5.2在IDOR检测基准测试中以远低于Claude Code的成本击败了它,尽管仍落后于Semgrep专门构建的多模态管道。文章探讨了漏洞检测性能有多少来自模型本身,又有多少来自其周围的工具链。

empero-ai/Qwythos-9B-Claude-Mythos-5-1M

Hugging Face Models Trending

Empero AI 发布了 Qwythos-9B,这是一个经过微调的推理模型,具有100万令牌的上下文和无审查能力,在基准测试中相比于其基础模型 Qwen3.5-9B 有显著提升。