Qwen3.5 4B + 抓取 logits 几乎接近 "Jev"?甚至只是 Qwen Reranker?
摘要
一位开发者分享了一项实验,使用 Qwen 3.5 4B 模拟 Jev 的概率输出,通过抓取 logits 概率,结果和代码在 GitHub 和演示网站上可用。
看到了新的 Introducing System One Models & Jev - TypeSafe AI Blog Jev 模型,它只是输出给定选项的概率,我觉得听起来像是 Qwen reranker 模型也能做到的事情?然后我尝试实现了它,使用 Qwen 4B + 只是将每个选项分配给一个字母并抓取每个的 logit 概率,结果甚至更好。结果和样本在 https://github.com/TheoLeeCJ/openjev,你也可以在 openjev.com 上的浏览器中尝试。我是不是错过了什么?几乎不是 Jev?结果
相似文章
一个基于Qwen3.5 4B微调的Jev风格模型
作者使用LoRA对Qwen3.5 4B进行了微调,结合公开数据和合成数据创建了一个Jev风格模型,实现了性能提升,并开源了模型和数据集。
在ninfer上原生运行类似jev的API,使用qwen3.8 27b模型,结果相当不错
作者成功在NInfer上使用Qwen3.8-27B实现了类似jev的API,在JevBench上达到了84.4%的准确率,结果相当不错,但这仍然是一个存在一些错误的概念验证。
Qwen/Qwen3.6-35B-A3B
Qwen 发布 Qwen3.6-35B-A3B,一款开源权重的混合专家(MoE)模型,总参数量 35B,激活参数量 3B,在智能体编码和推理能力保持方面实现显著提升。
YouTuber 用 Qwen 3.5 35B、Qwen 3.6 35B 与 Gemma 4 27B 逆向大型 JS,Qwen 3.6 表现亮眼
在 108 k token 的 JS 文件上,Qwen 3.6 35B 实现 283/285 行近乎完美的召回率,碾压 Gemma 4 27B(仅 6/16 通过),并修复了早期 Qwen 的长上下文短板。
Qwen 3.7 Max
Qwen 3.7 是一款来自中国实验室的新AI模型,令人印象深刻,讨论焦点在于其权重是否可供下载。