新基准测试发布!
摘要
新基准测试对比了Qwen3.8-27b、Sol 5.6和Qwen3.6-35B模型在生成沙漠中骆驼背景下的自行车上的马SVG图像时的性能,使用了包含拼写错误的提示。
自行车上的鹈鹕已经过时了,所以我提出了一个全新的改进版本。Qwen3.8-27b 中等(UD-Q4_K_XL)对比 Sol 5.6 高级对比 Qwen3.6-35B(UD-Q6_K_XL)。提示(仅包含真实拼写错误!):"创建一个沙漠中骆驼背景下的蓝色自行车上的马的SVG图像。"
相似文章
Qwen3.8 27B 在 SVG 生成上超出了我的预期 :D
一位用户在 SVG 生成任务中测试了 Qwen3.8 27B 模型,并使用了一个复杂提示,发现结果超出了预期,突显了该模型在创造性任务上的能力。
我的笔记本上的Qwen3.6-35B-A3B画出的鹈鹕比Claude Opus 4.7更好
Simon Willison对比了在MacBook Pro上本地运行的Qwen3.6-35B-A3B与Claude Opus 4.7,发现Qwen生成的骑自行车的鹈鹕和骑独轮车的火烈鸟的SVG插图更好,不过他指出这个狭窄的基准测试并不能反映更广泛的模型能力。
我刚刚用Q4量化的Qwen 3.8 27与GPT 5.6 Sol high进行测试——在复杂动画SVG任务中轻松获胜
一名用户在复杂动画SVG任务中测试了Q4量化的Qwen 3.8 27B和GPT 5.6 SOL,发现Qwen表现更好,错误更少,突显了其在空间推理和编码方面的优势。
我在 RTX 5090 上用同一真实架构写作任务实测 Qwen3.6-27B、Qwen3.6-35B-A3B、Qwen3.5-27B 与 Gemma 4
在 RTX 5090 上,让四款本地大模型——Qwen3.6-27B、Qwen3.6-35B、Qwen3.5-27B 与 Gemma 4——完成 2 万 token 架构写作任务,结果显示 Qwen3.6-27B 在清晰度、完整性与实用性上取得最佳综合平衡。
本地之王归来!Qwen3.8-27B 性能图表
Qwen3.8-27B 是一款新的本地可运行模型,据报道其性能超越之前的本地模型,可与 Opus4.6 媲美,并分享了基准测试图表以及 ModelScope 和 HuggingFace 的链接。