新基准测试发布!

Reddit r/LocalLLaMA 新闻

摘要

新基准测试对比了Qwen3.8-27b、Sol 5.6和Qwen3.6-35B模型在生成沙漠中骆驼背景下的自行车上的马SVG图像时的性能,使用了包含拼写错误的提示。

自行车上的鹈鹕已经过时了,所以我提出了一个全新的改进版本。Qwen3.8-27b 中等(UD-Q4_K_XL)对比 Sol 5.6 高级对比 Qwen3.6-35B(UD-Q6_K_XL)。提示(仅包含真实拼写错误!):"创建一个沙漠中骆驼背景下的蓝色自行车上的马的SVG图像。"
查看原文

相似文章

本地之王归来!Qwen3.8-27B 性能图表

Reddit r/LocalLLaMA

Qwen3.8-27B 是一款新的本地可运行模型,据报道其性能超越之前的本地模型,可与 Opus4.6 媲美,并分享了基准测试图表以及 ModelScope 和 HuggingFace 的链接。