@Chris_Wozniczek:Qwen 3.8 27B 对比 Ornith-1.5-35B [4 Bit MLX] 提示词:Bioluminescent Abyssal Temple (完整提示词在页面上) 工具:Grok…
摘要
推文对比了Qwen 3.8 27B和Ornith-1.5-35B模型在生成生物发光深渊神庙动画的提示词上的表现,指出Qwen在视觉效果上更优,而Ornith在构建速度和完成时间上更快。
查看缓存全文
缓存时间: 2026/08/20 15:00
Qwen 3.8 27B vs Ornith-1.5-35B [4 Bit MLX]
提示词:生物发光深渊神殿
(完整提示词见页面)
运行环境:Grok Build
生成速度:Qwen - 约24 tok/s,Ornith - 约55 tok/s
耗时:Qwen - 33分钟,Ornith - 16分钟
效果对比:请自行查看
https://chris-website-theta.vercel.app/compare.html?prompt=bioluminescent-abyssal-temple&left=qwen-grokbuild&right=ornith-grokbuild…
我的真实评价:
两者都生成了可运行的动画 Qwen在控制逻辑方面表现更优 Qwen的视觉效果更出色——以水母为例,层次更丰富,运动更自然 Ornith完整实现了提示词要求,包括截图并运用无头浏览器等工具完成任务
其他模型评测:https://chris-website-theta.vercel.app/benchmarks
使用“比较“功能可对比任意模型
更多测试提示词及各模型评分即将推出。
相似文章
@TeksEdge:经过一天的使用,测试 Orinth-1.0-35B 与 Qwen3.6-35B 的表现如何。凭经验来说,它的表现与……
一位用户报告称,Ornith-1.0-35B 在性能上与 Qwen3.6-35B 相当,但在规划和长任务执行方面更胜一筹,同时开发者宣布开源专门用于代理编码的 Ornith-1.0 系列 LLM。
RTX 3090 本地基准测试 - Qwen3.6 27b 对比 Ornith
用户在RTX 3090上使用inspect-ai运行本地基准测试,比较Qwen3.6 27b、Gemma4 26B和Ornith1.0 35B。结果显示Qwen在知识和编码方面领先,而Ornith在接地性和召回方面具有竞争力。
Ornith 35B 与 Qwen3.6 35B DFlash 推测模型配合效果良好
在 llama-server 中,Ornith 35B 与 Qwen3.6 35B DFlash 推测模型搭配使用时,token 生成速度提升了 30-40%,在混合代码和文本上实现了 80% 的接受率,但提示处理性能有所下降。
@TheAhmadOsman: Qwen 3.8 27B 能否在与 Muse Glimmer 30B 的对抗中卷土重来?无论如何,对这次发布感到非常高兴
一位用户对新的AI模型发布表示兴奋,并推测 Qwen 3.8 27B 能否与 Muse Glimmer 30B 竞争。
@malikwas1f: Ornith-1.0-35B:一个Qwen3.6-35B-A3B的编码微调版本,在真实编码上略优于基础模型(aider 15/30 vs 13)——完整262K…
宣布Ornith-1.0-35B,一个Qwen3.6-35B-A3B的编码微调版本,在aider基准测试上略优于基础模型。同时推广用于在RTX 3090上运行LLM的club-3090仓库。