@Youssofal_: Qwen 3.8 27B 对比 Fable、Kimi K3、GPT 5.6 Sol Pro 在 Flappy Bird 上。提示:“制作终极可爱、漂亮和美丽的……
摘要
本文比较了各种 AI 模型的性能,包括 Qwen 3.8 27B、Fable、Kimi K3 和 GPT 5.6 Sol Pro,在生成 HTML 版 Flappy Bird 游戏时的表现,重点突出了执行时间和质量的差异。
查看缓存全文
缓存时间: 2026/08/26 03:34
Qwen 3.8 27B 对决 Fable、Kimi K3、GPT 5.6 Sol Pro 的 Flappy Bird 游戏生成测试。
提示词:“制作一个终极可爱、精致、美丽的 HTML Flappy Bird 游戏。”
Qwen 3.8 27B Xhigh INT8:
- 视频 1(蓬蓬)
- 8分11秒
- 160 TPS(双卡3090)
Fable 5 Max:
- 视频 2(扑翼小绒球)
- 20分21秒
Kimi K3 Max Fireworks Fast:
- 视频 3(绒毛扑扑!)
- 4分40秒
- 111.3 TPS
GPT 5.6 Sol Pro:
- 视频 4(爆炸小鸟)
- 19分7秒
总结:
个人认为 Fable 表现最佳。它的成品极具打磨感,界面清晰,且在细节上独具匠心,比如死亡时的眩晕特效。然而,27B 的表现令人惊叹地接近。两个月前我绝不会想到本地模型能达到这样的水平。在某些方面,27B 甚至优于 Fable,比如死亡时的 3D 倾斜界面按钮设计。
Kimi K3 的操作手感最为流畅,它在难度和易玩性之间取得了完美平衡。此外,它是唯一一款自带背景音乐的模型。
5.6 Sol Pro 在所有方面都糟糕得令人发笑。我多次尝试 5.6 xhigh 版本,但生成的输出甚至更差。
相似文章
(交互式)OpenCode 赛车游戏对比:Qwen3.6 35B vs Qwen3.5 122B vs Qwen3.5 27B vs Qwen3.5 4B vs Gemma 4 31B vs Gemma 4 26B vs Qwen3 Coder Next vs GLM 4.7 Flash
一项非正式基准测试,通过 OpenCode/Playwright MCP 让 8 款 AI 模型(Qwen3.6 35B、Qwen3.5 系列、Gemma 4 系列、GLM 4.7 Flash)开发赛车游戏,以测试其代码生成智能体的能力,并记录了各种实现细节与特殊情况。
ArenaAI Kimi K3 与 Fable 和 Sol 的对比
关于 ArenaAI 上 AI 模型 Kimi K3、Fable 和 Sol 的对比视频
GPT-5.6 Sol 对比 Fable 5 - 移动应用设计
本文比较了GPT-5.6 Sol和Fable 5 AI模型在移动应用设计任务中使用相同提示的性能,并询问读者更偏好哪个模型。
Qwen-3.8-27B、Nemotron-3.5-Lightning-30B-A3B、Ornith-1.5-35B-A3B、Muse-Glimmer-30B oQ8e 对比
对比了多个AI模型,包括Qwen、Nemotron、Ornith和Muse-Glimmer在基准测试上的表现。Ornith表现优异,而TielCoder在编程任务中展现了潜力。
@rohanpaul_ai:Qwen 3.8 Max 构建的3D物理场景比 Fable 5 更好,而运行成本约为其1/7。测试由 @ato… 完成
atomic.chat 的一项测试显示,Qwen 3.8 Max 在生成自包含的3D物理场景方面胜过 Fable 5,而每次运行成本约为其1/7。