@rohanpaul_ai: atomic[.]chat,一款本地运行LLM的桌面应用,对Claude Sonnet 5、Claude Opus 4……进行了一次极具揭示性的对比。
摘要
atomic.chat进行了一项对比,显示Claude Sonnet 5在三个物理编码演示中与GPT 5.5表现相当,但成本低6倍,且使用的token数少于其他模型。
查看缓存全文
缓存时间: 2026/07/01 01:56
atomic[.]chat,一个本地运行大语言模型的桌面应用,进行了一次非常具启发性的对比测试,涉及Claude Sonnet 5、Claude Opus 4.8、Claude Sonnet 4.6和GPT 5.5。
Claude Sonnet 5在3个物理编码演示中恰好追平GPT 5.5,而成本仅为后者的1/6。
同时,它消耗的token数也最少。
- Sonnet 5:15,047 token,$0.15
- Opus 4.8:23,063 token,$0.58
- Sonnet 4.6:25,824 token,$0.39
- GPT 5.5:31,152 token,$0.94
atomic.chat (@atomic_chat_hq): 新的Claude Sonnet 5性能达到GPT 5.5水平,成本却便宜6倍!
我们给4个模型相同的提示:用真实物理碰撞演示构建三个独立的HTML5 canvas场景
提示内容:
- 一辆汽车撞上砖墙
- 一个铁球摧毁房屋
- 一台投石机将石块砸向
相似文章
@rohanpaul_ai: atomic[.]chat(一款本地运行大语言模型的桌面应用)在 MacBook 上进行了一场极具揭示性的本地 AI 智能体对比测试……
Liquid 的 LFM2.5-8B-A1B 在 MacBook Pro 上本地运行工具调用基准测试时,击败了 OpenAI 的 gpt-oss-20b,不仅完成了所有工具调用,耗时还缩短了一半以上,且内存占用更少。
@VraserX: GPT-5.5 依然是王者。GPT-5.5 以几乎一半的成本和大约两倍的速度碾压 Claude Opus 4.8。OpenAI …
一条推文声称,OpenAI 的 GPT-5.5 以近乎一半的成本和双倍的速度表现优于 Claude Opus 4.8,宣称 OpenAI 在 AI 领域继续保持统治地位。
@rohanpaul_ai: atomic[.]chat 让 Gemma 4 26B 在 LLaMA.cpp 中的运行速度更快,在 MacBook Pr… 上的 token 生成速度提升约 40%
atomic.chat 优化了 Gemma 4 26B 在 LLaMA.cpp 中的推理性能,在 MacBook Pro M5 Max 上通过多 token 预测(MTP)推测解码实现了约 40% 的 token 生成提速。这对运行桌面应用、编程智能体和本地私有助手的本地 AI 用户来说是一个重大利好。
@rohanpaul_ai: GPT-5.6 Sol Ultra vs GPT-5.5 在令人惊讶的HTML5物理测试演示中,Atomic Chat发现GPT-5.6 Sol Ultra的费用比GPT-5.5高出3倍…
Atomic Chat的一项物理测试显示,GPT-5.6 Sol Ultra的价格是GPT-5.5的三倍,但在HTML5 canvas物理演示中并无明显优势,突显出尽管成本更高,但在物理模拟方面存在弱点。
@rohanpaul_ai: Atomic-Chat 的 GitHub。"一个在您的计算机上 100% 离线运行的开源 ChatGPT 替代方案。" https://github.…
Atomic-Chat 是一款开源桌面和移动应用,用于在本地完全离线运行 LLM,提供 ChatGPT 的私有替代方案。