deepswe-benchmark

标签

Cards List
#deepswe-benchmark

@sashimikun_void: GPT-5.5 在 DEEPSWE 基准测试中优于 Claude Opus 4.8。Opus 4.8 耗时两倍,生成三倍的…

X AI KOLs Following · 2026-05-30 缓存

GPT-5.5 在 DEEPSWE 基准测试中优于 Claude Opus 4.8,以更低的成本和更少的 token 膨胀获得了更高的分数。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈