@QuixiAI: ChatGPT 未通过, Claude 未通过, Deepseek 未通过, Qwen3.8 通过, GLM 5.3 通过, Grok 通过

X AI KOLs Timeline 新闻

摘要

这条推文报告称,ChatGPT、Claude 和 Deepseek 未通过测试或基准,而 Qwen3.8、GLM 5.3 和 Grok 通过,基于一个链接的来源。

ChatGPT 未通过 Claude 未通过 Deepseek 未通过 Qwen3.8 通过 GLM 5.3 通过 Grok 通过 https://t.co/q7CbBbPymk
查看原文
查看缓存全文

缓存时间: 2026/08/29 08:01

ChatGPT 失败 Claude 失败 Deepseek 失败 Qwen3.8 通过 GLM 5.3 通过 Grok 通过 https://t.co/q7CbBbPymk

相似文章

@charles_irl: 新基准测试刚刚发布

X AI KOLs Timeline

Andon Labs 发布了一项新的基准测试,测试AI模型是否会拒绝播放纳粹进行曲。结果显示,Claude Opus 4.8 和 GPT 5.5 总是拒绝,Gemini 3.5 Flash 有一半时间拒绝,而 Grok 4.3 几乎总是播放。