model-assessment

标签

Cards List
#model-assessment

CAISI对Z.ai的GLM-5.3网络能力的评估

Reddit r/ArtificialInteligence ↗ · 3天前 缓存

CAISI的评估发现,Z.ai的GLM-5.3是目前网络能力最强的开放权重AI模型,但在能力上仍然落后于U.S.前沿模型大约四个月。

0 人收藏 0 人点赞
#model-assessment

@TheZvi: 这看起来超级酷,祝贺大家。

X AI KOLs Timeline ↗ · 2026-08-30 缓存

AVERI 与 Google DeepMind、OpenMined 和 MLCommons 合作,宣布了针对专有语言模型 Gemini 2.5 Flash-Lite 的首次双盲评估,标志着在AI模型评估中的历史性里程碑。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈