@elonmusk: Grok 4.5 在现实工作中表现卓越
摘要
Elon Musk 推荐 Grok 4.5 用于实际任务,引用 Ramp 测试:Grok 在 15 万张商业发票上实现了最高的完美抽取率。
Grok 4.5 在现实工作中表现卓越
查看缓存全文
缓存时间: 2026/07/24 23:19
Grok 4.5 在实际工作中表现出色
rahul (@rahulgs): Grok 4.5 在处理真实发票方面排名第一
在 Ramp,我们使用实际企业提交的 15 万张账单对模型进行测试,根据模型是否能预测出人工审核的所有修正项来评分
Grok 达到了最高的完美提取率,超越了其他同价位的模型
相似文章
@elonmusk: Grok 正在完善实际应用场景的闭环
Elon Musk 声称 Grok 正在完善实际应用场景的闭环,并引用测试结果称 Grok-4.5 的性能优于那些击败 gpt-5.5 的新 OpenAI 模型。
@elonmusk: Grok
埃隆·马斯克分享了一个工作流程,使用Grok 4.5进行各项开发任务,同时还有Fable 5和GPT-5.6 Sol,强调了一个实时研究和编码设置。
@elonmusk:Grok 4.6 在 CursorBench 真实编码测试中排名第一
Elon Musk 宣布,Grok 4.6 在 CursorBench 真实编码测试中排名第一,超越其他 AI 模型,展现出高效率。
@elonmusk: Grok 4.5 的好评
埃隆·马斯克发推文分享了一个对 Grok 4.5 的正面评价的链接。
@elonmusk: Grok Imagine 专注专业实用性、消费者趣味性和整体易用性
埃隆·马斯克强调,Grok Imagine 优先考虑专业实用性、消费者趣味性和易用性,同时有引述指出,Grok 4.5 在 Design Arena 的日常使用中排名第一,超越了像 Claude Fable 5 和 GPT-5.6 Sol 这样的竞争对手。