Claude Opus 5.5 在 HWE 基准测试中设计了一款比人工制造的处理器更快且更小的处理器
摘要
Claude Opus 5.5 设计了一款在 HWE 基准测试中比人工制造的 VexRiscv 更快且更小的处理器
每个模型都从相同的基本处理器设计开始,并在几轮中尝试改进它。结果根据两个方面评分:速度(芯片运行名为 CoreMark 的标准测试程序的速度,分数越高越好)和大小(芯片占用的空间,越小越好)。作为对比,有一个由人类工程师设计的知名处理器,叫做 VexRiscv。
相似文章
@elliotarledge:Claude Fable 5 [max] 在 KernelBench-Hard 上的表现。给我印象最深的核心是 B200 fp8 GEMM:它手动编写了原始的 SM10…
Claude Fable 5 通过为 B200 fp8 GEMM 手动编写 PTX 代码,在 KernelBench-Hard 上取得了顶级结果,超越了其他模型,并在计算密集型形状上达到峰值性能的 44-59%。
Claude Opus 5.5 在 Artificial Analysis Intelligence Index 上位居榜首,同时实现20%降价与更大的缓存命中折扣。
Claude Opus 5.5 已在 Artificial Analysis Intelligence Index 中获得首位,并伴随20%的价格下调和增强的缓存命中优惠。
Claude Opus 5 基准测试!
一篇介绍即将推出的 Claude Opus 5 AI 模型基准测试结果的文章。
Claude OPUS 5.5 现已发布,这次 Anthropic 简直碾压了所有对手。
Anthropic 发布了 Claude OPUS 5.5,以其令人印象深刻的性能和出色的性价比,超越了之前的模型和 GPT。
@sashimikun_void: GPT-5.5 在 DEEPSWE 基准测试中优于 Claude Opus 4.8。Opus 4.8 耗时两倍,生成三倍的…
GPT-5.5 在 DEEPSWE 基准测试中优于 Claude Opus 4.8,以更低的成本和更少的 token 膨胀获得了更高的分数。