@cognition: 推出 SWE-2,这是我们迄今最接近前沿的模型。在主流评估中,它的得分与近期前沿模型持平…
摘要
SWE-2 是一个AI模型,通过扩展强化学习,在成本降低高达70%的情况下匹配前沿性能。
查看缓存全文
缓存时间: 2026/09/10 20:23
推出 SWE-2,我们迄今最接近前沿水平的模型。
在主流基准测试中,其表现与近期前沿模型持平——成本却降低了最高达 70%。
我们将强化学习扩展至数万亿参数规模,并通过优化方案同时推进模型能力与成本效率的帕累托前沿。 https://t.co/FjBxrikExs
相似文章
SWE-1.7:以极低成本实现前沿智能(阅读时间约22分钟)
Cognition 发布了 SWE-1.7,一个功能强大的 AI 模型,专为智能体软件工程设计,以更低的成本实现了前沿级别的性能。该模型在强化学习训练、多集群基础设施、数据整理以及针对长任务的自我压缩方面进行了改进。
Cognition 推出新型 SWE-2 模型,与 Fable 5.1 和 GPT-Astra 相媲美
Cognition 推出 SWE-2,这是一款先进的编码模型,以极低的成本实现了与 Fable 5.1 和 GPT-Astra 相竞争的性能,利用新型强化学习来优化成本效益前沿。
Cognition的SWE-2
Cognition的SWE-2是一种基于Kimi K3进行后训练的新型编码模型,采用强化学习,在FrontierCode 1.1 Main上达到50.0%的性能,相比Fable 5.1节省64%的成本,同时与GPT-6 Astra具有竞争力。它现在可在Devin Desktop和CLI中使用。
@silasalberti: 对SWE-2在桌面和CLI中的需求史无前例。很高兴地宣布,我们能够确保额外的计算资源。我们正在……
Cognition宣布推出SWE-2,这是一款在性能上匹敌前沿模型且成本降低高达70%的AI模型。由于需求旺盛,我们将为Devin Cloud订阅者免费提供,直至10月8日。
Cognition的SWE-2在Terminal-Bench 2.1上达到92.8分
Cognition的SWE-2模型,基于Kimi K3进行后训练,在Terminal-Bench 2.1上获得92.8分,相较于前沿模型如Fable 5.1和GPT-6 Astra,提供具有竞争力的性能且成本更低。