deepreinforce

标签

Cards List
#deepreinforce

DeepReinforce 发布 Ornith-1.0 开源编程模型(2分钟阅读)

TLDR AI · 2026-06-26 缓存

DeepReinforce 开源了 Ornith-1.0,这是一系列自我改进的编程模型,参数从 9B 到 397B 不等,基于 Gemma 4 和 Qwen 3.5 基础模型训练,采用了一种新颖的强化学习方法,能够学习生成自己的脚手架。

0 人收藏 0 人点赞
#deepreinforce

@rohanpaul_ai: 又一个精彩的开源发布。DeepReinforce刚刚发布了Ornith-1.0,一个MIT许可的开源智能编码LLM系列…

X AI KOLs Timeline · 2026-06-25 缓存

DeepReinforce发布了Ornith-1.0,这是一个MIT许可的开源智能编码LLM系列,包含一个397B MoE模型,该模型在SWE-Bench和Terminal-Bench上超越了Claude Opus 4.7,采用了新颖的自我改进训练策略。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈