@natolambert: Thinky 是一款约 1T 参数、41B 激活参数、Apache-2.0 许可的模型。基准测试相比 Nemotron Ultra(55B 激活参数)有显著提升,并…
摘要
Thinky 是一款约 1T 参数的混合专家模型,激活参数 41B,采用 Apache-2.0 许可发布。它在美国模型中取得了新的最佳成绩,在基准测试上相比 Nemotron Ultra 有所提升,并支持全模态输入。
查看缓存全文
缓存时间: 2026/07/16 22:19
Thinky 模型,约1万亿参数,410亿激活参数,Apache-2.0许可证。 基准测试明显优于 Nemotron Ultra(550亿激活参数),新的最佳美国模型,支持全模态输入。 在智能体基准测试上略落后于 GLM 5.2,在多模态上略落后于 Kimi K 2.6。 超级激动人心!感谢 @johnschulman2 和团队 https://t.co/NtkO7vmfSy
相似文章
Nemotron 3 Ultra。5500亿参数,550亿活跃参数,100万token上下文窗口
NVIDIA发布Nemotron 3 Ultra,一个庞大的5500亿参数混合专家模型,具有550亿活跃参数和100万token的上下文窗口。
VibeThinker: 在推理上击败Opus 4.5的3B参数模型,采用新颖的SFT+GRPO方法
本技术报告介绍了VibeThinker-3B,一个3B参数的密集模型,在AIME26和LiveCodeBench等基准测试上实现了前沿水平的推理性能,通过结合基于课程的SFT、多领域RL和离线自蒸馏,匹配或超越了DeepSeek V3.2和GLM-5等更大的模型。
@heyshrutimishra:NVIDIA 刚刚发布了 Nemotron 3.5 Lightning,300 亿参数,只有 30 亿激活,专为执行层打造…
NVIDIA 发布了 Nemotron 3.5 Lightning,这是一个拥有 300 亿参数的 MoE 模型,只有 30 亿激活参数,针对智能体执行任务进行了优化。它声称在保持 OpenMDW-1.1 完全开源的同时,实现更快、更便宜的工具调用和智能体执行。
腾讯Hy发布新开源模型:Hy3(总参数量295B,激活参数21B,Apache 2.0)
腾讯发布Hy3,一款总参数量295B的混合专家模型,激活参数21B,采用Apache 2.0许可证,在多项基准测试中表现强劲,性能可媲美更大的旗舰模型。
VibeThinker-3B:这是什么黑科技?在MathQA上表现如同拥有约300亿参数
VibeThinker-3B是一个仅有30亿参数的小模型,却在MathQA基准测试中达到了堪比约300亿参数模型的性能,展现了极高的效率。