@ModelScope2022: Nanbeige4.2 @nanbeige 登陆 ModelScope,提供两个模型:- 28T-token Looped Transformer 基座 - 3B SFT+RL 智能体,用于…
摘要
Nanbeige4.2 已在 ModelScope 上发布,包含两个模型:一个 28T-token Looped Transformer 基座和一个 3B SFT+RL 智能体,据称在智能体基准测试中优于 Qwen3.5-9B 和 Gemma4-12B。
查看缓存全文
缓存时间: 2026/07/22 22:37
🚀 Nanbeige4.2 @nanbeige 登陆 ModelScope,发布两款模型:
- 28T 词元的环状 Transformer 基础模型
- 3B 参数 SFT+RL 智能体,支持工具调用、编程、推理、办公与深度研究
📊 团队报告在智能体基准测试中超越 Qwen3.5-9B 和 Gemma4-12B。 🤖 https://t.co/O80cFFbG80 https://t.co/YnhPK5R3L4
相似文章
Nanbeige/Nanbeige4.2-3B
Nanbeige4.2-3B 是一款紧凑型智能体模型,采用循环Transformer架构,在3B规模下展现出强大的智能体任务和推理基准性能,超越了Qwen3.5-9B和Gemma4-12B等更大规模的模型。
新模型:Nanbeige4.2-3B(Looped Transformer,性能超越4倍规模模型)
Nanbeige4.2-3B是一个新的3B参数AI模型,采用Looped Transformer架构,性能超越其4倍规模的模型。
@xdotli: ICYMI Nanbeige 4.1,一个由中国Indeed发布的3B模型,性能优于Qwen3-30b-A3b + Qwen 3.5 4b。它可以完成长…
Nanbeige 4.1,一个来自中国Indeed的3B模型,在需要600+工具调用的任务上性能优于更大的Qwen模型。
@ModelScope2022: Qwen-AgentWorld 刚刚在 ModelScope 上发布了两项更新!一个开放的 35B 总参数量/3B 激活参数的 MoE 世界模型,支持 256K 上下文…
Qwen-AgentWorld 发布了一个开放的 35B 总参数量/3B 激活参数的 MoE 世界模型,支持 256K 上下文,同时推出了一个涵盖 7 个领域的基准测试,在 AgentWorldBench 上取得了最先进的性能。
两种不同规模的智能体AI:Nanbeige4.2-3B与Laguna S2.1(9分钟阅读)
比较了两个用于智能体工作负载的新AI模型:采用循环Transformer架构的紧凑型Nanbeige4.2-3B,以及大型混合专家模型Laguna S2.1,两者均在Hugging Face上发布。