@thesupermanmx: 中国刚刚改变了游戏规则。他们发布了一个开源模型,仅消耗你们最喜欢的美国模型1%的token…
摘要
中国发布了Ling-2.6-1T,一个1万亿参数的开源模型,在256K上下文窗口中SWE-bench上达到72.2%,声称高效且兼容Claude Code。
查看缓存全文
缓存时间: 2026/07/16 02:02
中国刚刚改变了游戏规则。
他们发布了一款开源模型,仅消耗你钟爱的美国模型1%的token数量。
它叫Ling-2.6-1T,在智能体编程方面与Claude和GPT不相上下。
→ 1万亿参数
→ SWE-bench Verified 上 72.2%
→ 256K上下文窗口
→ 在OpenRouter上免费使用
→ 可直接接入Claude Code
100%开源。
相似文章
@Chinazhidx:蚂蚁集团刚刚发布了Ling-3.0-flash • 124B MoE • 5.1B 活跃参数/令牌 • 256K 上下文,可扩展至1M,仅八分之一……
蚂蚁集团发布了Ling-3.0-flash,这是一个124B MoE模型,每个令牌5.1B活跃参数,256K上下文可扩展至1M,在大多数基准测试中匹配或超越其1T旗舰模型。
@edandersen: 中国又发布了一个开源编程AI大模型“Ornith”。35B版本可在大型GPU上本地运行,在我使用场景中击败了Qwen3.6……
中国发布了一个名为Ornith的开源编程AI大模型,35B版本击败了Qwen3.6,397B版本基准测试接近Claude Opus 3.7。
@0x0SojalSec: 最终观点:腾讯最近发布了一个295B参数的模型,每个token仅激活21B参数。而大多数实验室仍在……
腾讯发布了Hy3,一个295B参数的MoE模型,每个token激活21B参数,在代理编程和工具使用任务上与更大的模型相竞争,并提供了Apache 2.0权重。
@ying11231:在TPU上令人印象深刻的性能。
LMSYS Org 的一篇博客文章详细介绍了使用 SGLang-JAX 在 TPU v7x 上优化 Ling-2.6-1T(一个 1 万亿参数的混合 MoE 模型),通过单个 Pallas 内核将 MoE 数据移动隐藏在计算之后,从而实现高效的推理。
@thesupermanmx: 中国刚刚开源了一款OCR模型,可一次性转录整本书。它名为Unlimited OCR。构建于…
中国开源了Unlimited OCR,这是一款基于DeepSeek OCR的OCR模型,可以一次性转录整本书,内存使用恒定,在标准解析基准上达到93%的准确率。