@levie: k3 模型权重已到达
摘要
Kimi.ai 发布了 Kimi K3 的模型权重和技术报告,这是一个 2.8T 参数的 MoE 模型,具有原生视觉理解和 1M token 上下文窗口,声称每单位计算智能提升 2.5 倍。
查看缓存全文
缓存时间: 2026/07/27 15:54
K3 模型权重已发布
Kimi.ai (@Kimi_Moonshot): 发布 Kimi K3 的模型权重和技术报告。
Kimi K3 是我们能力最强的模型:一个 2.8T MoE 模型,具备原生视觉理解能力和 1M token 的上下文窗口。
新的模型架构:每单位计算量的智能水平提升 2.5 倍,而不仅仅是增加参数量。
此外
相似文章
发布 Kimi K3 模型权重和技术报告(2分钟阅读)
Kimi Moonshot 发布了 Kimi K3,这是一个 2.8 万亿参数的多模态模型,拥有 100 万 token 的上下文窗口,以及 Kimi Delta Attention 和 Attention Residuals 等架构创新。公司声称其效率显著提升,在内部基准测试中超越了 Claude Opus 4.8 和 GPT-5.5。
Kimi K3 权重今天发布。我们本周将在A100、H200和B300上部署,而A100的内存需求已经显得很紧张了
Kimi K3 权重今日发布。该模型拥有2.8万亿参数、MoE架构(896个专家)、100万上下文、视觉能力以及MXFP4量化。在A100和H200上部署需要多节点,但单个B300节点即可容纳。预计本周末将公布各GPU配置下的tok/s、ttft及每百万token成本等基准数据。
Kimi K3 今日开放权重——真的有人在用中国AI模型取代Claude或Codex吗?
月之暗面(Moonshot AI)开放了Kimi K3的模型权重,这是一个3T参数的前沿模型,专注于长周期编程、仓库级上下文和工具使用,支持自托管和微调。
Kimi-K3 技术报告 [pdf]
MoonshotAI发布了Kimi-K3,一个拥有2.8万亿参数的开源权重多模态智能体模型,具备100万token的上下文窗口,基于全新的Kimi Delta Attention和Attention Residuals架构,实现了显著的扩展性改进。
@seclink: 官方页面地址: https://huggingface.co/moonshotai/Kimi-K3… 这是 Moonshot AI(月之暗面)发布的 2.8 万亿参数(MoE 架构,激活约 104B)开源权重模型,支持原生多模态(文本+图…
Moonshot AI releases Kimi K3, a 2.8 trillion parameter open-weight MoE model with native multimodal capabilities and a 1 million token context window, claiming it as the world's first open 3T-class model.