标签
一个故意为空的16.5万亿参数模型被上传到Hugging Face,暴露了参数量仅由safetensors头部计算得出,且Xet的内容定义去重极大减少了上传带宽,但存储配额仍按完整逻辑大小计费。
一篇评论认为,Anthropic和OpenAI的优势在于规模而非秘密配方,随着参数量增加,DeepSeek V4和Kimi K3等开源模型正在迎头赶上。
LongCat-2.0是一个大规模混合专家(MoE)模型,总参数量1.6万亿,激活参数量480亿。