第二个 K3 的权重发布了,我正在下载完整的 FP16 并藏在床垫里
摘要
一位用户发推文说正在下载第二个 K3 模型的完整 FP16 权重并储存起来,开玩笑地让其他人别锁门。
请别锁门,这样我就能轻松进入你家了。
相似文章
Kimi K3 权重将于27日发布。
Kimi K3 模型权重将于27日发布。
@neural_avb: 哈哈,有人将 Qwen3.6-35B-A3B 的权重去除了审查并发布到 Hugging Face 上。上个月下载量达300万。显然从未…
有人将 Qwen3.6-35B-A3B 模型权重去除了审查并发布到 Hugging Face 上,上个月累计下载量达300万。据报道,该模型从不拒绝任何提示。
稀疏设计(5分钟阅读)
Moonshot的Kimi K3是一个2.8万亿参数的开源权重模型,拥有896个专家(每个token激活16个),体现了在保持活跃计算不变的情况下扩大总参数的趋势,并使用注意力压缩来减少KV缓存大小,使得前沿推理更容易实现,但存储成本较高。
@0xkeenz: 今天验证了一个纠结很久的事情 Qwen3.6 27B 官方原模型是 BF16 权重,但一些量化版本,比如 cyankiwi / Unsloth,会把部分关键权重转换成 FP16 而不是保持 BF16。BF16 和 FP16 在存储占用上是…
作者验证了Qwen3.6 27B模型权重从BF16转换为FP16不会导致数值溢出,并指出FP16尾数精度更高,解释了量化版本为何使用FP16而非保持BF16。
还有人完全忽略这些大规模的“开放权重”发布吗?
一位社区成员表示,像 GLM-5.2(7530 亿参数)这样的巨大开放权重模型由于极高的显存需求,实际上无法在本地自托管,并认为这一趋势背离了本地 AI 社区的初衷,令人沮丧。