标签
Hugging Face 正在探索以约 130 亿美元估值出售,引发对开源模型政策可能变化的担忧,原因是第三方投资和盈利关注。
一位用户对 Meta 宣布开源 Muse Glimmer 以及即将推出的 Muse Spark 1.2 做出回应,称如果 Spark 1.2 采用 Apache 2.0 许可证且确实很出色,他就会道歉。
谷歌DeepMind的新论文SkillSmith将前缀键值缓存视为一种输入模态,在推理时把文本知识与现有权重组合成冻结的Gemma 3 4B模型的新前缀缓存,从而无需针对特定目标的训练运行即可改进适应能力。
谷歌DeepMind推出SkillSmith,将模型权重视为LLM可以原生推理的额外模态,从而实现指令引导的参数化合成,在推理时组合技能。该方法优于仅文本和仅权重的基线方法。
一篇将当今AI模型权重出口管制与1990年代密码战争进行对比的文章,援引OpenAI的封禁漏洞以及防御者使用中国开源权重模型的事例,主张限制措施反而损害安全。
Ernos Labs 推出一个免费的自托管存档,用于保存开放AI模型权重,强调去中心化和非单一实体所有。
NVIDIA 推出了 ModelExpress,该工具利用 GPU 到 GPU 的 RDMA 传输和优化的存储流式传输,加速了跨 GPU 集群的模型制品分发,将 DeepSeek-V4 Pro 等大型模型的启动时间从 8 分钟缩短至不到 2 分钟。
一位用户发推文说正在下载第二个 K3 模型的完整 FP16 权重并储存起来,开玩笑地让其他人别锁门。
IEEE Spectrum报道了高带宽闪存(HBF),这是一种新型内存技术,通过使用高带宽内存(HBM)封装技术堆叠NAND闪存芯片,大幅提升读取带宽,实现对LLM模型权重的高效存储。首批产品预计约一年内推出。
一种无需量化或重新训练即可从 GLM-5.2(753B 权重)中移除 423 GB 的技术,通过在 VRAM 中保持权重压缩状态实现逐比特精确压缩。
作者验证了Qwen3.6 27B模型权重从BF16转换为FP16不会导致数值溢出,并指出FP16尾数精度更高,解释了量化版本为何使用FP16而非保持BF16。
HASE 是一个强化学习框架,它在统一的智能体过程中协同进化模型权重、任务解决方案以及流程组件(引导与评估),使单个8B参数的模型在文本分类和阿尔法因子挖掘任务上能够匹配更大系统的性能。
LingBot-Vision引入了掩码边界建模用于自监督预训练,在1.1B参数下NYUv2线性探测上达到0.296 RMSE,而DINOv3-7B为0.309,虽然在ImageNet上表现稍逊;已发布四种尺寸的权重。
Alex Karp 认为,对企业来说,真正的 AI 安全意味着对数据和模型权重的控制,并批评 Anthropic 通过推出与客户竞争的产品来捕获下游价值的策略。文章将开放权重模型之争定位为商业问题而非安全问题。
一条推文宣布了一个基于种子的网站,用于下载开放LLM模型权重,将其定位为开放模型的海盗湾替代品。
Clement Delangue 发推文强调拥有AI模型权重的重要性,指出如果你不拥有它们,你就没有拥有你的大脑。
谷歌顶尖AI研究人员,包括Shazeer和John Jumper,正跳槽到竞争对手,表明真正的资产是人才而非模型权重。文章建议不要依赖任何单一的AI模型提供商。
关于2位量化感知训练(QAT)在更大规模MoE模型上的潜力的讨论,比较其与4位QAT及三元LLM的性能,并探讨在消费级硬件上的可行性。