标签
面向 Minimax-h3-Turbo 视频生成模型的 Hugging Face 页面,提供通过 Diffusers 及 Colab/Kaggle 笔记本使用该模型的说明。
a16z 强调开源权重模型的重要性,认为成本和掌控权是关键,专有 API 可能太贵且不可控。
对开放权重AI辩论的分析:支持者认为它使AI民主化,而批评者则指出滥用风险;多家大型科技公司签署了支持开放权重的公开信,而Anthropic和特朗普政府的部分成员仍保持谨慎。
DeepSeek官方宣布API价格大幅上调,在推出DeepSeek-V4-Flash-0731后不久,便结束了以超低价格访问接近前沿模型的时代。
Maxime Labonne 强调了 LFM2.5-2.6B 的早期微调成果,同时 Bad Theory Labs 发布了两个开放权重模型:BTL-4 35B(前沿智能体推理模型)和 Macaw 2.7B(设备端 Mac 智能体),在 BFCL v4 上表现突出。
微软发表了一篇政策文章,认为开放权重AI模型对美国AI领导地位、竞争和广泛经济扩散至关重要,同时承认其风险。
DeepSeek V4 Flash 已成为 Ollama 在 token 使用量上增长最快的模型,并且是本周 OpenRouter 上最受欢迎的模型,现在可通过多个提供商在 Pi 中使用。
评论推文称,Anthropic 和 OpenAI 只需开放权重即可解决开放权重之争,回应了特朗普顾问告知 AI 公司不会对开放权重模型进行安全测试的消息。
Mistral AI发布了Shieldstral,这是一个3B开放权重的多模态安全分类器,它将内容审核视为一种策略自适应的问答任务,在无需重新训练的情况下,性能优于其规模7倍的模型。
Aaron Levie 对阿里巴巴发布的 Qwen3.8-Max 做出回应,这是一个 2.4T 参数的开源权重模型,并讨论了开源模型发布对整个行业的影响。
MiniMax发布了开放权重的H3视频模型,这是首个登顶AI视频排名的开放模型,在视频编辑中排名第一,在文本生成视频中排名第二。该33B参数模型可处理文本、图像、视频和音频,但部分组件如2K分辨率和H3-Context-IR仍未开放。
Athena 是 markopolo_ai 对 Qwen3-4B 进行 LoRA 微调得到的 4B 参数模型,在 OPeRA 购物行为预测基准上击败了 GPT-5.6 和 Claude Opus 4.8,为预测购物者行为提供了一款可自行托管的专用模型。
Composio 在困难的智能体任务上测试了 DeepSeek v4 flash、GLM 5.2 和 Kimi K3,发现 DeepSeek 速度最快、成本最低,成功率与其他模型大致持平,而前沿模型仍稍稍领先。
一篇分析文章,认为中国的开源AI模型正在缩小与美国闭源模型的性能差距,并且尽管美国有所顾虑,开放路线将塑造AI的未来。
一条推文,按从最小到最大的顺序排列最佳开放权重AI模型,突出开放权重社区的活力。
Hugging Face首席执行官Clément Delangue表示,中国凭借开放权重模型正在赢得AI竞赛,并可能在年底前赶上美国前沿实验室,他呼吁以开放协作取代封闭式开发。
一条推文强调,像Qwen3.8-Max这样的主要开源模型可能使用线性注意力,并引用了阿里巴巴宣布即将发布Qwen3.8-Max(2.4万亿参数)和Qwen3.8-27B开放权重版本的消息。
MiniMax H3 是新一代开放权重视频模型,能够根据文本、图像、视频或音频生成带有原生立体声的 2K 视频,并在发布当天就获得了 ComfyUI 支持及优化,使其能够在消费级 GPU 上运行。
AI9Stars 发布了 G9v3-39A5B,这是一个开放权重的 39B MoE 语言模型,拥有 5 个活跃专家,面向推理、编码和助手任务,采用 Apache 2.0 许可。
阿里巴巴发布 Qwen3.8-Max,一个 2.4T 参数的 MoE 前沿模型,开放权重将于下周推出,声称自主运行16天,成本显著低于 GPT-5.6 Sol 和 Claude Fable 5。