综合热度、重要程度与时效排序的热门资讯。
腾讯混元 Hy3 在发布第一周就登顶 OpenRouter,总参数 295B,激活参数 21B,并且通过 WorkBuddy 免费提供至 2026 年 8 月 31 日。
太空镜初创公司 Reflect Orbital 计划发射反射阳光以获取太阳能的卫星,这可能扰乱天文学并带来眼睛损伤风险,引发了天文学家的警告。
Meta 发布 Muse Glimmer,这是一款 30B 开放权重多模态模型,专为本地智能体工作流优化,采用宽松的 Apache 2.0 许可证,支持 4 位量化、推测解码,并提供广泛的生态系统集成。
Unsloth 发布了 Meta 的 Muse Glimmer 30B 模型的 GGUF 量化版本,专为本地智能体任务设计,支持多模态输入、工具使用和多步推理。
一篇名为 TEPA 的新预印本将记忆有效性视为一等状态,当新证据与旧先例冲突时,撤销过时的先例,同时保留审计轨迹。在完全反转实验中,它优于仅追加和后写胜出,但结果尚未被独立复现。
Meta推出Muse Glimmer,一个采用宽松许可的30B参数模型,专为本地智能体工作流、编码和工具使用而优化,权重已在Hugging Face上发布。
Meta 宣布推出新的开源模型 Muse Glimmer 30B,采用 Apache-2.0 许可证。
Meta宣布将开源其Muse Spark 1.2和Muse Glimmer 30B模型,称其为自Llama 4和3以来最大的开放权重。
Meta 正准备发布其最新基础模型 Muse Spark 1.2 的权重,该模型将可供广泛使用。
一篇博客文章,介绍了一种在 Linux 上使用 Bubblewrap 的轻量级沙箱方法,其中名为 'box' 的脚本以只读方式共享主机文件系统,并以可读写方式共享当前目录,从而无需单独发行版即可在隔离环境中运行主机二进制文件。
据报道,Hark Handoff 在多个基准测试中优于 GPT-5.5 和 Opus 4.8,成本降低 90%,它使用 SFT 和基于 GRPO 的异步强化学习,基础模型未公开。作者对计算机使用代理的延迟表示怀疑,但对演示持乐观态度。
作者提出了合成查询探测(Synthetic Query Probing),这是一种简单而有效的方法,通过比较不同嵌入模型之间的相似度匹配分数,而非原始嵌入空间,来比较不同的嵌入模型。论文展示了如Ada和Titan等模型之间的非线性关系,为更换嵌入模型和设定检索阈值提供了实用指导。
这篇文章描述了一个内部的 Agent Run Dashboard,用于跟踪 AI 智能体的运行情况、质量评分和工作流性能,提供对人机协作的可见性,并表明这种方法可以应用于软件开发之外。
Brian Tarricone 反思了在开源开发中使用大语言模型的伦理权衡,然后解释了他如何在构建 xfwl4 时使用 Claude 进行研究和规划。
内存定价提升了三星和SK海力士芯片工程师的薪酬和社会价值,员工平均获得约40万至50万美元的大额奖金。