Cactus Compute 发布 Needle 2,这是一个45M参数的智能体LLM,压缩为14MB二进制文件,适用于手机、可穿戴设备、智能家居和机器人,在树莓派5上实现每秒500+ tokens,运行内存仅28MB。
OpenAI 正在扩展 Daybreak,新增两个访问层级(Blue 和 Red),并推出 GPT-5.6-Cyber,这是一款专用训练的网络安全模型,可显著减少对授权防御性安全工作的拒绝。
OpenAI强调在真实世界的漏洞研究中使用GPT-5.6-Cyber,包括发现Chrome V8引擎等开源软件中此前未知的漏洞。
Cactus 发布了 Needle 2,这是一款面向手机、可穿戴设备、智能家居设备和机器人的 14MB 智能体 LLM,在低端硬件上实现快速推理,并支持结构化提取和微调。
据报道,GPT-5.6 Sol 在无工具条件下以 pass@5 达到 ZeroBench 人类基线,这意味着在基准测试中五次尝试中至少有一次成功。
NVIDIA 宣布推出 Magpie 多语言 TTS,这是一个开放权重的文本转语音模型,支持 12 种语言,可通过 NVIDIA NIM 进行低延迟部署,用于构建生产级语音代理。
Meta发布了Muse Glimmer,这是一个开放权重的300亿参数AI模型,旨在消费级硬件上本地运行强大的个人智能体,为马克·扎克伯格关于分布式个人超级智能的愿景提供了具体的一瞥。
用户报告称,30B 参数的 Muse Glimmer 使用 Q4_K_XL 量化和 DFlash,在单张 RTX 3090 上即可运行,并支持完整的 256k 上下文,速度达到 64-124 tok/s,且长上下文检索完美,与同类模型不同。
Meta introduced Muse Glimmer, an open-weight 30B-parameter model distilled from Muse Spark for on-device agentic workflows, with ExecuTorch now supporting running it on NVIDIA GPUs and Apple silicon.
一位用户对新的AI模型发布表示兴奋,并推测 Qwen 3.8 27B 能否与 Muse Glimmer 30B 竞争。
腾讯混元 Hy3 在发布第一周就登顶 OpenRouter,总参数 295B,激活参数 21B,并且通过 WorkBuddy 免费提供至 2026 年 8 月 31 日。
Meta 开源了 Muse Glimmer,这是一个采用 Apache 2.0 协议的 30B 参数多模态 Agent 模型,针对本地工具使用和编码进行了优化,通过 4-bit 量化压缩至 20GB 以下,可在消费级 GPU 上运行。扎克伯格还承诺开源 Muse Spark 1.2 的权重,并设立 10 亿美元社区基金用于数据中心所在地区。
Unsloth 发布了 Meta 的 Muse Glimmer 30B 模型的 GGUF 量化版本,专为本地智能体任务设计,支持多模态输入、工具使用和多步推理。
Meta宣布将开源其Muse Spark 1.2和Muse Glimmer 30B模型,称其为自Llama 4和3以来最大的开放权重。
Meta 宣布推出新的开源模型 Muse Glimmer 30B,采用 Apache-2.0 许可证。
Meta 发布 Muse Glimmer,这是一款 30B 开放权重多模态模型,专为本地智能体工作流优化,采用宽松的 Apache 2.0 许可证,支持 4 位量化、推测解码,并提供广泛的生态系统集成。
Meta推出Muse Glimmer,一个采用宽松许可的30B参数模型,专为本地智能体工作流、编码和工具使用而优化,权重已在Hugging Face上发布。