作者在10万个样本上训练了一个40M参数的连接器,使DeepSeek V4 Flash获得基础的视觉能力,同时冻结语言模型和MoonViT图像编码器,展示了将纯文本MoE转变为基础VLM的低成本方法。
一位用户报告称,Muse-Glimmer-30B 在推理效率和常识知识方面优于 Qwen3.6-27B,但在编码方面稍弱,使其成为 24GB GPU 上的可行选择。
中国BGI-Research的研究人员发布了OneGenome,这是一个开源AI系统,可解读基因突变用于临床诊断,性能优于DeepSeek-v4等通用大语言模型,旨在缩短罕见病患者的诊断之路。
Nous Research 宣布与 Black Forest Labs 合作的 FLUX 3 短片竞赛结束,并强调 FLUX 3 Preview 现已在 Hermes Agent 上公开发布,并在 Nous Portal 付费订阅上免费提供 48 小时。
一位用户分享了对 Muse-Glimmer 推理轨迹的观察,指出与 Qwen 和 Gemma 模型相比,其推理显得杂乱且重复,并向社区询问大家的体验。
OpenAI正在扩展其Daybreak网络防御服务,新增Blue和Red两个层级,并发布新的防御性网络模型GPT-5.6-Cyber。随着AI驱动的攻击增多,该模型仅对受信任的合作伙伴开放。
Meta 推出 Muse Glimmer,一款基于 Apache 2.0 协议的全新 30B 开放权重模型,针对智能体任务完成、可靠工具使用和多步推理进行了优化。Simon Willison 使用 LM Studio 和 llm-coding-agent 在本地对其进行了测试。
埃隆·马斯克称赞 Grok 的图像生成能力,因为它正确描绘了一位数学家从亏格为1的物体中喝水的画面,而 ChatGPT 生成的则是亏格为2的甜甜圈马克杯。
Anthropic 正在为所有 Claude 文本输出添加不可见水印,并为受支持的文件添加带签名的 C2PA 来源元数据,这符合《欧盟人工智能法案》透明度行为准则,检测机制将在稍后详细说明。
推文报告称,AMD Strix Halo 上的 Ling 3.0 Flash 在使用 ROCm 优化格式时明显快于 Qwen-122b,但指出在某些测试框架中工具调用功能异常。
一位开发者从零开始训练了一个1.1B参数的LLM,使用了200亿个token,成本约为200美元。该模型使用fineweb-edu进行预训练,并在OpenHermes上进行了LoRA微调。该项目包含开源代码、模型权重和一个演示网站。
Muse Spark 1.2 即将开源,考虑到大家关注的 Llama 4 Behemoth,这令人意外。作者评论了这一出乎意料的发布顺序。
一位用户分享了在 llama.cpp 上使用 OpenCode 对 Muse Glimmer(通过 Unsloth 的 Q4 量化)进行本地测试,指出其性能低于 Qwen3.6 27B,但工具调用可靠。
在 RTX 5090 上对 unsloth 的 Muse Glimmer 30B 进行基准测试,采用推测解码,使用 DFlash 草稿模型和基于 GPU 的 argmax PR,最高可达 253 t/s,不过该 PR 仍是草稿状态。
TwiL-LM 是一个针对 SmolLM2-1.7B-Instruct 的参数高效 LoRA 适配器,专为形式逻辑和推理任务设计,在形式逻辑套件上取得了 0.361 的 macro-primary 分数。
TwiL-LM 是一系列小巧的专用开源模型,现已发布在 HuggingFace 上。其中 3B 版本在形式推理基准测试上优于 OpenAI 的 120B gpt-oss 模型,并且能在消费级硬件上高效运行。
一位用户对 Meta 宣布开源 Muse Glimmer 以及即将推出的 Muse Spark 1.2 做出回应,称如果 Spark 1.2 采用 Apache 2.0 许可证且确实很出色,他就会道歉。
Nous Research 的 Hermes 引入了浏览器使用模式,用基于 browser_use CLI 3.0 的单一脚本驱动方法取代了十二个浏览器工具,将 token 使用量削减 48-66%,且准确率无下降。
Eric Wallace 宣布发布 GPT-5.6-Cyber,这是一个专注于漏洞利用开发等网络安全任务的模型,并敦促 Sam Altman 考虑将其用于防御目的。