模型

Cards List

我通过在10万个示例上训练一个40M连接器,为DeepSeek V4 Flash赋予了基础视觉能力

Reddit r/LocalLLaMA · 1小时前

作者在10万个样本上训练了一个40M参数的连接器,使DeepSeek V4 Flash获得基础的视觉能力,同时冻结语言模型和MoonViT图像编码器,展示了将纯文本MoE转变为基础VLM的低成本方法。

0 人收藏 0 人点赞

使用一天后,我觉得可以这么说:Muse-Glimmer-30B 在部分使用场景下终于以同等规模击败了 3.6-27B

Reddit r/LocalLLaMA · 2小时前

一位用户报告称,Muse-Glimmer-30B 在推理效率和常识知识方面优于 Qwen3.6-27B,但在编码方面稍弱,使其成为 24GB GPU 上的可行选择。

0 人收藏 0 人点赞

中国免费发布强大DNA筛查AI工具,助力对抗罕见病

Reddit r/ArtificialInteligence · 2小时前 缓存

中国BGI-Research的研究人员发布了OneGenome,这是一个开源AI系统,可解读基因突变用于临床诊断,性能优于DeepSeek-v4等通用大语言模型,旨在缩短罕见病患者的诊断之路。

0 人收藏 0 人点赞

@NousResearch:与 @bfl_ai 合作举办的 FLUX 3 短片竞赛已结束。感谢所有参赛者,我们观看了所有作品。以下是……

X AI KOLs Timeline · 4小时前 缓存

Nous Research 宣布与 Black Forest Labs 合作的 FLUX 3 短片竞赛结束,并强调 FLUX 3 Preview 现已在 Hermes Agent 上公开发布,并在 Nous Portal 付费订阅上免费提供 48 小时。

0 人收藏 0 人点赞

关于 Muse-Glimmer 推理轨迹与 qwen / gemma 模型明显不同的观察,以及想请教大家的问题

Reddit r/LocalLLaMA · 5小时前

一位用户分享了对 Muse-Glimmer 推理轨迹的观察,指出与 Qwen 和 Gemma 模型相比,其推理显得杂乱且重复,并向社区询问大家的体验。

0 人收藏 0 人点赞

随着AI主导的攻击增多,OpenAI推出新型网络模型

TechCrunch AI · 5小时前 缓存

OpenAI正在扩展其Daybreak网络防御服务,新增Blue和Red两个层级,并发布新的防御性网络模型GPT-5.6-Cyber。随着AI驱动的攻击增多,该模型仅对受信任的合作伙伴开放。

0 人收藏 0 人点赞

推出 Muse Glimmer

Simon Willison's Blog · 5小时前 缓存

Meta 推出 Muse Glimmer,一款基于 Apache 2.0 协议的全新 30B 开放权重模型,针对智能体任务完成、可靠工具使用和多步推理进行了优化。Simon Willison 使用 LM Studio 和 llm-coding-agent 在本地对其进行了测试。

0 人收藏 0 人点赞

@elonmusk:Grok 太棒了

X AI KOLs Timeline · 6小时前 缓存

埃隆·马斯克称赞 Grok 的图像生成能力,因为它正确描绘了一位数学家从亏格为1的物体中喝水的画面,而 ChatGPT 生成的则是亏格为2的甜甜圈马克杯。

0 人收藏 0 人点赞

Claude 现在在所有文本输出中嵌入不可见水印,并为文件添加签名元数据

Reddit r/singularity · 7小时前 缓存

Anthropic 正在为所有 Claude 文本输出添加不可见水印,并为受支持的文件添加带签名的 C2PA 来源元数据,这符合《欧盟人工智能法案》透明度行为准则,检测机制将在稍后详细说明。

0 人收藏 0 人点赞

Ling 3.0 Flash 在 Strix Halo 上的表现

Reddit r/LocalLLaMA · 7小时前

推文报告称,AMD Strix Halo 上的 Ling 3.0 Flash 在使用 ROCm 优化格式时明显快于 Qwen-122b,但指出在某些测试框架中工具调用功能异常。

0 人收藏 0 人点赞

我用大约200美元的成本,从零开始在20B tokens上训练了一个1B参数的LLM。

Reddit r/LocalLLaMA · 7小时前

一位开发者从零开始训练了一个1.1B参数的LLM,使用了200亿个token,成本约为200美元。该模型使用fineweb-edu进行预训练,并在OpenHermes上进行了LoRA微调。该项目包含开源代码、模型权重和一个演示网站。

0 人收藏 0 人点赞

OpenAI为网络防御者推出限制更少的新模型

Reddit r/ArtificialInteligence · 9小时前

OpenAI发布了一款限制更少的新AI模型,旨在帮助网络防御者,很可能以更少的限制增强安全运营。

0 人收藏 0 人点赞

Muse Spark 1.2 开源竟早于 Llama 4 Behemoth!!?

Reddit r/LocalLLaMA · 9小时前

Muse Spark 1.2 即将开源,考虑到大家关注的 Llama 4 Behemoth,这令人意外。作者评论了这一出乎意料的发布顺序。

0 人收藏 0 人点赞

在本地使用 OpenCode 测试 Muse Glimmer 的编码与智能体工作

Reddit r/LocalLLaMA · 9小时前

一位用户分享了在 llama.cpp 上使用 OpenCode 对 Muse Glimmer(通过 Unsloth 的 Q4 量化)进行本地测试,指出其性能低于 Qwen3.6 27B,但工具调用可靠。

0 人收藏 0 人点赞

可达 253 t/s - unsloth/Muse Glimmer 30B UD-Q5_K_M 在 5090 上

Reddit r/LocalLLaMA · 10小时前

在 RTX 5090 上对 unsloth 的 Muse Glimmer 30B 进行基准测试,采用推测解码,使用 DFlash 草稿模型和基于 GPU 的 argmax PR,最高可达 253 t/s,不过该 PR 仍是草稿状态。

0 人收藏 0 人点赞

@svpino:HuggingFace 链接:

X AI KOLs Timeline · 10小时前 缓存

TwiL-LM 是一个针对 SmolLM2-1.7B-Instruct 的参数高效 LoRA 适配器,专为形式逻辑和推理任务设计,在形式逻辑套件上取得了 0.361 的 macro-primary 分数。

0 人收藏 0 人点赞

@svpino:小巧、专业且开源的模型才是未来!TwiL-LM 模型系列现已在 HuggingFace 上发布,供 Tra…

X AI KOLs Timeline · 10小时前 缓存

TwiL-LM 是一系列小巧的专用开源模型,现已发布在 HuggingFace 上。其中 3B 版本在形式推理基准测试上优于 OpenAI 的 120B gpt-oss 模型,并且能在消费级硬件上高效运行。

0 人收藏 0 人点赞

@casper_hansen_:如果 Muse Spark 1.2 采用 Apache 2.0 许可证,并且确实是一个不靠刷榜的优秀模型,我就会填写道歉表格…

X AI KOLs Following · 11小时前 缓存

一位用户对 Meta 宣布开源 Muse Glimmer 以及即将推出的 Muse Spark 1.2 做出回应,称如果 Spark 1.2 采用 Apache 2.0 许可证且确实很出色,他就会道歉。

0 人收藏 0 人点赞

@NousResearch:Hermes 有十二个浏览器工具。浏览器使用模式将它们替换为单个工具,由 @browser_use 的 CLI 3.0 驱动。在……

X AI KOLs Timeline · 11小时前 缓存

Nous Research 的 Hermes 引入了浏览器使用模式,用基于 browser_use CLI 3.0 的单一脚本驱动方法取代了十二个浏览器工具,将 token 使用量削减 48-66%,且准确率无下降。

0 人收藏 0 人点赞

@sama:请考虑使用我们的模型来帮助防御你的系统

X AI KOLs Following · 11小时前 缓存

Eric Wallace 宣布发布 GPT-5.6-Cyber,这是一个专注于漏洞利用开发等网络安全任务的模型,并敦促 Sam Altman 考虑将其用于防御目的。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈