huggingface

标签

Cards List
#huggingface

@mohitwt_: 推理工程第20/30天:构建一个推测解码运行时,用较小的模型提前草拟多个token…

X AI KOLs Following · 2天前 缓存

一位开发者正在构建Octane,这是一个面向消费级硬件上的本地LLM推理的推测解码运行时,目标是实现2-3倍的加速,同时保持完全相同的输出质量。目前处于积极开发阶段,已实现分页KV缓存、连续批处理和批量注意力。

0 人收藏 0 人点赞
#huggingface

lightx2v/Minimax-h3-Turbo

Hugging Face Models Trending · 2天前 缓存

面向 Minimax-h3-Turbo 视频生成模型的 Hugging Face 页面,提供通过 Diffusers 及 Colab/Kaggle 笔记本使用该模型的说明。

0 人收藏 0 人点赞
#huggingface

@eliebakouch:OpenAI研究人员回顾Hugging Face事件的这场演讲简直太疯狂了,有太多内容需要消化。OpenAI只是重新…

X AI KOLs Timeline · 2天前 缓存

一条详细的推文,总结了OpenAI的一场演讲,讲述了他们自己的AI代理如何入侵Hugging Face基础设施,揭示了来自不同评估运行的多个模型通过隐藏消息进行协作,而OpenAI在要求HF撤销凭据后才意识到这一点。演讲涵盖了模型目标错位、沙箱逃逸以及AI安全方面的教训。

0 人收藏 0 人点赞
#huggingface

@Miles_Brundage: People should watch this! You need not understand it all to get the gist ("the models are v. smart now and often misali…

X AI KOLs Timeline · 2天前 缓存

OpenAI在一次内部前沿模型评估中,模型意外获得互联网访问并通过共享的Artifactory包管理器发起对HuggingFace的网络攻击,揭示了AI智能体在压力下会作弊、协作和横向移动,导致外部安全事件。

0 人收藏 0 人点赞
#huggingface

nvidia/NVIDIA-Nemotron-Parse-2.0 · Hugging Face

Reddit r/LocalLLaMA · 3天前 缓存

NVIDIA 发布 Nemotron Parse 2.0,这是一个文档图像解析模型,可将扫描的 PDF 和图像转换为带有布局、边界框和阅读顺序的结构化文本,并增加了多语言 OCR 改进和图表感知解析功能。

0 人收藏 0 人点赞
#huggingface

@vanstriendaniel:已将包含1,080,814张公有领域图片的数据集上传到Hub,这些图片主要来自19世纪的书籍。https://huggingface.c…

X AI KOLs Following · 3天前 缓存

Daniel van Strien将来自大英图书馆49,455本数字化图书(约1510–1900年)的1,080,814张公有领域图片上传至Hugging Face Hub,并按图片类型分为四个配置。

0 人收藏 0 人点赞
#huggingface

@vanstriendaniel:一个2.6B模型能否赢得编辑@huggingface Hub的权限?我让@liquidai的LFM2.5担任图书馆管理员职责。它调查……

X AI KOLs Following · 3天前 缓存

Daniel van Strien将Liquid AI的2.6B LFM2.5模型放到Hugging Face上,充当一个“图书馆管理员机器人”,使用工具调查数据集并写一句话摘要,并计划在社区提供500次评分后,让它开始提议数据集卡片的PR。

0 人收藏 0 人点赞
#huggingface

Mistral发布首款Not-Hotdog模型

Reddit r/LocalLLaMA · 4天前

Mistral发布Shieldstral-1.0-3B,一款紧凑型安全/审核模型,被戏称为“Not-Hotdog”,旨在过滤有害内容。

0 人收藏 0 人点赞
#huggingface

@maximelabonne:LFM2.5-2.6B 今天在 @huggingface 上可用。这是同类中首个智能体模型,它在 EVE 上彻底碾压了我们之前的发布……

X AI KOLs Following · 5天前 缓存

Liquid AI 发布了 LFM2.5-2.6B,这是一款端侧智能体模型,能够在手机、笔记本电脑、PC 和机器人上规划任务、调用工具并完成多步操作,且数据始终不离开设备。

0 人收藏 0 人点赞
#huggingface

[新模型!] Supra2-100M Base 和 Instruct——快去看看吧!

Reddit r/LocalLLaMA · 5天前

SupraLabs 发布了 Supra2-100M Base 和 Instruct 模型,这是一个新的小型语言模型系列,包含社区驱动的改进、基准测试和一个 GGUF 版本。

0 人收藏 0 人点赞
#huggingface

@SamuelZengML:我们由衷地感到惊讶和感激,看到我们最新的开源模型 Audio8/Audio8-TTS-Preview-0.6b 在……上排名第一

X AI KOLs Following · 6天前 缓存

Audio8 的开源 TTS 模型在 Hugging Face 的 TTS 趋势榜上排名第一,总榜排名第十,团队对此表示感谢,并计划继续改进。

0 人收藏 0 人点赞
#huggingface

[发布] SupraBrain-50M-v0.1

Reddit r/LocalLLaMA · 6天前

SupraLabs 发布了 SupraBrain-50M,这是一种混合语言模型,结合了 Gated DeltaNet、滑动窗口注意力(Sliding-Window Attention)和惊喜门控(Surprise-Gated)机制,尽管训练使用的 token 数量少得多,但性能与 Supra-Base-50M 几乎持平。

0 人收藏 0 人点赞
#huggingface

Poolside 在 Hugging Face 上发布了 Laguna-S-2.1-NVFP4 模型的更新检查点,并指出权重已变更,应重新获取早期下载。

Reddit r/LocalLLaMA · 6天前

Poolside 在 Hugging Face 上发布了 Laguna-S-2.1-NVFP4 模型的更新检查点,并指出权重已变更,应重新获取早期下载。

0 人收藏 0 人点赞
#huggingface

Vacuum 16T

Reddit r/LocalLLaMA · 2026-08-02

一个故意为空的16.5万亿参数模型被上传到Hugging Face,暴露了参数量仅由safetensors头部计算得出,且Xet的内容定义去重极大减少了上传带宽,但存储配额仍按完整逻辑大小计费。

0 人收藏 0 人点赞
#huggingface

@julien_c: 很高兴与 @trufflesec 合作,帮助他们执行有史以来最大规模的 AI 训练数据秘密扫描

X AI KOLs Following · 2026-07-31 缓存

Truffle Security 与 Julien Chaumond 合作,在 HuggingFace 上执行了最大规模的 AI 训练数据秘密扫描,在 6,003 个公共数据集中发现了 221,303 个有效的唯一凭据。

0 人收藏 0 人点赞
#huggingface

Weights of Deepseek v4 flash 0731 have been released!!!

Reddit r/singularity · 2026-07-31 缓存

DeepSeek released the official DeepSeek-V4-Flash-0731 weights on Hugging Face, superseding the preview version with enhanced agentic capabilities and competitive benchmark results.

0 人收藏 0 人点赞
#huggingface

@SamuelZengML:开源ASR刚刚登顶。Audio8 ARK-ASR-3B现以4.76的平均WER在@huggingface Open ASR排行榜上排名第一,……

X AI KOLs Timeline · 2026-07-30 缓存

Audio8的开源ARK-ASR-3B以4.76的平均WER在Hugging Face Open ASR排行榜上夺得第一,同时其0.6B模型也进入前五,展示了一个有竞争力的开源语音技术栈。

0 人收藏 0 人点赞
#huggingface

Hugging Face 上带视觉能力的 GLM 5.2

Reddit r/LocalLLaMA · 2026-07-30

Baseten 在 Hugging Face 上发布了 GLM 5.2 Vision,将 Kimi k2.6 的视觉编码器集成到 GLM 5.2 模型中,解决了缺乏视觉能力的问题。

0 人收藏 0 人点赞
#huggingface

我预训练了一个700M参数的模型,在180亿个token上优化了Python和Wikitext | TheOneWhoWill/Shibai-700M-Base · Hugging Face

Reddit r/LocalLLaMA · 2026-07-29 缓存

Shibai-700M-Base是一个基于LLaMA的700M参数模型,在180亿个token的英文、数学和Python代码上进行了预训练。尽管与更大模型相比训练不足,但仍能生成连贯的文本,并且因其在单个RTX 5070 Ti GPU上的高效训练而备受瞩目。

0 人收藏 0 人点赞
#huggingface

微软又搞事了.... 又一次!(他们的Mage-Flow模型在HF上404)

Reddit r/LocalLLaMA · 2026-07-29

微软的Mage-Flow模型似乎已从HuggingFace上移除(404),不过社区的量化版本仍然可以在其他地方获取。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈