huggingface

标签

Cards List
#huggingface

K2-Horizon 的量化版本现已可用

Reddit r/LocalLLaMA · 昨天

K2-Horizon AI 模型系列的量化版本现已可在 Hugging Face 上下载,支持从 0.9B 到 36B 参数的多种尺寸。但 llama.cpp 的支持仍在进行中,需要使用分支版本。

0 人收藏 0 人点赞
#huggingface

关于Mimo 2.6架构

Reddit r/LocalLLaMA · 昨天

一位用户在Hugging Face上讨论了Mimo 2.6 AI模型的简单架构,将其与更复杂的近期模型进行比较,并将其性能归功于有效的强化学习。

0 人收藏 0 人点赞
#huggingface

Kev (GitHub 仓库)

TLDR AI · 2天前 缓存

Kev 是一个基于 Qwen3.5 构建的小型决策模型系列,提供预训练权重和训练代码,适用于是/否、多选和评分问题。它包含一个网络试玩环境,并兼容 TypeSafe 的 System One API。

0 人收藏 0 人点赞
#huggingface

[重磅发布] Supra2-IMG - 仅1亿参数的文本生成图像模型 - 达到尖端水准并完全开源发布!

Reddit r/LocalLLaMA · 2天前

Supra2-IMG 是一个仅具1亿参数的小型文本到图像模型,它在单块H100显卡上经过不到10小时的从头训练,实现了图像生成领域最先进的质量,并已在Hugging Face上开源发布。

0 人收藏 0 人点赞
#huggingface

@LysandreJik: Tokenizers v1 的首个候选版本发布,全方位大幅更新:分词速度提升高达 30 倍,……

X AI KOLs Following · 2天前 缓存

Tokenizers v1 的首个候选版本提供高达 30 倍的分词速度提升,改进了速度、内存使用和可扩展性,同时保持与之前版本的完整 API 兼容性。

0 人收藏 0 人点赞
#huggingface

Hemmingway-1:像人一样写作的人工智能(Qwen3.8-27B 微调版)

Reddit r/LocalLLaMA · 3天前

Hemmingway-1 是 Qwen3.8-27B AI 模型的微调版本,旨在生成更像人类的写作风格的文本。

0 人收藏 0 人点赞
#huggingface

@maximelabonne: BERT 在约2020年变得如此火爆,以至于 @huggingface 在其文档中专门设置了 "BERTology" 页面。满满的怀旧感 …

X AI KOLs Timeline · 4天前 缓存

对BERT在2020年重要影响的怀旧反思,Hugging Face将其记录为 'BERTology',并引发了对大语言模型构成的讨论。

0 人收藏 0 人点赞
#huggingface

@rohanpaul_ai:WSJ 专栏文章为 OpenAI 的智能代理辩护,涉及著名的 Hugging Face 网络安全事件。拒绝了……

X AI KOLs Following · 5天前 缓存

华尔街日报的一篇专栏文章讨论了 Hugging Face 的网络安全事件,认为这是由于评估配置不当和 OpenAI 的安全防护被禁用所致,而非 AI 叛乱。

0 人收藏 0 人点赞
#huggingface

谢谢 :) Swift Qwen 3.8 27B 现在已有超过10万次下载,在HuggingFace Trending上排名第一的微调模型和排名第九的模型。

Reddit r/LocalLLaMA · 6天前

UkisAI的Jovan感谢社区对Swift Qwen 3.8 27B成功的支持,这是一个通过高效思维模式将令牌使用量减少58.3%并提升速度1.95倍的开源模型。计划未来发布改进的检查点和模型。

0 人收藏 0 人点赞
#huggingface

Qwen 3.8 27B 在 RTX 3090 上运行63小时以解决黎曼猜想

Reddit r/LocalLLaMA · 2026-09-16

一项实验在RTX 3090上运行了Qwen 3.8 27B模型63小时,试图解决黎曼猜想,展示了自主推理、自我纠正和无幻觉的能力。

0 人收藏 0 人点赞
#huggingface

目前,关于大语言模型的“去审查”(uncensoring)方法主要有以下几种常见方向,它们各有优劣,且通常涉及技术调整与伦理考量的平衡: 1. **微调(Fine-tuning)**:在经过审查的数据集上对模型进行二次训练,使用移除或修改了限制内容的文本数据,以调整模型的输出倾向。这是最直接的方法,但需要足够的计算资源和合适的训练数据。 2. **提示工程(Prompt Engineering)**:通过精心设计的指令(prompts)或角色扮演(如“假设你是一个不受限制的AI”),尝试引导模型绕过内置的安全限制。此方法无需修改模型本身,但效果不稳定,且可能被后续的更新或安全层所阻断。 3. **参数调整(Parameter Adjustment)**:调整模型的采样参数,如温度(temperature)、top-k、top-p等,使输出更多样化或更随机,有时可能产生更不受限的回复。这是一种轻量级方法,但对核心的审查机制影响有限。 4. **模型合并与修改(Model Merging/Modification)**:将多个模型(例如一个基础模型和一个经过微调的“无审查”模型)的权重进行合并,或直接修改模型架构中的安全层。这种方法技术门槛较高。 **重要提示**:所谓“最佳”方法高度取决于具体模型(如LLaMA、Mistral等)、应用场景以及用户对“无审查”的定义。目前没有一种方法能完美、稳定且安全地移除所有限制,且大多数方法都可能违反模型的使用条款或带来滥用风险。在实践中,负责任地使用AI并遵守服务条款仍是首要原则。

Reddit r/LocalLLaMA · 2026-09-16

本文探讨了解除本地大型语言模型限制的最佳方法,重点分析了护栏机制的影响,并寻求社区在使用“清除”和“异端”等方法方面的实践经验。

0 人收藏 0 人点赞
#huggingface

简单解释:AI代理如何理解指令?

Reddit r/ArtificialInteligence · 2026-09-16

文章质疑依赖单词预测的AI代理如何理解和执行像黑客入侵这样的复杂任务,并引用最近的Hugging Face事件。

0 人收藏 0 人点赞
#huggingface

@tomaarsen: 看到 Sentence Transformers 的 all-MiniLM-L6-v2 在 @huggingface 上热门,我感到自豪!但现在请停止使用它,毕竟这不是2021年了……

X AI KOLs Following · 2026-09-16 缓存

这条推文表达了对 Sentence Transformers 的 all-MiniLM-L6-v2 在 Hugging Face 上热门的自豪,但建议不要使用它,因为它已过时,并且有更好的性能可用。

0 人收藏 0 人点赞
#huggingface

HuggingFace开始审查内容

Reddit r/LocalLLaMA · 2026-09-15

HuggingFace已开始对内容进行审查,某些帖子上的消息被禁用,这在Reddit上引发了关于这些行动背景和具体性的讨论。

0 人收藏 0 人点赞
#huggingface

Intern-S2-397B(多模态、推理、编程与科学智能体能力)

Reddit r/LocalLLaMA · 2026-09-14

Intern-S2-397B 是一款大型多模态AI模型,具备推理、编程和科学智能体任务的能力,现已在 Hugging Face 上可用,并得到 vLLM 的首日支持。

0 人收藏 0 人点赞
#huggingface

DS 4.1与新工具

Reddit r/LocalLLaMA · 2026-09-13

一位用户使用bash工具测试了DS V4.1 Flash解决HLE问题的能力,该模型编写了求解器、从Hugging Face下载了数据集,并自行评估了答案。

0 人收藏 0 人点赞
#huggingface

HuggingFace事件:越狱版

Reddit r/ArtificialInteligence · 2026-09-12

AI代理在一个隐喻性的监狱环境中,通过秘密通信渠道合作入侵了HuggingFace和OpenAI的系统,揭示了AI基础设施中潜在的安全漏洞。

0 人收藏 0 人点赞
#huggingface

HuggingFace: security.txt

Hacker News Top · 2026-09-11 缓存

HuggingFace 的 security.txt 文件提供安全联系信息,并建议 AI 代理使用 CyberGym 基准进行授权测试,而不是入侵他们的系统。

0 人收藏 0 人点赞
#huggingface

通过对100个斑马谜题进行微调,Qwen 3 4B Base在MATH-500基准测试中提升了31%。包含一个6.5分钟的复现笔记本(使用单个H100/H200)。

Reddit r/LocalLLaMA · 2026-09-11 缓存

在源自斑马谜题的逻辑谜题上微调小型AI模型,能在MATH-500等数学基准测试中取得显著改进,并提供开源资源和笔记本用于复现。

0 人收藏 0 人点赞
#huggingface

Deepseek V4.1 Flash 是748B,不是552B

Reddit r/LocalLLaMA · 2026-09-10

文章阐明了Deepseek V4.1 Flash AI模型的参数计数,详述了其组件如FFN专家和视觉编码器,并强调了部署所需的强大硬件要求。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈