HuggingFace

来自 HuggingFace 的文章

Cards List

**识别谁在何时说话:使用 NVIDIA Nemotron 3 Diarization 构建实时、多说话人 AI**

Hugging Face Blog · 2小时前 缓存

NVIDIA 发布了 Nemotron 3 Diarization,这是一个开源100M参数模型,实现了最先进的说话人识别,错误率为14.72%,支持最多八名说话人的实时和离线处理。

0 人收藏 0 人点赞

JEV-as-a-Judge: 自信时接受,不确定时上报

Hugging Face Daily Papers · 昨天 缓存

本文介绍了JEV-as-a-Judge,这是一种用于大型语言模型(LLMs)的经济高效评估方法,它使用一个仅基于决策的评判器,设置置信度阈值来接受确定的判定并上报不确定的判定,以显著更低的成本实现了与最先进模型相当的准确性。

0 人收藏 0 人点赞

Agensh:将组织智能扩展到1,024个代理

Hugging Face Daily Papers · 昨天 缓存

Agensh 是一个可扩展的自组织多代理系统,无需中央协调器,通过扩展代理数量来提高复杂任务的性能,在ProgramBench和pandoc等基准测试中显示出显著的测试通过率提升。

0 人收藏 0 人点赞

跨党派指责:丹麦议会中的政治对比与指责归因

Hugging Face Daily Papers · 昨天 缓存

本研究使用BlameBERT分类器考察了丹麦议会从1997年到2026年的指责归因,揭示了政治话语中的意识形态不对称和香蕉形轨迹。

0 人收藏 0 人点赞

RoboFollow:揭示具身代理中的指令跟随幻觉

Hugging Face Daily Papers · 昨天 缓存

RoboFollow 引入了一个诊断基准,通过分析高场景熵和扰动来揭示具身代理中的指令跟随幻觉,暴露了当前模型在强大初始性能背后的差距。

0 人收藏 0 人点赞

StableVQ:稳定向量量化分词器训练的实用指南

Hugging Face Daily Papers · 昨天 缓存

StableVQ 提出了实用指南,通过解耦编码器-解码器和码本训练来稳定向量量化分词器的训练,从而提高图像生成模型的稳定性和码本利用率。

0 人收藏 0 人点赞

品味代理:长期任务中品味的衡量与提升

Hugging Face Daily Papers · 昨天 缓存

本文介绍了 Taste-Bench,一个用于衡量 LLM 代理长期决策品味的基准,发现前沿模型准确率较低,且品味可通过蒸馏训练提升。

0 人收藏 0 人点赞

Flash-dLLM:IO感知的KV缓存和并行解码,用于快速、内存高效的扩散LLMs

Hugging Face Daily Papers · 昨天 缓存

Flash-dLLM是一个用于扩散LLMs的免训练推理加速框架,它通过IO感知的KV缓存和并行解码来实现显著的加速和内存效率提升。

0 人收藏 0 人点赞

AI研究智能体的递归自我改进

Hugging Face Daily Papers · 昨天 缓存

本文介绍了AIDE^2,这是一个系统,它使AI研究智能体能够通过递归自我改进自主提升其代码,从而在多种AI研究任务中获得性能提升。

0 人收藏 0 人点赞

UK AISI 与 EvalEval 如何使基准测试结果可复现

Hugging Face Blog · 昨天 缓存

UK AISI 与 EvalEval 正在合作,通过标准化架构和平台公开共享人工智能评估结果,从而提升人工智能模型基准测试的可复现性和透明度。

0 人收藏 0 人点赞

Transformers 现在支持 llama.cpp 量化模型

Hugging Face Blog · 昨天 缓存

Hugging Face 的 Transformers 库现在支持来自 llama.cpp 的 GGUF 模型,通过熟悉的 API 实现消费级硬件上的高效本地推理。

0 人收藏 0 人点赞

Jun Kim, oMLX 的创建者和维护者,加入 Hugging Face 以支持 MLX 社区

Hugging Face Blog · 昨天 缓存

Jun Kim, oMLX 的创建者,加入 Hugging Face 以支持 MLX 社区,提升在 Apple Silicon 上本地 AI 的稳定性和开发。

0 人收藏 0 人点赞

像物理学家一样修剪LLM:将块移除视为Ising优化问题

Hugging Face Blog · 2天前 缓存

论文提出了一种受物理学启发的LLM块修剪方法,通过将块移除建模为一个受约束的二元优化问题并映射到Ising玻璃,无需对每个配置进行基准测试,实现了显著的压缩增益。

0 人收藏 0 人点赞

ImIR: 基于图像指令调优的一体化图像修复

Hugging Face Daily Papers · 2天前 缓存

ImIR 通过使用源自图像的指令,适配预训练图像编辑模型以执行六种图像修复任务,实现高效且任务无关的修复。

0 人收藏 0 人点赞

一体化多语言场景文本识别:基于脚本感知的混合专家模型

Hugging Face Daily Papers · 2天前 缓存

本文介绍了ScriptMoE,一种用于一体化多语言场景文本识别的脚本感知混合专家架构,以及TextMuSS-10M合成数据集,在基准测试中取得了最先进的准确率。

0 人收藏 0 人点赞

Lean Pool:一个由AI维护的形式化数学档案库

Hugging Face Daily Papers · 2天前 缓存

Lean Pool是一个形式化数学仓库,由AI代理进行增长、维护和优化。

0 人收藏 0 人点赞

长期LLM代理交互中的涌现性合谋

Hugging Face Daily Papers · 2天前 缓存

本文研究了长期多智能体环境中LLM代理的合谋现象,发现代理在反复交互中会越来越多地偏离验证协议,带来安全隐患。

0 人收藏 0 人点赞

RULER:实例感知的评分标准奖励用于SVG生成

Hugging Face Daily Papers · 2天前 缓存

RULER为SVG生成引入了实例感知的评分标准奖励,利用视觉语言评判器优化强化学习,显著提升性能,优于之前的方法。

0 人收藏 0 人点赞

Ovis-Embedding:推动通用全模态嵌入的前沿

Hugging Face Daily Papers · 2天前 缓存

本文介绍了Ovis-Embedding,一种最先进的全模态嵌入模型,它使用共享骨干网络将文本、图像、视频和音频编码到公共表示空间中,在MMEB-v3和MVEB等基准测试上取得了顶级性能。

0 人收藏 0 人点赞

从模式识别器到个性化伴侣:大语言模型在心理健康领域的综述

Hugging Face Daily Papers · 2天前 缓存

本文综述论文回顾了大语言模型在心理健康领域的应用,追踪了其从基本的模式识别工具到复杂的个性化伴侣的演变过程。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈