HuggingFace

来自 HuggingFace 的文章

Cards List

通过方向分解解析Transformer中的表示演化

Hugging Face Daily Papers · 2026-09-14 缓存

本文将Transformer表示更新分解为平行和垂直分量,以研究演化几何,并将其与编辑鲁棒性、压缩诊断和训练改进联系起来。

0 人收藏 0 人点赞

ModaLens:在报告条件下的医学视觉语言模型中测量图像敏感性

Hugging Face Daily Papers · 2026-09-14 缓存

ModaLens是一种配对图像交换审计方法,用于测量报告可用性如何降低医学视觉语言模型中的图像敏感性,通过在MIMIC-CXR数据集上使用MedGemma-27B进行演示。

0 人收藏 0 人点赞

无损推测解码有多无损?数值精度在Orthrus中的作用

Hugging Face Daily Papers · 2026-09-14 缓存

本文研究了Orthrus的无损性,Orthrus是一种用于推理加速的混合自回归-扩散模型,发现其需要高数值精度(FP32)来实现精确轨迹匹配,而BF16精度偏差并不影响下游性能。

0 人收藏 0 人点赞

LynnReal-Omni:面向智能体视觉工作流的原生多模态视频生成

Hugging Face Daily Papers · 2026-09-14 缓存

LynnReal-Omni 是一个统一的多模态视频扩散框架,它将智能体视觉控制与高保真生成和实时加速相结合,以实现稳定、可控的视频创作。

0 人收藏 0 人点赞

并非所有提示都是平等的:探索引导的提示脚手架用于多模态强化后训练

Hugging Face Daily Papers · 2026-09-14 缓存

本文提出了一种探索引导的提示脚手架框架,该框架动态调整多模态强化学习的训练提示,在基准测试中实现了高达9.7%的相对性能提升。

0 人收藏 0 人点赞

PhysBrain 1.5:从视觉-语言模型到物理基础模型

Hugging Face Daily Papers · 2026-09-14 缓存

PhysBrain 1.5 是一个统一模型,通过自回归训练集成物理环境理解、动作生成和未来状态预测,在28个具身基准测试中实现了最先进的开源性能。

0 人收藏 0 人点赞

Kaininja:将原生3D生成器扩展至部分级别

Hugging Face Daily Papers · 2026-09-14 缓存

KaiNinja通过双体积表示扩展了原生3D生成器,以生成部分级别输出,提高了部分和整体对象的保真度,无需进行分割。

0 人收藏 0 人点赞

Atria Dawn: 代理型超级智能的黎明

Hugging Face Daily Papers · 2026-09-14 缓存

Atria Dawn Preview 是一个基础代理型语言模型,专为科学研究设计,取得了有竞争力的基准测试结果,并展示了向人类-AI项目级协作的转变。

0 人收藏 0 人点赞

当智能体减速时:通过每令牌Elo分析理解LLM智能体的测试时策略

Hugging Face Daily Papers · 2026-09-14 缓存

本文引入Elo每令牌分析来研究LLM智能体如何分配测试时计算资源,揭示智能体最初优于独立采样但随时间减速,并行会话提供性能提升。

0 人收藏 0 人点赞

赋能氛围设计智能体的创意探索

Hugging Face Daily Papers · 2026-09-14 缓存

本文提出了一种方法,使氛围设计智能体能够通过结构化设计规范将探索与实现分离,从而探索多样化的UI替代方案。该方法在168个提示和一个超过30万任务的大型在线实验中进行了评估。

0 人收藏 0 人点赞

挑选毒药:学习选择毒集以实现更强的LLM后门攻击

Hugging Face Daily Papers · 2026-09-14 缓存

本文介绍了SAILS,一种针对大型语言模型后门攻击中选择最优毒集的方法,相比基线方法,最坏情况攻击成功率提高了30个百分点。

0 人收藏 0 人点赞

HazardAuditor: 从可执行威胁到更安全的计算机使用代理

Hugging Face Daily Papers · 2026-09-14 缓存

HazardAuditor 引入了一个基于执行的框架,用于监督计算机使用代理的安全性,其中 Guard Policy Optimization 将安全结果的准确率提高了多达 16.5%,相比之前的方法。

0 人收藏 0 人点赞

RSIAgent: 在新环境中递归自我改进的自主探索

Hugging Face Daily Papers · 2026-09-14 缓存

RSIAgent 是一个无需训练的多智能体框架,它使数字智能体能够通过递归自我改进、自主记忆构建和广度优先然后深度优先的探索来适应新环境,在基准测试中优于闭源模型。

0 人收藏 0 人点赞

Omni-Streaming Thinking

Hugging Face Daily Papers · 2026-09-14 缓存

Omni-Streaming Thinking 通过推迟声明直到跨模态验证来改进流式全模态推理,减少过早承诺和听觉幻觉。

0 人收藏 0 人点赞

Dream-RSI: 通过进化世界的递归自我改进

Hugging Face Daily Papers · 2026-09-14 缓存

Dream-RSI 是一个用于AI代理的可扩展递归自我改进框架,它利用历史发现树创建重放模拟器,用于离线策略评估,减少在线成本并提高发现效率。

0 人收藏 0 人点赞

BVB:通过在 Blender 中进行程序化重建来基准测试代理视频理解

Hugging Face Daily Papers · 2026-09-14 缓存

论文介绍了 BVB,这是一个通过在 Blender 中进行程序化重建来基准测试代理视频理解的基准,评估模型在感知相似性和时空事实保留方面的表现。

0 人收藏 0 人点赞

Discovery Foundation Models: 面向开放式发现智能

Hugging Face Daily Papers · 2026-09-14 缓存

Discovery Foundation Models 被提议作为通用系统,通过迭代问题表述、假设测试和基于证据的修订,在干湿实验室环境中实现开放式科学发现。本文引入了一个具有问题发现和持续改进等能力的框架,并通过Zetema和GALILEO等系统进行实例化。

0 人收藏 0 人点赞

Mothersuperior/yue2-mothersuperior-realaudio-tokenizer-v4

Hugging Face Models Trending · 2026-09-13 缓存

这是一个用于YuE2-3B模型的音频分词器和LoRA工具,使用户能够对真实音频录音进行分词并生成新歌曲或翻唱。

0 人收藏 0 人点赞

平滑长上下文混合专家训练中的所有内存峰值

Hugging Face Daily Papers · 2026-09-13 缓存

本文介绍了管理长上下文长度下训练大型混合专家模型内存峰值的技术,包括Pipelined LLEP、Ring-DTP、SCO和OffloadStreamAdamW,这些技术实现了固定的GPU工作集,并将吞吐量提高了多达10.4倍。

0 人收藏 0 人点赞

谱移(SpectralShift):通过谱重参数化有效扩展门控 DeltaNet 的上下文窗口

Hugging Face Daily Papers · 2026-09-13 缓存

谱移引入了一种谱重参数化方法,通过重塑衰减谱来有效扩展门控 DeltaNet 模型的上下文窗口,并通过持续预训练提升其长上下文处理能力。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈