HuggingFace

来自 HuggingFace 的文章

Cards List

Harness-Zero:通过Agent-as-Harness的Harness蒸馏

Hugging Face Daily Papers · 2天前 缓存

本文介绍了Harness-Zero,一种通过agent-as-harness将优化的代理框架蒸馏到大语言模型中的方法,即使在专业框架被移除后,也能显著提升知识工作、工具使用和科学领域的任务性能。

0 人收藏 0 人点赞

onPanda:通过令牌级修正实现大语言模型与智能体在线策略对齐数据的高效标注

Hugging Face Daily Papers · 2天前 缓存

onPanda是一个交互式工具,使用令牌级修正来高效标注大语言模型对齐数据和智能体轨迹,将中位数标注时间减少了52%。

0 人收藏 0 人点赞

1%的令牌或许已足够:探讨在线策略蒸馏中的梯度估计

Hugging Face Daily Papers · 2天前 缓存

本文提出了一种信息效率比(IER),用于优化稀疏在线策略蒸馏中的令牌选择,证明仅使用1%的令牌就能达到与全面监督相当的性能。

0 人收藏 0 人点赞

CARE:面向视觉-语言-动作策略的经验引导原子纠正执行

Hugging Face Daily Papers · 2天前 缓存

CARE是一个面向视觉-语言-动作策略的框架,通过从执行失败中学习生成纠正动作来增强机器人操作,在模拟和现实世界任务中展示了成功率的提升。

0 人收藏 0 人点赞

文档检索感知分块(D-RAC):通过 PDF 标准化和多模态 Markdown 转换实现企业文档的通用检索感知摄入

Hugging Face Daily Papers · 2天前 缓存

文档检索感知分块(D-RAC)是一种方法,它将企业文档标准化为 PDF,使用多模态 LLM 将其转换为检索优化的 Markdown,并进行高效分块,与代理分块相比,显著降低了 token 使用量和成本。

0 人收藏 0 人点赞

WorldCrafter: 一致的视频世界模型与隐式3D感知记忆

Hugging Face Daily Papers · 2天前 缓存

WorldCrafter是一个视频世界模型,它学习一个可相机查询的隐式3D感知记忆,用于从单张图像或文本提示进行一致且相机可控的流式场景探索。

0 人收藏 0 人点赞

RRSI: 智能体框架的正则化递归自我改进

Hugging Face Daily Papers · 2天前 缓存

本文介绍了针对AI智能体框架的正则化递归自我改进(RRSI),该方法在递归进化过程中应用正则化以防止过拟合,在多个基准测试中展示了性能提升。

0 人收藏 0 人点赞

tokenizers v1:编码、解码与扩展性能实测

Hugging Face Blog · 2天前 缓存

Hugging Face 发布了 tokenizers v1,这是分词库的重大性能更新,基准测试显示与先前版本相比速度有显著提升。

0 人收藏 0 人点赞

abenzerps/Qwen-Image-2.1-无审查-GGUF

Hugging Face Models Trending · 2天前 缓存

Qwen-Image-2.1模型的GGUF量化版本,用于使用ComfyUI进行本地图像生成,包含推荐的量化方式和部署设置说明。

0 人收藏 0 人点赞

Altworld/Hemmingway-1

Hugging Face Models Trending · 2天前 缓存

Hemmingway-1 是一款拥有270亿参数的开源AI模型,专注于日常写作任务,在用于类似人类沟通的基准测试中表现优于领先模型。

0 人收藏 0 人点赞

Grounded Action Model:3D定位作为机器人技术的基础

Hugging Face Daily Papers · 3天前 缓存

本文提出了Grounded Action Models (GAMs),一种集成3D定位的新型机器人基础模型范式,在操作任务上实现了最先进的性能。

0 人收藏 0 人点赞

Mira-Scene:用于生成式三维场景的像素对齐布局

Hugging Face Daily Papers · 3天前 缓存

Mira-Scene 引入了一个组合式三维场景重建框架,使用像素对齐的规范坐标图进行精确的对象布局,在布局精度上相较于现有方法实现了显著提升。

0 人收藏 0 人点赞

从一到多,从多到一:面向软件工程智能体的类别感知迭代专家训练

Hugging Face Daily Papers · 3天前 缓存

本文介绍了一种用于软件工程智能体的类别感知专家训练框架,以缓解不同任务类别间进展不均的问题。该框架采用迭代训练和多教师蒸馏技术,并在Pro-618和SWE-bench Multilingual基准测试上取得了显著性能提升。

0 人收藏 0 人点赞

为什么视频扩散模型违反物理规律?揭示注意力机制中的缺陷

Hugging Face Daily Papers · 3天前 缓存

本文对视频扩散模型进行可解释性研究,揭示旋转位置嵌入(RoPE)导致过度的空间注意力衰减,从而引发物理违规,并提出一种轻量级的架构修改以增强生成视频的物理连贯性。

0 人收藏 0 人点赞

面向LLMs的全流水线FP8强化学习

Hugging Face Daily Papers · 4天前 缓存

本文提出校准裁剪方法,通过将FP8裁剪界限与高精度分布对齐,来稳定LLMs强化学习中的FP8量化,消除熵激增并恢复性能。

0 人收藏 0 人点赞

UltraTex: 释放2K多视角扩散在3D纹理生成中的潜力

Hugging Face Daily Papers · 4天前 缓存

UltraTex是一个高效框架,用于基于高分辨率多视角扩散的3D纹理生成,引入了技术以减少冗余并在训练和推理中实现显著加速。

0 人收藏 0 人点赞

OmniEdu:面向学习和教学的开放基础模型

Hugging Face Daily Papers · 4天前 缓存

OmniEdu 推出一个开放的基础模型家族,专为K-12教育设计,通过精选语料库训练,以提高问题解决、课程理解和教学辅导能力。

0 人收藏 0 人点赞

将视觉语言模型的智能迁移至机器人控制

Hugging Face Daily Papers · 4天前 缓存

本文提出了RoboDawn,一种将视觉语言模型智能迁移至机器人控制的方法。该方法通过零样本和单样本学习在基准测试中取得了先进结果,并在真实世界应用中验证成功。

0 人收藏 0 人点赞

convaiinnovations/laya

Hugging Face Models Trending · 4天前 缓存

Laya 是一款开源的非自回归决策模型,提供带有校准概率的类型化回答,旨在用于电子邮件分类和对话AI等任务,相比现有模型显示出显著的性能提升。

0 人收藏 0 人点赞

HuRo:用于可扩展VLA预训练的机器人化人类视频

Hugging Face Daily Papers · 5天前 缓存

本文介绍了HuRo,一个将人类视频机器人化以创建可扩展VLA预训练数据的流程,展示了在真实世界操作任务中任务完成率和鲁棒性的显著提升。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈