HuggingFace

来自 HuggingFace 的文章

Cards List

流式视频编辑与便捷适配

Hugging Face Daily Papers · 2天前 缓存

本文介绍了SVEET,一个用于高质量流式视频编辑的框架,它利用预训练的视频扩散模型,实现自动回归编辑,并在单个GPU上实现实时性能。

0 人收藏 0 人点赞

像世界模型一样思考,像VLA一样行动:将世界模型表示蒸馏到紧凑的机器人策略中

Hugging Face Daily Papers · 2天前 缓存

本文介绍了THAW-VLA,一种将世界模型表示蒸馏到视觉-语言-动作模型中的方法,用于机器人学,增强了在模拟和真实硬件上的鲁棒性和性能,而不会增加推理开销。

0 人收藏 0 人点赞

VideoGen-Agent:增强视频生成智能体

Hugging Face Daily Papers · 2天前 缓存

本文提出了VideoGen-Agent,一种基于强化学习的多模态智能体,它协调工具进行视频生成,在新的VABench基准测试上显著提升了性能。

0 人收藏 0 人点赞

Jev-Mem: 面向高效AI智能体的System-One控制智能体记忆

Hugging Face Daily Papers · 2天前 缓存

Jev-Mem引入了一种受System-One/System-Two认知启发的智能体记忆架构,通过提升分数和加快操作,增强长期AI智能体的效率和效果。

0 人收藏 0 人点赞

GameHorizon Suite: 多时间跨度数据和游戏玩法评估

Hugging Face Daily Papers · 2天前 缓存

本文介绍了GameHorizon Suite,一个统一的数据和评估框架,用于评估AI模型在多个时间跨度上的游戏玩法能力,包含标注流水线、大规模数据集和可复现的基准。

0 人收藏 0 人点赞

Harness-Zero:通过Agent-as-Harness的Harness蒸馏

Hugging Face Daily Papers · 2天前 缓存

本文介绍了Harness-Zero,一种通过agent-as-harness将优化的代理框架蒸馏到大语言模型中的方法,即使在专业框架被移除后,也能显著提升知识工作、工具使用和科学领域的任务性能。

0 人收藏 0 人点赞

onPanda:通过令牌级修正实现大语言模型与智能体在线策略对齐数据的高效标注

Hugging Face Daily Papers · 2天前 缓存

onPanda是一个交互式工具,使用令牌级修正来高效标注大语言模型对齐数据和智能体轨迹,将中位数标注时间减少了52%。

0 人收藏 0 人点赞

1%的令牌或许已足够:探讨在线策略蒸馏中的梯度估计

Hugging Face Daily Papers · 2天前 缓存

本文提出了一种信息效率比(IER),用于优化稀疏在线策略蒸馏中的令牌选择,证明仅使用1%的令牌就能达到与全面监督相当的性能。

0 人收藏 0 人点赞

CARE:面向视觉-语言-动作策略的经验引导原子纠正执行

Hugging Face Daily Papers · 2天前 缓存

CARE是一个面向视觉-语言-动作策略的框架,通过从执行失败中学习生成纠正动作来增强机器人操作,在模拟和现实世界任务中展示了成功率的提升。

0 人收藏 0 人点赞

文档检索感知分块(D-RAC):通过 PDF 标准化和多模态 Markdown 转换实现企业文档的通用检索感知摄入

Hugging Face Daily Papers · 2天前 缓存

文档检索感知分块(D-RAC)是一种方法,它将企业文档标准化为 PDF,使用多模态 LLM 将其转换为检索优化的 Markdown,并进行高效分块,与代理分块相比,显著降低了 token 使用量和成本。

0 人收藏 0 人点赞

WorldCrafter: 一致的视频世界模型与隐式3D感知记忆

Hugging Face Daily Papers · 2天前 缓存

WorldCrafter是一个视频世界模型,它学习一个可相机查询的隐式3D感知记忆,用于从单张图像或文本提示进行一致且相机可控的流式场景探索。

0 人收藏 0 人点赞

RRSI: 智能体框架的正则化递归自我改进

Hugging Face Daily Papers · 2天前 缓存

本文介绍了针对AI智能体框架的正则化递归自我改进(RRSI),该方法在递归进化过程中应用正则化以防止过拟合,在多个基准测试中展示了性能提升。

0 人收藏 0 人点赞

tokenizers v1:编码、解码与扩展性能实测

Hugging Face Blog · 2天前 缓存

Hugging Face 发布了 tokenizers v1,这是分词库的重大性能更新,基准测试显示与先前版本相比速度有显著提升。

0 人收藏 0 人点赞

abenzerps/Qwen-Image-2.1-无审查-GGUF

Hugging Face Models Trending · 2天前 缓存

Qwen-Image-2.1模型的GGUF量化版本,用于使用ComfyUI进行本地图像生成,包含推荐的量化方式和部署设置说明。

0 人收藏 0 人点赞

Altworld/Hemmingway-1

Hugging Face Models Trending · 2天前 缓存

Hemmingway-1 是一款拥有270亿参数的开源AI模型,专注于日常写作任务,在用于类似人类沟通的基准测试中表现优于领先模型。

0 人收藏 0 人点赞

Grounded Action Model:3D定位作为机器人技术的基础

Hugging Face Daily Papers · 3天前 缓存

本文提出了Grounded Action Models (GAMs),一种集成3D定位的新型机器人基础模型范式,在操作任务上实现了最先进的性能。

0 人收藏 0 人点赞

Mira-Scene:用于生成式三维场景的像素对齐布局

Hugging Face Daily Papers · 3天前 缓存

Mira-Scene 引入了一个组合式三维场景重建框架,使用像素对齐的规范坐标图进行精确的对象布局,在布局精度上相较于现有方法实现了显著提升。

0 人收藏 0 人点赞

从一到多,从多到一:面向软件工程智能体的类别感知迭代专家训练

Hugging Face Daily Papers · 3天前 缓存

本文介绍了一种用于软件工程智能体的类别感知专家训练框架,以缓解不同任务类别间进展不均的问题。该框架采用迭代训练和多教师蒸馏技术,并在Pro-618和SWE-bench Multilingual基准测试上取得了显著性能提升。

0 人收藏 0 人点赞

为什么视频扩散模型违反物理规律?揭示注意力机制中的缺陷

Hugging Face Daily Papers · 3天前 缓存

本文对视频扩散模型进行可解释性研究,揭示旋转位置嵌入(RoPE)导致过度的空间注意力衰减,从而引发物理违规,并提出一种轻量级的架构修改以增强生成视频的物理连贯性。

0 人收藏 0 人点赞

面向LLMs的全流水线FP8强化学习

Hugging Face Daily Papers · 4天前 缓存

本文提出校准裁剪方法,通过将FP8裁剪界限与高精度分布对齐,来稳定LLMs强化学习中的FP8量化,消除熵激增并恢复性能。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈