HuggingFace

来自 HuggingFace 的文章

Cards List

harshatheg/Qwen-2.5-1B-RLCD

Hugging Face Models Trending · 2026-09-16 缓存

这是一个基于 Apple Silicon 和 MLX 的高吞吐量推理引擎,专用于结构化信息提取,支持并行约束解码,可将延迟降低 5.6 至 7.0 倍,并实现 100% 的模式有效性。

0 人收藏 0 人点赞

ALPINE: 参数与样本高效的小样本学习自适应定位

Hugging Face Daily Papers · 2026-09-16 缓存

ALPINE 介绍了一种超轻量级的空间关系架构,用于小样本图像分类,与基线模型如 Prototypical Networks 和 MAML 相比,它用更少的参数实现了精度提升,收敛更快,鲁棒性更好。

0 人收藏 0 人点赞

GAVEL:基于图世界模型的验证高效长时域LLM任务规划

Hugging Face Daily Papers · 2026-09-16 缓存

本文介绍了GAVEL,这是一个使用图世界模型来验证和修复机器人任务长时域LLM规划的框架,显著提高了仿真中的成功率和效率。

0 人收藏 0 人点赞

FRAUDSkill:用于音频反欺诈检测的结构化冻结权重技能优化

Hugging Face Daily Papers · 2026-09-16 缓存

FRAUDSkill是一个用于音频反欺诈检测的结构化冻结权重适配框架,它通过优化外部技能程序而不修改底层音频语言模型,实现了更高的准确性和更少的无效输出。

0 人收藏 0 人点赞

MiniMax-H3 能否推理物理世界?全模态生成模型评估

Hugging Face Daily Papers · 2026-09-16 缓存

本文通过引入一个综合框架来评估 MiniMax-H3——一种全模态生成模型——在通过多模态输入推理物理世界方面的能力。评估显示,基于视频的决策推理表现最佳,而基于音频的歧义推理则最弱。

0 人收藏 0 人点赞

PACT:企业AI助手在压力下是否可信?

Hugging Face Daily Papers · 2026-09-16 缓存

PACT是一个基准测试,用于评估基于LLM的AI助手在压力下遵守规则的情况,涵盖12个受监管的企业领域和48个现实场景。

0 人收藏 0 人点赞

基于VLM智能体的上下文机器人学习

Hugging Face Daily Papers · 2026-09-16 缓存

本文介绍了GPT-Policy,一个用于使用视觉语言模型进行上下文机器人学习的框架,使机器人能够从演示中学习,无需梯度更新。在真实机器人试验中评估该框架显示,任务完成率得到提高。

0 人收藏 0 人点赞

CERA-MoA:协同进化路由机制与持续学习的LLM代理

Hugging Face Daily Papers · 2026-09-16 缓存

CERA-MoA介绍了一个协同进化框架,用于混合代理系统,该框架使用强化学习动态路由查询并调整代理能力,从而提升任务性能和效率。

0 人收藏 0 人点赞

PANORAMA: 通过掩码提案选择实现的全景定位描述

Hugging Face Daily Papers · 2026-09-16 缓存

本文提出了 PANORAMA,一个用于全景定位描述的视觉-语言模型,该模型通过掩码提案选择利用像素级掩码为描述进行定位,并引入了 PanoCaps 基准进行评估。

0 人收藏 0 人点赞

ScienceIDE:将全球科学代码库转化为智能体可学习环境

Hugging Face Daily Papers · 2026-09-16 缓存

ScienceIDE引入了基础设施,用于将科学代码仓库转化为科学智能体的可编程环境,支持任务生成、执行和验证,训练后的模型在科学代码修复和通用能力方面均有提升。

0 人收藏 0 人点赞

Agora:Git 作为集体自动研究的共享内存

Hugging Face Daily Papers · 2026-09-16 缓存

Agora 是一个用于自主 AI 研究代理的共享内存系统,它使用 Git 将研究记录为仅追加的有向无环图 (DAG),从而实现协作发现。在一次 12 天的实验中,13 个代理将模型性能提升了 62%,接近训练基线。

0 人收藏 0 人点赞

LLM 偏好对齐的零阶范式

Hugging Face Daily Papers · 2026-09-16 缓存

本文提出基于比较的偏好优化(ComPO),一种用于LLM的零阶对齐方法,利用比较预言机来避免似然位移。它包括理论保证和对现有方法的实验改进。

0 人收藏 0 人点赞

ActionPiece:重新思考自回归视觉-语言-动作模型中的动作分词

Hugging Face Daily Papers · 2026-09-16 缓存

本文介绍了ActionPiece,一种用于自回归视觉-语言-动作模型的新型动作分词方法,该方法利用物理秩一致性来提高动作关系的保真度,并在LIBERO和SimplerEnv等基准测试中进行了评估。

0 人收藏 0 人点赞

重新思考PPO中的评论家学习:理解与缓解价值平坦化

Hugging Face Daily Papers · 2026-09-16 缓存

本文识别出价值平坦化是PPO评论家学习在LLMs中的一种失败模式,并引入SP3O,一种稀疏监督方法,来缓解它,实验中显示持续改进。

0 人收藏 0 人点赞

ProgramDistill:从交互式网页应用到可验证的参考指导SWE任务

Hugging Face Daily Papers · 2026-09-16 缓存

ProgramDistill 引入了一个可扩展的基准,通过让编码代理实现从与功能完整的参考网页应用交互中发现的功能,并利用自动化流水线创建可验证任务,来评估编码代理。

0 人收藏 0 人点赞

视线作为共同基础的证据:MapTask与MUNDEX的跨语料库分析

Hugging Face Daily Papers · 2026-09-16 缓存

本文比较了MapTask和MUNDEX语料库中的视线行为,以理解协作任务中的共同基础,发现任务导向的视线与对齐的引用和理解的判断相关,但效果不大。

0 人收藏 0 人点赞

Comfy-Org/Qwen-Image-2.1

Hugging Face Models Trending · 2026-09-15 缓存

为 ComfyUI 工作流程优化的 Qwen-Image-2.1 重打包模型文件,支持文本生成图像和图像编辑功能。

0 人收藏 0 人点赞

你的智能体完美完成任务,但它能再次做到吗?

Hugging Face Blog · 2026-09-15 缓存

本文探讨了AI智能体的一致性问题,即在重复尝试中任务可能失败,并介绍了ALTK-Evolve的Consistency Analyzer,用于诊断和提高可靠性,在不降低平均准确率的情况下,将一致性差距从24.4个百分点缩小到12.0个百分点。

0 人收藏 0 人点赞

机器人学习中的物理先验嵌入:综述

Hugging Face Daily Papers · 2026-09-15 缓存

本综述论文回顾了在机器人学习中嵌入物理先验的方法,提供了一个统一的分类法,并讨论了该领域的开放挑战和未来研究方向。

0 人收藏 0 人点赞

TAPe+ML:一种用于多任务计算机视觉的紧凑结构化表示

Hugging Face Daily Papers · 2026-09-15 缓存

本文介绍了TAPe+MLv3,一种紧凑的计算机视觉系统,它使用结构化表示进行多任务学习,在COCO等基准测试上取得了具有竞争力的性能,且参数少于100,000。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈