data-centric

标签

Cards List
#data-centric

金融推理的数据中心化后训练:挖掘、蒸馏与可验证学习

arXiv cs.CL · 5天前 缓存

本文介绍了一种数据中心化的流水线,用于通过挖掘推理轨迹、蒸馏指令数据和生成可验证的问答对来对语言模型进行后训练,以增强金融推理能力,展示了在防止灾难性遗忘的同时性能得到提升。

0 人收藏 0 人点赞
#data-centric

超越上下文窗口:数据智能体的持久发现上下文

arXiv cs.AI · 2026-09-03 缓存

本文介绍了持久发现上下文,这是一个为数据智能体设计的轻量级记忆层,用于存储先前的意图到对象的映射,以增强跨任务的检索质量,在结构化数据环境中展示了改进。

0 人收藏 0 人点赞
#data-centric

使用 Data-Centric Parallel 训练可变长序列

arXiv cs.AI · 2026-08-11 缓存

介绍了 Data-Centric Parallel (DCP),一种通过在每批次动态调整运行时设置来训练变长序列深度学习模型的方法,在 32 个 H200 GPU 上实现了高达 2.88 倍的加速,仅需集成 10 行代码。

0 人收藏 0 人点赞
#data-centric

DataRx:面向更安全的大语言模型任务特定微调的缺失感知采样方法

arXiv cs.CL · 2026-08-06 缓存

本文提出了DataRx,一种缺失感知的采样方法,用于在任务特定微调期间选择安全关键的示例以保持大语言模型的安全性,在Llama3-8B-Instruct上将攻击成功率从59.23%降低到13.70%。

0 人收藏 0 人点赞
#data-centric

更少数据,更好对齐:数据驱动的多评估者一致性偏好优化

arXiv cs.AI · 2026-07-29 缓存

本文介绍了DMAPO,一种偏好优化方法,利用多评估者共识来选取高置信度的在策略响应,以显著更少的数据(仅3.45%的接受率)实现强对齐,并在多个基准测试中优于SimPO等基线。

0 人收藏 0 人点赞
#data-centric

以数据为中心的调试:面向训练神经网络的团队 [P]

Reddit r/MachineLearning · 2026-06-21

WeightsLab 是一个开源、PyTorch 原生的工具,允许团队在训练过程中暂停、检查实时损失信号,并在数据问题(如标签错误和类别不平衡)影响模型性能之前发现它们。它专为处理图像、视频和 LiDAR 点云的计算机视觉工程师而设计。

0 人收藏 0 人点赞
#data-centric

PreUnlearn:在大语言模型遗忘前审计附带知识损害

arXiv cs.CL · 2026-06-18 缓存

本文提出了PreUnlearn,一个在LLM遗忘执行前审计附带知识损害的框架,采用以数据为中心的分析来预测跨语义层的下游损害。

0 人收藏 0 人点赞
#data-centric

LIMMT:动作追踪中的少即是多

Hugging Face Daily Papers · 2026-06-05 缓存

本文介绍了LIMMT,这是一项以数据为中心的研究,表明使用高质量、极小的运动数据子集(不到AMASS的3%)进行训练,在基于物理的人形动作追踪方面优于使用完整数据集,并通过物理可行性、多样性和复杂性来定义运动数据质量。

0 人收藏 0 人点赞
#data-centric

大型语言模型的对齐微调:以数据为中心的视角看对齐数据流水线

arXiv cs.CL · 2026-05-27 缓存

本综述将大型语言模型的对齐微调重新表述为一个数据流水线设计问题,将其分解为三个环节:响应合成、偏好评估和偏好实例化。它识别了设计权衡和失败模式,并概述了开放挑战,如提示级对齐和智能体设置。

0 人收藏 0 人点赞
#data-centric

真正提升数学推理的是什么:超越纯代码的结构化推理信号

arXiv cs.AI · 2026-05-20

本文挑战了代码能提升语言模型推理能力的观点,通过受控的预训练实验发现,代码主要提升编程能力,而推理能力的提升来自结构化推理轨迹(如代码-文本混合和数学-文本混合)。

0 人收藏 0 人点赞
#data-centric

EMA: 面向学习型系统的高效模型自适应方法

arXiv cs.LG · 2026-05-15 缓存

本文介绍了EMA,一种面向学习型系统的模型自适应系统,能够在降低训练和标注成本的同时,提升系统在不断演化环境中的性能。

0 人收藏 0 人点赞
#data-centric

合成分层设计数据是否有利于分层设计分解?

Hugging Face Daily Papers · 2026-05-14 缓存

探究合成分层数据是否能改善图形设计分解,发现合成数据优于不可扩展的数据集,并能够实现均衡的层数分布。

0 人收藏 0 人点赞
#data-centric

DataFlex:面向大语言模型数据驱动动态训练的统一框架

Papers with Code Trending · 2026-03-27 缓存

DataFlex是一个面向大语言模型数据驱动动态训练的统一框架,集成了样本选择、领域混合调整和样本重加权,兼容标准工作流程并支持高效大规模部署,相比静态训练实现了一致的性能提升。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈