training-data-curation

Tag

Cards List
#training-data-curation

DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning

arXiv cs.LG · 2026-07-28 Cached

DomainPilot introduces a domain-level loss-guided two-stage framework for data mixture optimization in LLM fine-tuning, achieving improvements on MMLU-Redux, AIME24, LiveCodeBench v5, and BFCL v3 without increasing data volume or training cost.

0 favorites 0 likes
← Back to home

Submit Feedback