model-fine-tuning

标签

Cards List
#model-fine-tuning

WHALE: 一种联合 Harness-Weight 优化的简单方法

arXiv cs.LG ↗ · 2026-09-02 缓存

该论文提出了 WHALE,一种交替优化方法,用于联合训练 AI 代理中的模型权重和 Harness 代码,在搜索 QA、数学推理和国际象棋谜题中实现了显著的性能提升。

0 人收藏 0 人点赞
#model-fine-tuning

在流式ASR中,数据规模而非延迟影响跨语言编码器迁移

arXiv cs.AI ↗ · 2026-06-24 缓存

本文研究了数据规模与延迟对流式ASR跨语言迁移的影响,发现多语言初始化的优势受限于数据量而非延迟,且随着目标语言数据的增加而减弱。

0 人收藏 0 人点赞
#model-fine-tuning

Roland.W (@rwayne) on X

X AI KOLs ↗ · 2026-09-12 缓存

本文详细介绍了模型微调的基本概念和术语,包括预训练、监督微调、LoRA等关键知识点,适合初学者理解。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈