BitTide
首页
最新
模型
工具
新闻
产品
论文
事件
今日日报
搜索
订阅
English
登录
large-scale-ai
标签
Cards
List
#large-scale-ai
逐步扩展:大规模 Mixture-of-Experts 的计算高效超参数迁移
Hugging Face Daily Papers
↗
· 4天前
缓存
本文提出了一种计算高效的两步超参数迁移框架,用于预测大型 Mixture-of-Experts 模型的最优学习率,从而无需昂贵的超参数搜索即可实现高效预训练。
0 人收藏
0 人点赞
← 返回首页
意见反馈
×
提交意见反馈
感谢您的反馈!
提交