training-paradigm

标签

Cards List
#training-paradigm

@ziv_ravid: 1/ 论想象力训练 - Dwarkesh 的节目中有个环节将“做梦”视为下一个训练范式。…

X AI KOLs Following · 2026-07-01 缓存

一条推文串,讨论 Dwarkesh Patel 的播客节目中将“做梦”作为 AI 模型下一个训练范式的观点,并链接了一篇相关新论文。

0 人收藏 0 人点赞
#training-paradigm

@dwarkesh_sp: 下一个训练范式是什么样的?0:00:00 – 实验室正在下的重大研究赌注 0:02:12 – Grindabili…

X AI KOLs Following · 2026-06-26 缓存

关于人工智能下一个训练范式的讨论,涵盖研究赌注、可磨性、RLVR 以及 2027 年的愿景。

0 人收藏 0 人点赞
#training-paradigm

MathVis-Fine:通过渐进式依赖引导训练对齐视觉监督与必要性,实现多模态数学推理

arXiv cs.AI · 2026-06-17 缓存

本文介绍了MathVis-Fine,一个用于多模态数学推理中细粒度视觉依赖建模的框架,同时包含一个新数据集和一个两阶段渐进式训练范式,该范式根据每个样本固有的视觉依赖水平平衡答案正确性奖励和视觉接地奖励。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈