@QuixiAI:宣布推出QuixiAI/SYN-1B——一个合成预训练数据集,旨在教导模型跟踪规则、更新信念……
摘要
QuixiAI发布SYN-1B,这是一个合成预训练数据集,旨在教导模型在长上下文中的规则跟踪、信念更新和证据保留,可在Hugging Face上获取。
宣布推出QuixiAI/SYN-1B——一个合成预训练数据集,旨在教导模型跟踪规则、在修正后更新信念、在长上下文中保留证据、忽略合理的干扰项,以及迁移超越记忆表面形式的抽象状态更新模式。🆀发布在@huggingface上。
相似文章
@neural_avb: https://x.com/neural_avb/status/2072294078805684613
本论文介绍了Autodata,这是一种利用智能“数据科学家”AI的方法,通过迭代生成、验证和优化来自动创建高质量合成数据集,该方法特别针对强化学习(GRPO)进行了优化,以提升语言模型的推理能力。
[大数据集发布] - SupraLabs/reasoning-corpus-4K-5M-v1 - 训练你的小型 SLM 学会思考!
SupraLabs 发布了 reasoning-corpus-4K-5M-v1,一个包含 500 万样本的推理数据集,用于训练小型语言模型 (SLM),包含思维链追踪和 ChatML 格式,托管在 Hugging Face 上。
推出 SimpleQA
OpenAI 推出 SimpleQA,一个新的事实性基准数据集,包含 4,326 个简短事实性问题,旨在评估前沿语言模型在提供准确答案而不产生幻觉的能力。该数据集通过双独立标注、严格标准实现高质量,估计错误率仅为 ~3%,GPT-4o 得分不到 40%。
制作用于微调的合成数据集
作者提出了一种使用形式求解器为LLM生成多样化合成推理训练数据的流程,并询问现有工作以及关于避免重复模板的建议。
@neural_avb:观看这个45分钟的视频,学习如何创建合成数据集并训练针对狭窄任务的小型(1亿参数)本地语言模型…
一个45分钟的视频教程,关于创建合成数据集并训练针对狭窄任务的小型(1亿参数)本地语言模型,提供了代码和资源。