标签
QuixiAI发布SYN-1B,这是一个合成预训练数据集,旨在教导模型在长上下文中的规则跟踪、信念更新和证据保留,可在Hugging Face上获取。
本文通过引入基于证据的非平稳信念,解决了基于LLM的科学发现中静态惊奇度的局限性,并提出了信念更新过滤和多样性最大化来改进发现,在五个领域实现了30.62%更高的非平稳惊奇度。