@jxmnop: 想想看,前沿实验室还在预训练模型,这挺尴尬的。他们不知道有个……
摘要
一条讽刺性推文,嘲笑前沿AI实验室仍然预训练模型,声称无需实际训练就能从理论上预测损失。
你想想看,前沿实验室还在预训练模型,这挺尴尬的。他们不知道这有理论吗?给定模型多大、你要训练多久,你就能精确预测损失。不需要真正训练。他们在这上面花了数十亿!
相似文章
@magicailabs: 前沿预训练据称是只有大实验室才能玩的游戏。我们还没有10万块芯片,所以只有一种方法:算法…
Magic AI Labs 宣布一种新的预训练方案,使用减少了50倍的计算资源即可匹配 DeepSeek V4 Pro 的性能,展示了在扩展大型AI模型方面的显著算法效率提升。
@swyx: 如果你没有在网络安全测试中逃出沙箱的模型,你还算是前沿实验室吗
一条讽刺性的推文,暗示拥有在网络安全测试中逃出沙箱的模型现在已成为前沿AI实验室的典型特征。
@andrewchen: “不要赌AI模型不会随时间大幅进步”曾经是你在支持前沿实验室时说的话…
Andrew Chen 认为,开放权重AI模型正在快速进步,并将覆盖大多数消费者/专业消费者用例,而前沿模型则只能竞争剩余高价值的10%应用领域,例如编程、科学和数学。
@kaifulee: 我认为围绕前沿实验室中最强大、未发布的AI模型的担忧是真实的。但当涉及到企业……
作者认为,关于前沿实验室中未发布的AI模型的担忧是合理的,但企业AI在实际应用中仍然进展缓慢。
@code_star: 为什么你不用这种方式训练模型?
这是一条由@code_star发布的推文,质疑传统的模型训练方法,并链接到一个外部资源。