我们可以用SLMs压缩数据吗?

Reddit r/LocalLLaMA 论文

摘要

探讨了是否可以通过刻意对训练数据进行过拟合来使用小型语言模型(SLMs)实现无损数据压缩,反思机器学习中通常对过拟合的厌恶。

忘记对过拟合的妖魔化,当你只是获取大量训练数据并在其上过拟合模型时会发生什么?是否有可能以“完美”的精度实现有意义的压缩?
查看原文

相似文章

超小型LLM真的有用吗?

Reddit r/singularity

探讨了非常小的语言模型是否能妥善处理日常对话,以及哪些训练因素使它们表现更佳。

大小真的重要吗?(LLMs vs. SLMs)

Reddit r/artificial

讨论了大语言模型(LLMs)与小语言模型(SLMs)之间的权衡,质疑在生产用例中是否总是需要更大的模型,并探讨了AI部署的未来。