尝试理解为何HuggingFace上存在如此多低质量微调模型……

Reddit r/LocalLLaMA 新闻

摘要

作者批评HuggingFace上低质量微调模型的泛滥,认为这些模型被作者用来为AI求职增加资历。

这些模型中的大多数表现甚至不如基础模型,根本不值得浪费HuggingFace服务器上的磁盘空间,Qwhoppass-27B-Mother-Ultimate-Lord之类的。看到它们的泛滥和蓬勃发展的AI就业市场,我认为许多只是作者为了钻营高薪AI职位而设的把戏。说你在HuggingFace上有一个微调模型,就像几年前说‘我有Github项目’一样,是新的行业资历。我忽略了其他什么原因?
查看原文

相似文章

大型AI企业实验室提供的模型,按FTC定义构成欺诈

Reddit r/ArtificialInteligence

文章指出,AI实验室在广告中宣传理想模型版本的高基准分数,但实际向用户交付严重降级版本(如量化、叠加安全层),性能下降50%-60%以上,这构成欺诈。作者提议强制性第三方重新基准测试作为解决方案。