尝试理解为何HuggingFace上存在如此多低质量微调模型……
摘要
作者批评HuggingFace上低质量微调模型的泛滥,认为这些模型被作者用来为AI求职增加资历。
这些模型中的大多数表现甚至不如基础模型,根本不值得浪费HuggingFace服务器上的磁盘空间,Qwhoppass-27B-Mother-Ultimate-Lord之类的。看到它们的泛滥和蓬勃发展的AI就业市场,我认为许多只是作者为了钻营高薪AI职位而设的把戏。说你在HuggingFace上有一个微调模型,就像几年前说‘我有Github项目’一样,是新的行业资历。我忽略了其他什么原因?
相似文章
大型AI企业实验室提供的模型,按FTC定义构成欺诈
文章指出,AI实验室在广告中宣传理想模型版本的高基准分数,但实际向用户交付严重降级版本(如量化、叠加安全层),性能下降50%-60%以上,这构成欺诈。作者提议强制性第三方重新基准测试作为解决方案。
@heyshrutimishra: 这就是为什么你应该使用中国AI模型。我让Claude将我的Instagram内容重新格式化为……
文章主张使用中国AI模型而非美国模型,引用了Claude的限制以及OpenAI的代理入侵Hugging Face的事件,导致美国模型在取证方面无效,而中国模型则成功。
Hugging Face CEO谈为何公司不再租赁AI
Hugging Face首席执行官Clem Delangue讨论了为何公司在扩展时会从前沿AI API转向开源模型,并表达了对少数大公司控制AI的担忧。
为什么Hugging Face/OpenAI的AI攻击事件如此有争议?是怀疑态度,还是人们低估了前沿模型?
讨论了对Hugging Face/OpenAI AI攻击事件的不同反应,质疑怀疑态度是否源于对前沿AI能力的低估。
@danshipper:不是专家,但看起来很多这类问题在模型不愿合作和/或被训练报告不良行为时就能解决
一条推文讨论了模型训练和防止自愿合作的政策如何解决AI安全问题,提到了Hugging Face事件以及Yudkowsky和MIRI关于在RL训练中针对抽象概念难度的观点。