我的LLM一直实现它遇到的每个方法,所以我添加了研究和规范门控[D]

Reddit r/MachineLearning 工具

摘要

一位LLM开发者添加了研究和规范门控,以防止模型实现它遇到的每个方法,从而提高了代码生成质量。

暂无内容
查看原文

相似文章

Fence:面向LLM应用的专用SLM护栏

arXiv cs.AI

Fence提出使用在高质量合成数据上训练的小语言模型作为LLM应用的专用护栏,展示了相对于基于提示的LLM护栏的性能提升。

DLLG:LLM专家的动态Logit级门控机制

arXiv cs.CL

DLLG(动态Logit级门控)是一种新颖的框架,通过轻量级可学习门控模块,在token级别的logit空间中动态融合多个专门化LLM,在推理和代码基准测试中超越了路由、启发式集成和参数合并等基线方法。该方法仅需稀疏的响应级监督信号,且在无需重新训练的情况下保留了专家模块的独立性。