仅通过聊天API的两个oracle查询能否重构闭源LLM的分词器?
摘要
本文探讨了仅使用闭源大语言模型聊天API的两个oracle查询来重构其分词器的可行性,该过程可能揭示模型的内部表示细节。
暂无内容
相似文章
不要让LLM说话,直接探测它(8分钟阅读)
本文介绍了一种技术,该技术从LLM的最后一个提示标记处提取隐藏状态,无需文本生成即可进行分类,使用一个小型MLP读取模型的内部决策,从而实现快速且廉价的零样本分类器。
学习如何让大语言模型进行推理
OpenAI 发布了一篇文章,通过密码破译示例探索大语言模型的推理技术,展示了语言模型的逐步问题求解和模式识别能力。
在受限API访问下对LLM架构属性的黑盒推断
本文介绍NightVision,一种利用受限黑盒API访问来估计大型语言模型隐藏维度、深度和参数数量的攻击方法。它采用新颖的公共集提示技术与频谱分析,在开源模型上实现了高精度。
如何在无潜在特征访问的封闭LLM API上进行OOD检测?
讨论了在无潜在特征访问的封闭LLM API上进行分布外检测的方法,重点介绍了SelfCheckGPT、令牌级熵、代理嵌入和验证器模型等技术,并指出OOD检测与幻觉检测的合并。
@MaximeRivest: 开源LLM中的工具调用在不同模型间差异巨大。我刚刚搭建了:http://chattemplatepl…
一个新的在线工具Chat Template Playground,让用户可视化查看不同开源LLM渲染其聊天模板的方式,突出显示了提示和分词上的差异。