frozen-llm

标签

Cards List
#frozen-llm

LODESTAR: Trustworthy Entropy Is Navigated, Not Merely Measured -- Reinforced Polarizer Keeps a Frozen LLM from Being Confidently Misled by the Wrong Evidence

arXiv cs.CL · 2026-08-13 缓存

This paper introduces Lodestar, a method that uses reinforcement learning to train a short polarizer prompt string that helps a frozen LLM avoid being misled by misleading retrieved passages in RAG question answering. It improves F1 and exact match scores across five QA benchmarks compared to existing entropy-based selection rules.

0 人收藏 0 人点赞
#frozen-llm

IRIS:基于冻结大语言模型的可复用身份表示用于实体对齐

arXiv cs.CL · 2026-07-29 缓存

IRIS是一个无需训练的框架,利用冻结的大语言模型为知识图谱中的实体构建可复用的身份表示,从而能够在不同知识图谱间实现高效的实体对齐,无需依赖配对处理。

0 人收藏 0 人点赞
#frozen-llm

多表问答的潜在桥梁

arXiv cs.CL · 2026-06-30 缓存

GRAB 使用 GNN 编码器将关系表转换为潜在标记,用于冻结的 LLM,在多表问答中取得了显著的性能提升。

0 人收藏 0 人点赞
#frozen-llm

PYTHALAB-MERA:面向冻结LLM代码代理的验证驱动记忆、检索与接受控制

arXiv cs.CL · 2026-05-12 缓存

本文介绍了 PYTHALAB-MERA,这是一种用于冻结本地大语言模型(LLM)的外部控制器,通过基于验证的记忆和检索机制来提升代码代理的性能。与自我修正基线方法相比,该方法利用执行反馈和时间差分学习,在严格验证任务中展现出更高的成功率。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈