适合 <2000 token 的轻量级摘要小模型
摘要
一位新手在尝试用 Qwen2.5-7B-Instruct 给员工笔记做摘要时遭遇幻觉,现求助适用于 2000 token 以内、能合并同类标签的小模型及提示策略。
新手求助:我想给员工笔记做自动摘要。每次有 10–50 条笔记(约 3000–15000 token),已打好标签,需要汇总成 200–1000 token 的通用报告。模型要能判断“过于细节”的内容,并把同一标签下的多条笔记归纳成一类。
我试过 [Qwen/Qwen2.5-7B-Instruct](https://huggingface.co/Qwen/Qwen2.5-7B-Instruct) 加提示词,结果幻觉严重,降 temperature 也没用。针对这种任务,有什么模型和提示策略推荐?
相似文章
用于令牌高效且语义保持的观点摘要的大语言模型
本文提出一个利用大语言模型进行观点摘要的框架,该框架结合多维分类和分层采样,在降低令牌使用量的同时保持语义多样性和观点间的平衡。
SLM的消亡?
作者反思了27B以下的小语言模型是否正被Qwen 3.5和Gemma 4等更大模型所掩盖,并询问社区中有哪些适合智能体编码任务的高性能SLM。
训练了我的第一个小型语言模型
作者训练了一个小型语言模型来替代Gemini Flash进行摘要任务,达到了97%的准确率和0.06秒的延迟,适合在内部应用中部署。
利用更优词元加速学习:面向专业文本摘要的参数高效词表适配
本文提出了一种针对专业领域LLM文本摘要的参数高效词表适配方法,通过扩充预训练分词器中的领域专用词元并选择性替换训练不足的词元,将训练时间减少35-55%,参数数量减少高达37%。
LexLattice:基于文档层次结构的神经元胞自动机多语言抽取式摘要
LexLattice 提出了一种多语言抽取式摘要方法,该方法利用文档层次结构上的神经元胞自动机,在 EUR-Lex-Sum 数据集上实现了最先进的 ROUGE 分数,并通过紧凑模型超越了大型指令调优基线。