llm-distillation

标签

Cards List
#llm-distillation

买谣言,卖新闻:新闻何时被定价?

arXiv cs.AI · 2026-08-17 缓存

本文测试了金融新闻在发布前已被定价的格言,利用大语言模型蒸馏来分类新闻事件并分析市场反应。研究发现,价格变动集中在发布前和发布时,基本面新闻与故事驱动型新闻呈现不同模式。

0 人收藏 0 人点赞
#llm-distillation

[2606.05682] 超越输出匹配:在NVFP4 LLM蒸馏中保持内部几何结构

Reddit r/LocalLLaMA · 2026-08-09 缓存

本文研究了针对NVFP4低精度大语言模型的量化感知蒸馏,并发现仅使用KL损失的输出匹配可能掩盖内部表征漂移。作者提出了CKA-QAD,通过CKA引导的对齐来保持内部几何结构,从而提升了紧凑模型在推理和编码任务上的准确性。

0 人收藏 0 人点赞
#llm-distillation

Trace2Policy:从专家行为痕迹到自我进化决策代理

arXiv cs.AI · 2026-06-10 缓存

Trace2Policy 从专家行为痕迹中提取人类可读的决策规则,并通过错误驱动的技能精炼进行迭代优化,在物流领域的合规敏感任务上优于纯LLM基线。

0 人收藏 0 人点赞
#llm-distillation

重新思考温度在大语言模型蒸馏中的作用

arXiv cs.LG · 2026-06-02 缓存

本文重新审视了温度在大语言模型蒸馏中的作用,揭示出温度不对称地更有利于正向KL散度而非反向KL,使得简单的KL方法在较高温度下能够匹敌当前最先进的蒸馏方法。

0 人收藏 0 人点赞
#llm-distillation

黑盒LLM蒸馏的有界行为不可区分性

arXiv cs.LG · 2026-06-01 缓存

本文提出有界行为不可区分性,一种超越语义相似性的黑盒LLM蒸馏评估形式化框架。在Qwen和Llama模型上的实验表明,蒸馏降低了但并未消除对抗性可区分性,凸显了类别感知评估的必要性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈