标签
本文评估了大语言模型在罗马乌尔都语(一种资源匮乏语言)中的仇恨言论检测能力,证明使用LoRA的参数高效微调相比零样本推理显著提升了分类性能。
sbgrid 是一个 Krea 2 Turbo LoRA,可以从单个提示生成一个包含 8 个面板的故事板图像,托管为 Hugging Face Space。
本文研究了LoRA中的奇异分量,并提出SCLoRA,一种使用光谱裁剪来提高任务自适应能力同时减少预训练知识灾难性遗忘的方法。
LoRA-Diffusion 提出了一种针对扩散语言模型的参数高效微调方法,通过对去噪轨迹而非模型权重进行低秩分解,仅使用 1.2% 的轨迹适配器参数即可获得具有竞争力的性能。
一位开发者声称使用LoRA构建了真正的持续学习模型原型,让Qwen4B无需重新训练即可获得即时、可泛化的记忆,并邀请独立研究人员验证该机制。
本文提出了一种市场信息感知的门控LoRA框架,将Chronos-2时序基础模型适配到日前电价预测,提高了中国省级市场的跨市场可迁移性。
CoAdapt-GUI is a test-time adaptation framework for mobile GUI agents that jointly adapts workflow context and policy, improving performance on unseen-app benchmarks like AndroidWorld-Generalization and AndroidWorld Plus.
这篇arXiv论文对八种开源小语言模型在不同微调策略下进行了基准测试,用于急诊科决策支持,发现LoRA微调的小语言模型在分诊和转诊任务上可以超越商业基线模型,同时保持本地可部署性。
SeFoRA 是一种提出的联邦 LoRA 算法,利用草图聚合来处理异构客户端秩并缓解双线性失配问题。它包含一个具有收敛保证的秩同质变体,并在 RoBERTa-Large 微调上展示了最先进的性能。
本文提出在轻量级微调(如 LoRA)下利用路由器权重灵敏度来识别并剪枝混合专家模型中的专家,从而在最小化精度损失的同时显著降低内存和延迟。
提出了Self-Geometry,一种即插即用的测试时自适应流程,利用2D像素对应关系施加显式的多视图几何约束,以改进几何一致的3D视觉基础模型。
一位开发者从零开始训练了一个1.1B参数的LLM,使用了200亿个token,成本约为200美元。该模型使用fineweb-edu进行预训练,并在OpenHermes上进行了LoRA微调。该项目包含开源代码、模型权重和一个演示网站。
TwiL-LM 是一个针对 SmolLM2-1.7B-Instruct 的参数高效 LoRA 适配器,专为形式逻辑和推理任务设计,在形式逻辑套件上取得了 0.361 的 macro-primary 分数。
fal 发布了新的 LoRA 适配器 MiniMax-H3-Realism-People-LoRA,增强 MiniMax H3 视频模型,用于逼真的人物肖像、面部和日常场景。包含训练细节、通过 fal.ai LoRA 端点的用法,以及前后对比。
This paper investigates the warm-up stage for on-policy distillation (OPD), showing that teacher-compatible chain-of-thought supervision and LoRA-based training with near-saturation duration improve OPD effectiveness. It introduces Simple-OPD, a plug-and-play initialization method that boosts OPD performance across diverse settings.
一个Hugging Face仓库,托管了为ComfyUI使用而转换的MiniMax-H3模型,以及用于加快推理的Lightx2v蒸馏LoRA。
SemiAdapt-Instruct proposes a modular framework that discovers latent instruction domains, trains per-domain LoRA adapters in parallel, and routes among them without extra parameters, enabling extensible instruction tuning where new domains require only single-adapter updates instead of full retraining.
本文提出DiSR,一个将3D感知与推理分离的框架,利用现成的感知模型重建显式3D证据,并通过LoRA微调LLM进行空间推理,在提升可解释性和效率的同时取得了具有竞争力的性能。
LightX2V releases an open, local LoRA prompt rewriter for MiniMax-H3 text-to-audio-video generation, fine-tuned on Qwen3.6-27B to expand short prompts into structured audio-video descriptions.
YOLO-PEFT 是一个结构感知框架,将适配器放置建模为约束规划问题,用于 YOLO 检测器的参数高效微调,在降低内存占用的同时取得了优于全量微调的 mAP。