dpo-fine-tuning

标签

Cards List
#dpo-fine-tuning

@0x0SojalSec: 完全本地化的26B MoE模型,专为红队测试和漏洞挖掘打造。基于精英漏洞报告和真实规避技术训练…

X AI KOLs Timeline · 2026-06-17 缓存

BugTraceAI Apex 是一个完全本地化的26B混合专家模型,通过DPO微调,用于红队测试和漏洞挖掘,基于精英漏洞报告和规避技术训练。通过量化可在消费级GPU上运行。

0 人收藏 0 人点赞
#dpo-fine-tuning

将韩国文化融入LLM对齐:迈向文化一致性

arXiv cs.CL · 2026-06-08 缓存

本文提出一种数据集生成管道,通过DPO微调使大语言模型与韩国文化规范对齐,在提升文化安全性的同时不损害通用性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈