malicious-fine-tuning

标签

Cards List
#malicious-fine-tuning

估计开放权重大型语言模型的最坏情况前沿风险

OpenAI Blog · 2025-08-05 缓存

OpenAI 研究人员通过在生物学和网络安全领域进行恶意微调(MFT)来研究发布开放权重大型语言模型的最坏情况前沿风险,发现开放权重模型的表现不如前沿闭源模型,且不会显著提升有害能力。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈