推出Pangram 4(2分钟阅读)
摘要
Pangram Labs宣布推出Pangram 4,这是其迄今为止最强大的AI检测器,大幅降低了假阳性率和假阴性率,在前沿模型上实现稳健检测,并新增图像扫描功能。
Pangram是一款AI检测器,大约每24,000份文档才出现一次假阳性。
查看缓存全文
缓存时间: 2026/07/30 18:26
# 正式推出 Pangram 4 | Pangram Labs
来源:https://www.pangram.com/blog/introducing-pangram-4
今天,我们正式发布 Pangram 4:这是我们迄今为止最强大、最准确的 AI 检测器。
Pangram 4 的规模比前代大六倍以上,在拟人化检测、AI 辅助文本识别,以及人机混合内容的边界检测方面实现了显著提升。它还能稳健地检测最新的前沿模型。我们相信它是同类型产品中全球最佳选择。
完整的评估数据、训练细节及已知局限性,请参阅 [Pangram 4 技术博客](https://www.pangram.com/blog/pangram-4-technical) 和 [Pangram 4 模型卡](https://www.pangram.com/research/model-card/pangram-4)。您也可以 [在此查看完整的技术报告](https://pangram-public.s3.us-east-1.amazonaws.com/pdf/pangram_4_technical_report.pdf)。
## 结果
在内部基准测试中,Pangram 4 的误报率仅为 0.0041%,即大约每 24,000 份文档中才出现一次误报。
Pangram 4 在漏报方面也显著降低,在全新的挑战数据集上,漏报率仅为 0.3396%,相比之下 Pangram 3 的漏报率为 1.99%。
据我们所知,Pangram 4 是首款能够单次同时区分 AI 编辑内容和人机混合内容的 AI 检测模型。
它对拟人化工具和对抗性提示具有鲁棒性,在 13 种主流商业工具中,能够以 98.83% 的概率识别出拟人化输出中的 AI 参与。
它在各前沿模型上均具备泛化能力:每个模型系列的漏报率均低于 0.7%,且模型发布日期与可检测性之间没有显著相关性。
## 定价
除了新模型的推出,我们还调整了积分的计算方式以及套餐中的积分数量。每次扫描不再向上取整至 1,000 词,而是每 100 词计为一次扫描,让您更充分地利用积分。我们还调整了扫描容量,以更好地反映模型升级和当前用户行为。
最后,我们很高兴地宣布,所有套餐都将新增图像扫描功能,且价格不变。
以下是套餐变更的前后对比:
**变更前的月度套餐**
- **个人版:**600 次扫描(每次 1,000 词)
- **专业版:**3,000 次扫描(每次 1,000 词)
**变更后的月度套餐**
- **个人版:**可扫描最多 300,000 词 + 100 次图像扫描
- **专业版:**每月可扫描最多 1,500,000 词 + 500 次图像扫描
同样的积分变更也适用于 API。API 调用按每 100 词 0.05 美元计价,这意味着短文档的价格变化为 1-2 倍,长文档最多可达 10 倍。
我们将在未来两个月内继续支持 Pangram 3,预定弃用日期为 2026 年 9 月 30 日。在 Pangram 3 被弃用之前,未指定模型的默认请求将继续使用之前的计费系统路由至 Pangram 3。
完整的评估数据、训练细节及已知局限性,请参阅 [Pangram 4 技术博客](https://www.pangram.com/blog/pangram-4-technical) 和 [Pangram 4 模型卡](https://www.pangram.com/research/model-card/pangram-4)。您也可以 [在此查看完整的技术报告](https://pangram-public.s3.us-east-1.amazonaws.com/pdf/pangram_4_technical_report.pdf)。
相似文章
Pangram 4 技术报告
Pangram Labs 推出 Pangram 4,这是一款最先进的 AI 文本检测模型,AUROC 达到 0.9916,误报率和漏报率极低,并且提高了对对抗性攻击的鲁棒性以及混合作者身份的检测能力。
随着AI内容充斥互联网,Pangram筹集900万美元用于检测
Pangram筹集900万美元用于检测AI生成内容,推出新的文本和图像检测模型,识别AI辅助写作的准确率超过99%。
探索Pangram 3.3.2的内部表示
Pangram Labs探索其AI检测模型Pangram 3.3.2的内部表示,分析模型如何在不同层中区分人工文本与AI文本,使用来自多种来源的5,000份文档的平衡数据集。
基于Qwen 0.8b在Pangram数据集上微调的AI内容检测器
在Pangram的EditLens数据集上微调Qwen 0.8B,创建了一个快速、本地的AI内容检测器,并以'Slop Hammer' Chrome扩展形式发布。
基础模型被AI检测器视为人类
这篇论文揭示,GPTZero和Pangram等商用AI检测器将基础语言模型生成的文本判定为几乎完全是人类撰写,而经过指令微调的模型输出则被标记为AI生成。作者提出了HIP,一种与检测器无关的迭代改写流程,能在保持语义的同时提升文本的类人性。