推出Pangram 4(2分钟阅读)

TLDR AI 模型

摘要

Pangram Labs宣布推出Pangram 4,这是其迄今为止最强大的AI检测器,大幅降低了假阳性率和假阴性率,在前沿模型上实现稳健检测,并新增图像扫描功能。

Pangram是一款AI检测器,大约每24,000份文档才出现一次假阳性。
查看原文
查看缓存全文

缓存时间: 2026/07/30 18:26

# 正式推出 Pangram 4 | Pangram Labs 来源:https://www.pangram.com/blog/introducing-pangram-4 今天,我们正式发布 Pangram 4:这是我们迄今为止最强大、最准确的 AI 检测器。 Pangram 4 的规模比前代大六倍以上,在拟人化检测、AI 辅助文本识别,以及人机混合内容的边界检测方面实现了显著提升。它还能稳健地检测最新的前沿模型。我们相信它是同类型产品中全球最佳选择。 完整的评估数据、训练细节及已知局限性,请参阅 [Pangram 4 技术博客](https://www.pangram.com/blog/pangram-4-technical) 和 [Pangram 4 模型卡](https://www.pangram.com/research/model-card/pangram-4)。您也可以 [在此查看完整的技术报告](https://pangram-public.s3.us-east-1.amazonaws.com/pdf/pangram_4_technical_report.pdf)。 ## 结果 在内部基准测试中,Pangram 4 的误报率仅为 0.0041%,即大约每 24,000 份文档中才出现一次误报。 Pangram 4 在漏报方面也显著降低,在全新的挑战数据集上,漏报率仅为 0.3396%,相比之下 Pangram 3 的漏报率为 1.99%。 据我们所知,Pangram 4 是首款能够单次同时区分 AI 编辑内容和人机混合内容的 AI 检测模型。 它对拟人化工具和对抗性提示具有鲁棒性,在 13 种主流商业工具中,能够以 98.83% 的概率识别出拟人化输出中的 AI 参与。 它在各前沿模型上均具备泛化能力:每个模型系列的漏报率均低于 0.7%,且模型发布日期与可检测性之间没有显著相关性。 ## 定价 除了新模型的推出,我们还调整了积分的计算方式以及套餐中的积分数量。每次扫描不再向上取整至 1,000 词,而是每 100 词计为一次扫描,让您更充分地利用积分。我们还调整了扫描容量,以更好地反映模型升级和当前用户行为。 最后,我们很高兴地宣布,所有套餐都将新增图像扫描功能,且价格不变。 以下是套餐变更的前后对比: **变更前的月度套餐** - **个人版:**600 次扫描(每次 1,000 词) - **专业版:**3,000 次扫描(每次 1,000 词) **变更后的月度套餐** - **个人版:**可扫描最多 300,000 词 + 100 次图像扫描 - **专业版:**每月可扫描最多 1,500,000 词 + 500 次图像扫描 同样的积分变更也适用于 API。API 调用按每 100 词 0.05 美元计价,这意味着短文档的价格变化为 1-2 倍,长文档最多可达 10 倍。 我们将在未来两个月内继续支持 Pangram 3,预定弃用日期为 2026 年 9 月 30 日。在 Pangram 3 被弃用之前,未指定模型的默认请求将继续使用之前的计费系统路由至 Pangram 3。 完整的评估数据、训练细节及已知局限性,请参阅 [Pangram 4 技术博客](https://www.pangram.com/blog/pangram-4-technical) 和 [Pangram 4 模型卡](https://www.pangram.com/research/model-card/pangram-4)。您也可以 [在此查看完整的技术报告](https://pangram-public.s3.us-east-1.amazonaws.com/pdf/pangram_4_technical_report.pdf)。

相似文章

Pangram 4 技术报告

arXiv cs.CL

Pangram Labs 推出 Pangram 4,这是一款最先进的 AI 文本检测模型,AUROC 达到 0.9916,误报率和漏报率极低,并且提高了对对抗性攻击的鲁棒性以及混合作者身份的检测能力。

探索Pangram 3.3.2的内部表示

Hacker News Top

Pangram Labs探索其AI检测模型Pangram 3.3.2的内部表示,分析模型如何在不同层中区分人工文本与AI文本,使用来自多种来源的5,000份文档的平衡数据集。

基础模型被AI检测器视为人类

arXiv cs.CL

这篇论文揭示,GPTZero和Pangram等商用AI检测器将基础语言模型生成的文本判定为几乎完全是人类撰写,而经过指令微调的模型输出则被标记为AI生成。作者提出了HIP,一种与检测器无关的迭代改写流程,能在保持语义的同时提升文本的类人性。