标签
本文使用n-gram分布分析LLM生成文本中的统计模式,揭示了其风格缺陷,并表明风格与语义不可分离。
本文研究了现有AI文本检测器在专利权利要求上的高误报率——专利权利要求在法律上要求像LLM输出一样清晰简洁——并提出了一种基于语言复杂性特征的逻辑回归分类器,在消费级硬件上优于基于困惑度的检测器。