标签
对Web规模LLM预训练数据中叙事特征的细粒度研究,引入了NarraBERT和NarraDolma来测量叙事模式及其在不同来源中的分布。
本文提出了一种衡量AI生成故事中文化本地化程度的方法,检测到仅有一小部分词汇区分国籍,而叙述依赖于共享模板,并发现许多全球南方国家的文化标记往往具有冒犯性。
本文介绍了StoryScope,一个分析语篇层面叙事特征以区分AI生成小说和人类创作故事的流程。它达到了很高的准确率,并揭示了不同大语言模型(如Claude、GPT和Gemini)独特的叙事指纹。
本文介绍了一种名为“叙事景观”的定量框架和可视化工具,用于映射并比较前沿大语言模型的叙事倾向及其稳定性。