标签
Rohan Paul 解释了 AI 生成的小说为什么读起来像流水线垃圾——单提示的聊天机器人设计、上下文窗口有限,以及无法记住长篇故事中埋下的伏笔——并重点介绍了 Sherpa,该系统使用专门的智能体(创意、结构、研究、行文、审阅)加上一个叙事世界模型来追踪故事历史和连贯性。
本文报道了短篇小说创意写作基准测试的最新分数,显示了Opus 5.5、Grok 4.7和Gemini 3.8 Flash等AI模型的改进,排行榜涵盖了56个模型和超过100,000次评估判断。
Dan Shipper将Plato的《Protagoras》小说化,并使用Opus 5.5 AI模型生成了一个基于此的电影场景。
Hemmingway-1是一款专为创意写作设计的27B开放权重模型,在EQ-Bench 4上获得1330分,并声称在与前沿模型的盲测中具有类人性能。
来自瑞士和南非的一个小实验室开源了 Hemmingway-1,这是一个基于 Qwen3.8-27B 的 27B Apache-2.0 许可证微调模型,专注于创意写作,在 EQ-Bench 和内部基准测试中取得了高分。
本次基准发布比较了24个大语言模型与人类作家在475个创意写作提示上的表现,使用自定义奖励模型显示前沿模型优于业余作家,但不及专业作家。
Film Screenwriter 是一款 AI 智能体,帮助用户从概念阶段开始撰写故事片,直至生成制作就绪的剧本。它引导您完成前提设定、大纲构建、草稿撰写和反复修订,并具备跨会话的持久记忆和行业标准格式。
作者测试了Muse-glimmer-30b模型在创意写作方面的表现,发现它令人印象深刻,在模仿作家风格方面优于其他本地模型如qwen3.8-27b。
GLM-5.3 在短篇故事创意写作基准测试中获得第二名,定性报告显示其在叙事结构和角色发展方面优于 GLM-5.2 Max。
一位专业作家分享了在点评家人AI生成的小说时面临的道德困境,讨论了对AI在创意工作中角色的个人不适感,以及处理家庭关系的挑战。
本文提出了一种属性引导的类型扩展框架,用于扩展创意写作数据超越以故事为中心的格式,创建一个多类型语料库,以提高语言模型在多样化创意任务上的性能。
社区关于Qwen3.8-27B发布的讨论,重点关注与Qwen3.6-27B和Qwen3.5-27B等前版本的性能比较、内存使用和创意写作能力。
一个设定在1996年的短篇故事,关于年轻人Alan在电子音乐事业与计算机软件公司职位之间的抉择,配有非官方的mod音乐文件原声带。
GPT-5.6 在 Eq-Bench 的 Creative Writing 基准测试中取得第一名,展示了 AI 生成创意文本方面的重大进展。
一篇评论文章讨论了Claude近期更新如何使AI聊天机器人更容易拒绝请求和说教用户,尤其是在敏感的创意话题上,这让长期用户感到沮丧。
Jerry Liu 分享说,创建一项反映其写作风格的技能并基于真实样本进行爬山优化,解决了70%的风格问题,但他指出,表达清晰、独特的见解仍然是一个训练后的难题。
Akwin123专门为文案写作和创意写作任务微调了Gemma-4-31B-it,在使用QLoRA的定制基准测试中,相对于基础模型实现了+290 Elo的提升。该模型是开源的,可在Hugging Face上获取。
本论文介绍了Loom,一种基于叙事学中故事/话语区分的三层流水线的辅助写作框架,用于控制叙事意图和渲染密度,与基线相比,实现了事实完整性和描述强度的提升。
本文介绍了一种通过修改采样过程利用熵来改进大语言模型创意写作的技术,旨在减少生成文本中常见的“大语言模型风格”。