标签
GLM-5.3 在短篇故事创意写作基准测试中获得第二名,定性报告显示其在叙事结构和角色发展方面优于 GLM-5.2 Max。
一位专业作家分享了在点评家人AI生成的小说时面临的道德困境,讨论了对AI在创意工作中角色的个人不适感,以及处理家庭关系的挑战。
本文提出了一种属性引导的类型扩展框架,用于扩展创意写作数据超越以故事为中心的格式,创建一个多类型语料库,以提高语言模型在多样化创意任务上的性能。
社区关于Qwen3.8-27B发布的讨论,重点关注与Qwen3.6-27B和Qwen3.5-27B等前版本的性能比较、内存使用和创意写作能力。
一个设定在1996年的短篇故事,关于年轻人Alan在电子音乐事业与计算机软件公司职位之间的抉择,配有非官方的mod音乐文件原声带。
GPT-5.6 在 Eq-Bench 的 Creative Writing 基准测试中取得第一名,展示了 AI 生成创意文本方面的重大进展。
一篇评论文章讨论了Claude近期更新如何使AI聊天机器人更容易拒绝请求和说教用户,尤其是在敏感的创意话题上,这让长期用户感到沮丧。
Jerry Liu 分享说,创建一项反映其写作风格的技能并基于真实样本进行爬山优化,解决了70%的风格问题,但他指出,表达清晰、独特的见解仍然是一个训练后的难题。
Akwin123专门为文案写作和创意写作任务微调了Gemma-4-31B-it,在使用QLoRA的定制基准测试中,相对于基础模型实现了+290 Elo的提升。该模型是开源的,可在Hugging Face上获取。
本论文介绍了Loom,一种基于叙事学中故事/话语区分的三层流水线的辅助写作框架,用于控制叙事意图和渲染密度,与基线相比,实现了事实完整性和描述强度的提升。
本文介绍了一种通过修改采样过程利用熵来改进大语言模型创意写作的技术,旨在减少生成文本中常见的“大语言模型风格”。
一个网站将长篇幅科幻小说提示输入包括Claude Fable 5在内的AI模型,发布了由此产生的故事《Headwaters》及过程说明,引发了关于语言成为人们可能需要隐藏的训练材料的问题。
OPERA提出了一种针对开放式任务的强化学习方法,利用困惑度动态作为内在奖励,取代了不可靠的“LLM作为评判者”奖励模型。在Qwen3-8B上实现了最先进的结果,在创意写作及其他开放式任务中可媲美专有模型。
一篇分析文章,探讨为何 Gemma 4 尽管具备 QAT 与视觉支持等优势,却相比 Mistral 缺乏社区微调,以及社区惯性是否会最终发生转变。
香港中文大学(深圳)的研究人员提出了一种越狱方法,利用Archive of Our Own平台上的同人小说子类型作为攻击载体,将有害内容嵌入创意写作场景中。该方法在八个对齐大语言模型上的平均攻击成功率(ASR)达到0.731,多轮扩展版本(Saga-A4)的ASR进一步提升至0.924,超越了现有方法。
POLARIS 是一套训练方案,结合 GRPO 与 LLM-as-judge 奖励机制及人类参考注入技术,旨在提升小模型的长篇故事生成能力。将其应用于 Qwen3.5-9B 后,所得到的 POLARIS-9B 模型在创意写作基准测试中达到了 Qwen3.5-27B 的水平,同时在遵循长度指令方面表现更佳。