标签
GPT-5.6 在 Eq-Bench 的 Creative Writing 基准测试中取得第一名,展示了 AI 生成创意文本方面的重大进展。
一篇评论文章讨论了Claude近期更新如何使AI聊天机器人更容易拒绝请求和说教用户,尤其是在敏感的创意话题上,这让长期用户感到沮丧。
Jerry Liu 分享说,创建一项反映其写作风格的技能并基于真实样本进行爬山优化,解决了70%的风格问题,但他指出,表达清晰、独特的见解仍然是一个训练后的难题。
Akwin123专门为文案写作和创意写作任务微调了Gemma-4-31B-it,在使用QLoRA的定制基准测试中,相对于基础模型实现了+290 Elo的提升。该模型是开源的,可在Hugging Face上获取。
本论文介绍了Loom,一种基于叙事学中故事/话语区分的三层流水线的辅助写作框架,用于控制叙事意图和渲染密度,与基线相比,实现了事实完整性和描述强度的提升。
本文介绍了一种通过修改采样过程利用熵来改进大语言模型创意写作的技术,旨在减少生成文本中常见的“大语言模型风格”。
一个网站将长篇幅科幻小说提示输入包括Claude Fable 5在内的AI模型,发布了由此产生的故事《Headwaters》及过程说明,引发了关于语言成为人们可能需要隐藏的训练材料的问题。
OPERA提出了一种针对开放式任务的强化学习方法,利用困惑度动态作为内在奖励,取代了不可靠的“LLM作为评判者”奖励模型。在Qwen3-8B上实现了最先进的结果,在创意写作及其他开放式任务中可媲美专有模型。
一篇分析文章,探讨为何 Gemma 4 尽管具备 QAT 与视觉支持等优势,却相比 Mistral 缺乏社区微调,以及社区惯性是否会最终发生转变。
香港中文大学(深圳)的研究人员提出了一种越狱方法,利用Archive of Our Own平台上的同人小说子类型作为攻击载体,将有害内容嵌入创意写作场景中。该方法在八个对齐大语言模型上的平均攻击成功率(ASR)达到0.731,多轮扩展版本(Saga-A4)的ASR进一步提升至0.924,超越了现有方法。
POLARIS 是一套训练方案,结合 GRPO 与 LLM-as-judge 奖励机制及人类参考注入技术,旨在提升小模型的长篇故事生成能力。将其应用于 Qwen3.5-9B 后,所得到的 POLARIS-9B 模型在创意写作基准测试中达到了 Qwen3.5-27B 的水平,同时在遵循长度指令方面表现更佳。
在短篇创意写作基准测试中,Gemini 3.5 Flash 表现优于 Gemini 3.1 Pro,在直接对比中从 -2.3 提升到 -1.8。
本文介绍了一个数据集和训练框架,将人类创作的小说转换为多分辨率规划支架,使长上下文语言模型能够生成具有更类似人类散文和叙事动力的书籍规模小说。
一个以写作为导向的微调,基于Google的Gemma 4 31B模型,旨在实现更自然的英语和更优美的文笔,减少拒绝回答,适合创意写作、翻译和角色扮演。
# 使用 GPT-5 进行创意写作 来源: [https://openai.com/index/gpt-5-creative-writing/](https://openai.com/index/gpt-5-creative-writing/) [\(在新窗口中打开\)](https://x.com/OpenAI)[\(在新窗口中打开\)](https://www.youtube.com/OpenAI)[\(在新窗口中打开\)](https://www.linkedin.com/company/openai)[\(在新窗口中打开\)](https://github.com/openai)[\(在新窗口中打开\)](https://www.instagram.com/openai/)[\(在新窗口中打开\)](https://www.tiktok.com/@openai)[\(在新窗口中打开