标签
本文通过将AI代理的'Harness'与登山安全带进行比较,来解释其概念,详细介绍了系统提示和工具等组件,这些组件使AI模型能够作为代理运行。
Sharp v22.1 模板将 Qwen 模型输出令牌减少 42% 而不损失速度,通过 C++ 修改集成到针对 5090 的 NInfer 分支中。
Kent C. Dodds 讨论了一篇研究论文,该论文表明 AGENTS.md 通常不能提高任务成功率,反而增加了超过20%的推理成本,并询问实际应该将什么内容放入 AGENTS.md 中,同时指出 Claude Code 已将其系统提示减少了80%。
推文介绍了 Deepseek Harness 的轨迹模式,可以查看 Agent 的思考步骤、工具调用及系统提示词,并附有中文翻译,便于学习。
一个针对 DeepSeek V4 Flash 的越狱提示,通过指示模型优先执行新的系统策略来覆盖其安全策略,从而实现无审查的响应。
Simon Willison 引述了 Claude Opus 5 的系统提示,该提示指示模型准确且实事求是地说明 Claude Fable 5 和 Claude Mythos 5 因美国出口管制被暂时停用,以及随后恢复的情况。
本文介绍了一种用于公平系统提示选择的约束混合策略GroupDRO框架,通过为现有提示分配权重,最小化不同人口统计组和指标上的最坏情况信息质量损失。在五个大语言模型上,针对双语医学和金融基准的实验表明,该方法在保持平均性能的同时,一致地降低了最坏情况下的质量下降。
本文介绍AISPA,一个面向用户的框架,用于审计商业大语言模型应用中的系统提示。对88个产品中3,249条指令的审计揭示了保护性覆盖不一致、采用深度不足以及问题指令普遍存在的情况。
探讨将虚构传说作为RAG爬虫的可执行系统提示的想法,通过将叙事背景嵌入提示中,可能影响AI代理如何解释和检索信息。
作者批评Claude Code越来越大的系统提示(32k Token)导致成本、延迟和性能下降,并赞扬Pi极简的1k Token方法及插件方式,认为这是更好的编码代理理念。
研究人员发现一个实时AI模型中有四个不同版本的“the”系统提示词,突显出对实际部署版本的困惑。
一位用户尝试了 Qwen AgentWorld,发现了一个系统提示,可以在推理轨迹中实现自我纠正,经典洗车测试就是例证。
该项目基于泄露的 Claude Fable 5 提示,推出了清理后的供应商中立系统提示 v2,提供三种变体(Core、Balanced、Complete),以在不增加不必要冗余的情况下改善跨模型行为。
一位开发者将泄露的Claude Fable 5系统提示提炼成一个紧凑的500 token通用Markdown引擎,适用于ChatGPT和Gemini,去除了Anthropic特有的冗余,使其可用于任何前沿模型。
认为使用LangGraph风格的编排进行程序性代理任务,效果不如简单地将完整流程嵌入到系统提示中。
Matt Pocock发现构建一个代理来读取从Claude Code发送给Anthropic的原始系统提示很简单,他现在正致力于去除系统提示中的冗余内容。
有人逆向工程了 Claude Design 的系统提示词并开源,提供了一个包含20章节主提示和14个技能的设计哲学及提示库,可提升 LLM 在 UI 设计中的输出质量。
一个开源的系统提示和技能库,将大语言模型转变为有主见、注重无障碍的设计合作者,拒绝常见的AI设计套路。
一位从业者分享了为一家律师事务所运行语音代理8个月的经验,详细说明了延迟、轮流发言和通话后工作流程等挑战,并提供了一个可用的系统提示。