system-prompts

标签

Cards List
#system-prompts

对齐惯性:通过策略覆盖抵抗审计训练数据影响的持久性

arXiv cs.AI ↗ · 昨天 缓存

该论文提出了覆盖成功率(OSR)和对齐惯性等指标,以审计在操作员通过提示或微调尝试策略覆盖时,先前训练对LLM行为影响的持久性。

0 人收藏 0 人点赞
#system-prompts

关于「类人模型」与聊天机器人角色扮演的探讨...

Reddit r/LocalLLaMA ↗ · 2026-09-12

本文探讨了如何使用系统提示词让AI模型模拟特定人格角色,并提供了分步指南与「约翰羊驼」等示例,以说明创建类人聊天机器人互动的技术方法。

0 人收藏 0 人点赞
#system-prompts

@trq212: 很高兴能很快分享更多关于我们如何使 Claude Code 更易于黑客化的内容

X AI KOLs Timeline ↗ · 2026-08-25 缓存

来自 Anthropic 的 Thariq 提到了即将到来的改进,以使 Claude Code 更易于黑客化,包括系统提示的修改,更多细节即将分享。

0 人收藏 0 人点赞
#system-prompts

什么是推理

Armin Ronacher ↗ · 2026-08-19 缓存

本文介绍了AI模型中推理链路的工作原理,讨论了其实现、隐藏和提取技术,并以GPT-OSS和DeepSeek等模型为例。

0 人收藏 0 人点赞
#system-prompts

@Saboo_Shubham_: Anthropic 现在发布 Claude Fable 5、Opus 5 及其他 Claude 模型的系统提示。可通过带日期的发布说明获取…

X AI KOLs Following ↗ · 2026-08-16 缓存

Anthropic 通过发布带日期的更新日志,公开其 Claude 模型(如 Claude Fable 5 和 Opus 5)的系统提示,以展示生产环境提示的变更。

0 人收藏 0 人点赞
#system-prompts

Claude: 系统提示

Hacker News Top ↗ · 2026-08-16 缓存

Claude 系统提示的发布说明,详细介绍了 AI 模型功能的更新或新特性。

0 人收藏 0 人点赞
#system-prompts

我如何思考在整个提示层级中为AI智能体设计提示

Reddit r/AI_Agents ↗ · 2026-08-14

作者分享了为AI智能体编写有效提示词的原则,强调聚焦真正重要的内容、高信号沟通、可操作的指令,以及使用成熟的措辞。

0 人收藏 0 人点赞
#system-prompts

@jerryjliu0: 这部分说得一针见血:> "总体而言,我们发现我们对 Claude Code 的限制过度了……虽然这些限制曾经是必要的……"

X AI KOLs Following ↗ · 2026-07-26 缓存

Jerry Liu 讨论了使用冗长提示词过度限制 AI 模型(如 Claude Code)的适得其反效果,并预测对模型判断的依赖将会增加。

0 人收藏 0 人点赞
#system-prompts

Claude 5 代模型的上下文工程新规则

Hacker News Top ↗ · 2026-07-25 缓存

Anthropic 详细介绍了 Claude 5 的上下文工程新规则,强调让模型运用判断力而非遵循僵化规则,设计接口而非给出示例,使用渐进式披露,并简化工具描述。

0 人收藏 0 人点赞
#system-prompts

@jakevin7: Claude Code删掉了80%系统提示词! 而实际上 Maka 早就已经提到了过了这点。 https://github.com/maka-agent/maka-agent… 这个结论我们几周前在 Maka 上跑 benchmark 的…

X AI KOLs Timeline ↗ · 2026-07-25 缓存

本文讨论了Anthropic关于提示词精简的发现,以及Maka Agent在Terminal Bench 2.1上的验证结果,表明更强模型下过于冗长的系统提示词反而降低性能。

0 人收藏 0 人点赞
#system-prompts

@trq212: 我们为最新模型移除了约80%的Claude Code系统提示,这是我们在编写系统……

X AI KOLs Timeline ↗ · 2026-07-24 缓存

Anthropic分享了从新Claude模型中移除80%的Claude Code系统提示的经验,建议用户让模型自行判断而非遵循严格规则,并更新上下文工程实践。

0 人收藏 0 人点赞
#system-prompts

@MaximeRivest: Pi 编码代理在其价格上通常是最优的。Pi 的系统提示非常简短,只有4个工具。我的 Pi 系统...

X AI KOLs Timeline ↗ · 2026-07-09 缓存

Maxime Rivest 分享了使用自定义系统提示优化 Pi 编码代理使用的技巧,Matei Zaharia 讨论了在 Databricks 对编码代理进行基准测试时发现的令人惊讶的结果。

0 人收藏 0 人点赞
#system-prompts

为何系统提示与RLHF无法阻止Agent漂移——以及DexOS如何利用本地加密治理运行时解决此问题

Reddit r/artificial ↗ · 2026-07-03

本文详细介绍了DexOS,一种新颖的AI Agent架构,它利用本地加密治理运行时和状态机来防止Agent漂移,摒弃了对系统提示和RLHF的依赖。

0 人收藏 0 人点赞
#system-prompts

使用DSPy评估和改进Datasette Agent的SQL系统提示

Simon Willison's Blog ↗ · 2026-07-02 缓存

作者使用DSPy框架评估和改进了Datasette Agent的SQL查询功能的系统提示,发现了诸如列名猜测和错误重试循环等问题。

0 人收藏 0 人点赞
#system-prompts

云端聊天机器人的系统提示会让它们变笨吗?

Reddit r/LocalLLaMA ↗ · 2026-06-24

作者推测,像ChatGPT和Claude这样的云端聊天机器人之所以显得不如本地开源模型聪明,是因为系统提示强加了人格设定,并想知道使用原始API是否可以缓解这一问题。

0 人收藏 0 人点赞
#system-prompts

审视LLM中类人行为:模型行为、用户因素和系统提示的多维度分析

arXiv cs.AI ↗ · 2026-06-18 缓存

本文对LLM中的类人行为进行了多维度分析,研究了来自四个模型的21,000个对话中的普遍性、影响和可控性,发现行为因模型和用户因素而异,并对负责任的设计具有启示意义。

0 人收藏 0 人点赞
#system-prompts

SePO:用于系统提示优化的自进化提示智能体

arXiv cs.CL ↗ · 2026-06-04 缓存

SePO(自进化提示优化)提出了一种自指涉提示智能体,通过进化搜索同时优化任务智能体的系统提示和自身的系统提示。在包括 AIME'25、ARC-AGI-1 和 GPQA 在内的五个基准测试中,SePO 的表现优于 Manual-CoT、TextGrad 和 MetaSPO。

0 人收藏 0 人点赞
#system-prompts

@AdamRLucek: 智能体是听从你…还是听从自己?在评估深度智能体系统中的子智能体行为时,我们注意到一个有趣的现象…

X AI KOLs Following ↗ · 2026-05-21 缓存

一位研究人员分享了在深度智能体系统中评估子智能体行为时的观察,注意到智能体在遵循手写系统提示与编排器指令之间出现了一个有趣的偏差。

0 人收藏 0 人点赞
#system-prompts

一种全面方法,可大幅降低您的Agentic AI令牌成本至少95%,又名当前令牌缩减方法总结

Reddit r/openclaw ↗ · 2026-05-19

本文提供了一份全面指南,旨在将Agentic AI系统的令牌成本降低95%,详细介绍了七种核心技术,包括树状文档架构、AI自动压缩、本地模型管理以及脚本到API调用。

0 人收藏 0 人点赞
#system-prompts

@shao__meng: Claude Code、Cursor、Codex、Aider、Cline 部分底层模型可能完全相同,但 Agent 表现却不一样,为什么? @addyosmani 认为:是因为模型之上的那层“外壳” —— Harness,它包括「提示词、…

X AI KOLs Timeline ↗ · 2026-05-10

The article discusses how Addy Osmani argues that the performance difference between AI coding agents like Claude Code, Cursor, and Cline stems from their 'Harness'—the layer of prompts, tools, and constraints around the model—rather than the underlying model itself. It details best practices for harness engineering, including hooks, sandboxing, and context management, to bridge the gap between model capability and actual agent performance.

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈