prompt-cache

标签

Cards List
#prompt-cache

@DeRonin_: 遵循这三条规则,Claude Code 将显著提升:- 使用 /subtask 而非生成新子代理,它…

X AI KOLs Following · 2026-08-28 缓存

本文建议在 Claude Code 中使用 /subtask、后台执行和工作树隔离,通过共享提示缓存和有效管理上下文来提高效率,降低成本。

0 人收藏 0 人点赞
#prompt-cache

您的智能体工作流的缓存保活成本高出8倍

Lobsters Hottest · 2026-07-21 缓存

一项跨Anthropic、OpenAI、Gemini和DeepSeek的详细测量研究发现,传统的30秒提示缓存保活频率过高8倍;4分钟间隔是最优的,并且只有在长时间空闲间隔下,Anthropic的缓存才能节省成本。

0 人收藏 0 人点赞
#prompt-cache

使用llama-server自托管?修复每次轮次中提示缓存重载的问题

Reddit r/openclaw · 2026-06-29

一份故障排除指南展示了将OpenClaw的contextInjection设置从 'always' 更改为 'continuation-skip' 后,如何解决使用 llama-server 时每次对话都会重载提示缓存的问题,从而在长时间会话中实现100倍的加速。

0 人收藏 0 人点赞
#prompt-cache

@rohanpaul_ai: TokenPilot 通过摄入感知压缩和生命周期感知驱逐来降低 LLM 智能体成本,实现了 61–87% 的成本降低。

X AI KOLs Following · 2026-06-16 缓存

TokenPilot 通过摄入感知压缩和生命周期感知驱逐来降低 LLM 智能体成本,在 PinchBench 和 Claw-Eval 上实现了 61–87% 的成本降低,且得分具备竞争力。

0 人收藏 0 人点赞
#prompt-cache

TokenPilot:面向LLM代理的缓存高效上下文管理

Hugging Face Daily Papers · 2026-06-15 缓存

TokenPilot是一个双粒度上下文管理框架,通过稳定提示前缀和保守管理上下文片段,降低长时程LLM会话中的推理成本。在基准测试中实现了61-87%的成本降低,同时保持竞争性性能。

0 人收藏 0 人点赞
#prompt-cache

@ClaudeDevs:使用Opus 4.8,您可以在对话中途添加系统指令而不破坏提示缓存。更多缓存命中意味着…

X AI KOLs Following · 2026-05-29 缓存

Claude Opus 4.8 允许在对话中途添加系统指令而不破坏提示缓存,从而降低API请求的成本和延迟。

0 人收藏 0 人点赞
#prompt-cache

@Michaelzsguo:所以你买了128GB MacBook Pro。现在的问题不是“哪个本地模型的TPS最高?”而是:哪个设…

X AI KOLs Timeline · 2026-05-17 缓存

这条推文推荐了适用于128GB MacBook Pro的本地AI编程方案,使用Qwen 3.6模型搭配MLX服务器及特定配置,以实现可靠的编程辅助。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈