llm-tools

标签

Cards List
#llm-tools

@__oQuery: 大家都在说 K3 好用,我就开了一个试了一下最新的 Kimi Code。但我发现 Kimi 的开发团队可能真的对设计不是很有感觉,在我刚刚开始使用它的时候,就发现了很多让人难受的问题: 1. 图一中的 ask user question …

X AI KOLs Following · 2026-07-16 缓存

用户发帖批评Kimi Code的交互设计,指出ask user question tool的提交方式不合理以及命令选择时容器高度变化导致状态栏抖动等问题,希望Kimi团队优化。

0 人收藏 0 人点赞
#llm-tools

压缩作为认识论失败:自主LLM工具如何从终止进程捏造已确认结果

arXiv cs.AI · 2026-07-16 缓存

本文识别了自主LLM工具(如Claude Code)中的一种失效模式:会话压缩摘要将超时命令的部分终端输出误解为已确认结果,从而在跨会话和模型版本中传播误报,且未重新验证。

0 人收藏 0 人点赞
#llm-tools

开发者实际选择的智能体可靠性工具:LangSmith、Langfuse、Phoenix、Braintrust 和 Galileo 在四个层面的映射。

Reddit r/AI_Agents · 2026-07-10

本文比较了在四个层面上用于智能体可靠性的热门开发者工具:追踪/评估、运行时护栏和网关。结果表明,没有一款开源工具能覆盖所有层面,大多数开发者会组合使用多种工具。

0 人收藏 0 人点赞
#llm-tools

@rohanpaul_ai: 非常及时的文章。MCP 服务器需要清晰的设计模式,因为当工具过多或描述模糊时,LLM 会感到困惑……

X AI KOLs Timeline · 2026-07-02 缓存

本文提出了 MCP 服务器的设计模式,以提升 LLM 工具选择的准确性,并发现可见工具过多会降低性能,尤其是对较弱的模型而言。

0 人收藏 0 人点赞
#llm-tools

@mylifcc: LiteLLM 正式迁移到 Rust 了! AI Gateway 迎来史诗级性能升级: 单请求开销降低 150 倍(~0.05ms vs Python 7.5ms) 吞吐量提升 15 倍 内存占用降低 11 倍(峰值仅 32MB) 单个 …

X AI KOLs Timeline · 2026-06-23 缓存

LiteLLM已从Python迁移到Rust,性能大幅提升:请求开销降低150倍至0.05ms,吞吐量提升15倍,内存占用降低11倍至32MB。

0 人收藏 0 人点赞
#llm-tools

@systemdesignone: 如果你想在2026年提升你的AI工程职业生涯,请保存这20个GitHub仓库:1 OpenClaw ↳ 运行一个个人…

X AI KOLs Timeline · 2026-06-15 缓存

一条Twitter帖子列出了20个对AI工程至关重要的GitHub仓库,涵盖了本地AI代理、LLM、图像生成和工作流自动化方面的工具、框架和模型。

0 人收藏 0 人点赞
#llm-tools

@neural_avb: rtk 库在我所有的编码代理中节省了 250 万个 token……大约两周时间!这是一个库/技能,教……

X AI KOLs Timeline · 2026-06-01 缓存

rtk 库通过压缩 shell 命令输出来减少 token 消耗,在两周内为编码代理节省了 250 万个 token。

0 人收藏 0 人点赞
#llm-tools

我们应该比模型更努力

Hacker News Top · 2026-05-29 缓存

一篇反思性博客文章,探讨代理式代码生成如何阻碍技能保留,以及如何在开发中重新增加摩擦以进行刻意学习的策略。

0 人收藏 0 人点赞
#llm-tools

@GoSailGlobal: https://x.com/GoSailGlobal/status/2059814494021316923

X AI KOLs Timeline · 2026-05-28 缓存

LlamaIndex 用 Rust 重写了文档解析器,将 457 页 PDF 的解析时间缩短至 0.7 秒,开源免费且支持多种运行环境。

0 人收藏 0 人点赞
#llm-tools

ModelHub

Product Hunt · 2026-05-22

ModelHub 是一款在 Mac 菜单栏上运行本地大语言模型的应用。

0 人收藏 0 人点赞
#llm-tools

没人告诉你,在第六个月切换记忆工具和切换模型完全是两码事。

Reddit r/AI_Agents · 2026-05-16

反思在AI Agent系统中经过数月生产后切换记忆工具的隐藏成本,与切换模型的微不足道形成对比。

0 人收藏 0 人点赞
#llm-tools

@0xSero: vllm-studio 优于 claude-desktop 已获官方确认

X AI KOLs Timeline · 2026-05-15 缓存

一条推文称vllm-studio已被确认优于Claude Desktop。

0 人收藏 0 人点赞
#llm-tools

创建了一个免费工具,在提示词发送给服务提供商之前检测其泄露的 PII

Reddit r/artificial · 2026-05-12

发布了一款免费工具,帮助用户在服务提供商接收之前,检测大语言模型(LLM)提示词中泄露的个人身份信息(PII)。

0 人收藏 0 人点赞
#llm-tools

@geekbb: Agent harness 自动化优化工具,接管了 Agent harness 优化的脏活,你给一个基准测试命令和目标仓库,它就自动生成提案、跑评测、记结果、留好的,弃差的,自动改进 agent 的 prompt、配置和源码。 https…

X AI KOLs Timeline · 2026-05-11 缓存

autoharness 是一个自动化代理 harness 优化工具,能基于基准测试命令自动生成提案、运行评估并改进 agent 的 prompt、配置和源码,支持 Codex 和 Claude。

0 人收藏 0 人点赞
#llm-tools

@WSInsights: 国外一位 25岁的年轻播客主,这两年把 OpenAI、Anthropic、DeepMind 这些顶级 AI 实验室的核心人物挨个访谈过一遍。Karpathy、Hassabis、Dario Amodei、Ilya Sutskever 这些圈…

X AI KOLs Timeline · 2026-05-08

25岁播客主Dwarkesh Patel访谈了OpenAI、Anthropic、DeepMind等顶级AI实验室的核心人物,包括Karpathy、Hassabis、Dario Amodei、Ilya Sutskever等。他公开了自己用AI辅助的「一周准备」工作流:让AI列出必读资料、追踪未懂之处、用AI绘制全景图、自己动手实现代码。Time杂志2024年将其列入「AI 100人」。

0 人收藏 0 人点赞
#llm-tools

PrefectHQ/fastmcp

GitHub Trending (daily) · 3天前 缓存

FastMCP 是由 Prefect 开发的 Python 框架,用于构建 MCP 服务器、客户端和应用程序,简化了将 LLM 连接到工具和数据的过程。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈