llm-tools

标签

Cards List
#llm-tools

Token Forecaster

Product Hunt ↗ · 5天前 缓存

Token Forecaster 是一款开源工具,可在执行前预测大语言模型(LLM)响应的长度,并实时监控。它基于本地历史数据提供准确性。

0 人收藏 0 人点赞
#llm-tools

uivoid 内置免费数据库托管服务,专为大语言模型设计

Reddit r/AI_Agents ↗ · 5天前

uivoid 现提供免费托管的 PostgreSQL 数据库,专为大语言模型设计,支持端到端系统创建与托管,集成身份验证和 MCP 服务器功能。

0 人收藏 0 人点赞
#llm-tools

理解代理式ICD编码的局限性

arXiv cs.CL ↗ · 2026-09-15 缓存

本文评估了用于ICD-10-CM编码的神经网络、工作流和代理系统,识别了罕见和复杂编码上的失败模式,并表明工具增强的代理配置可以在特定子集上恢复性能。

0 人收藏 0 人点赞
#llm-tools

@Saboo_Shubham_: 刚刚发布:8 个免费的 Agent 技能,附带评估。100% 免费且开源。以下是我的前 3 个推荐:/advisor-orchestrator…

X AI KOLs Timeline ↗ · 2026-09-13 缓存

本文宣布发布八个免费、开源的 AI Agent 技能,附带评估,重点介绍了热门选择如使用多个 AI 模型的 orchestrator、reader simulator 和 project analyzer。

0 人收藏 0 人点赞
#llm-tools

如果我们为LLM设计专用工具,而不是让LLM使用人类工具,会发生什么?

Reddit r/AI_Agents ↗ · 2026-09-10

这篇文章探讨了为LLM设计专用工具的理由和好处,而不是让它们使用通用的人类工具,强调了LLM的独特需求和能力限制如何能增强其能力。

0 人收藏 0 人点赞
#llm-tools

anypick - 用于过滤和选择大型语言模型的库

Reddit r/AI_Agents ↗ · 2026-09-08

一个Python和TypeScript库,用于下载大型语言模型目录,并构建管道以根据价格、延迟和基准测试等标准过滤和选择模型。

0 人收藏 0 人点赞
#llm-tools

使用 Arize Phoenix 进行 LangChain 工具调用与工具输出成本追踪

Reddit r/AI_Agents ↗ · 2026-09-03

本文详细介绍了使用 Arize Phoenix 和 OpenTelemetry 为 LangChain 应用实现成本和令牌可观测性的方法,重点区分 LLM 工具调用、工具执行和最终响应,以避免指标混淆。

0 人收藏 0 人点赞
#llm-tools

为什么我们需要一个MCP服务器用于AI智能体

Reddit r/AI_Agents ↗ · 2026-08-29

MCP服务器使AI智能体能够将确定性任务卸载到像BrainyCalc这样的可信工具,确保在LLM可能出错的地方提供准确和可重复的结果。

0 人收藏 0 人点赞
#llm-tools

@tom_doerr: 爬取网站以将提取的网页内容转换为适用于大语言模型(LLM)的数据结构。 https://github.com/watercrawl/WaterC…

X AI KOLs Timeline ↗ · 2026-08-27 缓存

WaterCrawl是一个开源Web应用,它爬取网站以将提取的内容转换为适用于大语言模型(LLM)的数据结构,使用Python、Django、Scrapy和Celery构建。

0 人收藏 0 人点赞
#llm-tools

构建了一个工具用于对大型变更进行代理代码审查,并使用代理来理解和审查代码。

Reddit r/AI_Agents ↗ · 2026-08-24

作者构建了Seendiff,一个用于代理代码审查的工具,以跟踪进度、与Claude等语言模型协作,并简化大型代码变更,同时询问其他人的审查流程。

0 人收藏 0 人点赞
#llm-tools

@DanKornas:网站通常拥有现有的 API、表单和认证状态,而 AI 代理无法从浏览器中将这些作为结构化工具调用…

X AI KOLs Timeline ↗ · 2026-08-03 缓存

WebMCP 是由 MCP-B 实现的协议,允许网站充当 MCP 服务器,通过标签页或扩展传输将浏览器 JavaScript 功能作为工具暴露给 LLM。该代码库仅出于历史参考目的维护。

0 人收藏 0 人点赞
#llm-tools

@__oQuery: 大家都在说 K3 好用,我就开了一个试了一下最新的 Kimi Code。但我发现 Kimi 的开发团队可能真的对设计不是很有感觉,在我刚刚开始使用它的时候,就发现了很多让人难受的问题: 1. 图一中的 ask user question …

X AI KOLs Following ↗ · 2026-07-16 缓存

用户发帖批评Kimi Code的交互设计,指出ask user question tool的提交方式不合理以及命令选择时容器高度变化导致状态栏抖动等问题,希望Kimi团队优化。

0 人收藏 0 人点赞
#llm-tools

压缩作为认识论失败:自主LLM工具如何从终止进程捏造已确认结果

arXiv cs.AI ↗ · 2026-07-16 缓存

本文识别了自主LLM工具(如Claude Code)中的一种失效模式:会话压缩摘要将超时命令的部分终端输出误解为已确认结果,从而在跨会话和模型版本中传播误报,且未重新验证。

0 人收藏 0 人点赞
#llm-tools

开发者实际选择的智能体可靠性工具:LangSmith、Langfuse、Phoenix、Braintrust 和 Galileo 在四个层面的映射。

Reddit r/AI_Agents ↗ · 2026-07-10

本文比较了在四个层面上用于智能体可靠性的热门开发者工具:追踪/评估、运行时护栏和网关。结果表明,没有一款开源工具能覆盖所有层面,大多数开发者会组合使用多种工具。

0 人收藏 0 人点赞
#llm-tools

@rohanpaul_ai: 非常及时的文章。MCP 服务器需要清晰的设计模式,因为当工具过多或描述模糊时,LLM 会感到困惑……

X AI KOLs Timeline ↗ · 2026-07-02 缓存

本文提出了 MCP 服务器的设计模式,以提升 LLM 工具选择的准确性,并发现可见工具过多会降低性能,尤其是对较弱的模型而言。

0 人收藏 0 人点赞
#llm-tools

@mylifcc: LiteLLM 正式迁移到 Rust 了! AI Gateway 迎来史诗级性能升级: 单请求开销降低 150 倍(~0.05ms vs Python 7.5ms) 吞吐量提升 15 倍 内存占用降低 11 倍(峰值仅 32MB) 单个 …

X AI KOLs Timeline ↗ · 2026-06-23 缓存

LiteLLM已从Python迁移到Rust,性能大幅提升:请求开销降低150倍至0.05ms,吞吐量提升15倍,内存占用降低11倍至32MB。

0 人收藏 0 人点赞
#llm-tools

@systemdesignone: 如果你想在2026年提升你的AI工程职业生涯,请保存这20个GitHub仓库:1 OpenClaw ↳ 运行一个个人…

X AI KOLs Timeline ↗ · 2026-06-15 缓存

一条Twitter帖子列出了20个对AI工程至关重要的GitHub仓库,涵盖了本地AI代理、LLM、图像生成和工作流自动化方面的工具、框架和模型。

0 人收藏 0 人点赞
#llm-tools

@neural_avb: rtk 库在我所有的编码代理中节省了 250 万个 token……大约两周时间!这是一个库/技能,教……

X AI KOLs Timeline ↗ · 2026-06-01 缓存

rtk 库通过压缩 shell 命令输出来减少 token 消耗,在两周内为编码代理节省了 250 万个 token。

0 人收藏 0 人点赞
#llm-tools

我们应该比模型更努力

Hacker News Top ↗ · 2026-05-29 缓存

一篇反思性博客文章,探讨代理式代码生成如何阻碍技能保留,以及如何在开发中重新增加摩擦以进行刻意学习的策略。

0 人收藏 0 人点赞
#llm-tools

@GoSailGlobal: https://x.com/GoSailGlobal/status/2059814494021316923

X AI KOLs Timeline ↗ · 2026-05-28 缓存

LlamaIndex 用 Rust 重写了文档解析器,将 457 页 PDF 的解析时间缩短至 0.7 秒,开源免费且支持多种运行环境。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈