langfuse

标签

Cards List
#langfuse

@langfuse: 跟踪时间线现在可以在一个屏幕上适应任何跟踪。十二个跨度或一千二百个。像地图一样缩放:滚动平移,捏合或命令键滚动缩放两个轴,双击观测以飞速定位。

X AI KOLs Timeline · 4天前 缓存

Langfuse 推出了一个响应式跟踪时间线,可以在一个屏幕上适应任何跟踪,具有缩放和平移功能,增强了 AI 代理跟踪的可观察性。此更新允许使用类似地图的交互高效导航大型跟踪。

0 人收藏 0 人点赞
#langfuse

5种代理失败模式对比LangSmith、Langfuse和Phoenix:各工具的捕获与遗漏

Reddit r/AI_Agents · 2026-08-26

本文对比了LangSmith、Langfuse和Phoenix处理常见AI代理失败模式(如错误的工具调用和格式漂移)的方式,并介绍了Future AGI作为集成护栏和网关的工具,实现主动阻止。

0 人收藏 0 人点赞
#langfuse

@langfuse: 评估 评估 评估 在 Langfuse 中设置评估器从未如此简单…

X AI KOLs Timeline · 2026-08-25 缓存

Langfuse 推出了更轻松的评估器设置方式,包括模板、真实生产数据测试和交互式变量映射,以及全新的用户体验和一个演示视频。

0 人收藏 0 人点赞
#langfuse

@lotte_verheyden: 这太棒了!团队努力工作,确保 Langfuse 性能出色,即使你扩展到数百万乃至上千万条 trace

X AI KOLs Timeline · 2026-08-19 缓存

Langfuse v4 发布,采用重新架构的数据模型以提升性能,并新增全文搜索、监控器和 AI 助手等功能。

0 人收藏 0 人点赞
#langfuse

@LanLance24: 推荐这篇 Langfuse 团队成员的文章,主要讲当我们有 Traces 时如何设计 Agent/LLM 评测指标的最佳实践。 少而精、来自线上真实失败的case、能指导决策、会持续更新迭代,才是好的评测指标体系。 > 指标分成三类: 1…

X AI KOLs Timeline · 2026-08-19 缓存

这篇文章推荐了 Langfuse 团队关于使用 Traces 设计 Agent/LLM 评测指标的最佳实践,包括目标指标、防护栏指标和运营指标,并强调从错误分析开始,保持指标少而精、可行动。

0 人收藏 0 人点赞
#langfuse

@Yangtze_Seventh: EverOS 登上 Langfuse 官方集成页了!让大家看清楚白盒记忆的轨迹是啥样! 简单说下背景: Langfuse 是开源的 LLM 可观测、评估与 Prompt 管理平台。EverOS 则是一个开源、Local-first 的 A…

X AI KOLs Timeline · 2026-08-06 缓存

EverOS 宣布正式集成 Langfuse,使 Agent 记忆的存储、召回、置信度评估与冲突合并等过程可被观测和追踪,帮助开发者定位幻觉问题。

0 人收藏 0 人点赞
#langfuse

运行AI代理最昂贵的部分不是令牌消耗,而是花在弄清楚它们行为原因的时间。

Reddit r/AI_Agents · 2026-05-31

构建AI代理的过程揭示,主要成本在于调试——花费数周追踪诸如上游API变更等问题——而不仅仅是令牌或模型推理成本。

0 人收藏 0 人点赞
#langfuse

有人真的在分析 Agent 的运行轨迹模式,还是我们都在盯着仪表盘猜?

Reddit r/AI_Agents · 2026-05-11

作者质疑为何工程师不对 Agent 的运行轨迹进行自动化的模式分析,认为当前的可观测性工具(如 LangSmith 和 Langfuse)缺乏从 Agent 行为中“连接”并累积知识的关键步骤,这与个人知识管理系统形成鲜明对比。

0 人收藏 0 人点赞
#langfuse

[项目更新] Dunetrace:实时监控您的生产环境 AI Agent

Reddit r/AI_Agents · 2026-05-09

Dunetrace 是一款专为生产环境 AI Agent 设计的开源实时监控工具。此次更新增加了跨 Agent 模式分析、与 Langfuse 的深度分析集成,以及对自定义 Agent 的支持。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈