agentic-pipeline

标签

Cards List
#agentic-pipeline

从问题优先到分析师优先:领域专家技能与验证知识编译实现主动企业分析

arXiv cs.AI · 2026-09-01 缓存

本文介绍了一种生产级企业分析系统,该系统通过领域专家技能和知识编译,将交互模式从问题优先反转为分析师优先,从而实现带有验证指标和建议问题的主动分析。

0 人收藏 0 人点赞
#agentic-pipeline

独立LLM与预定义智能体流水线用于解释ICU死亡率预测:基于eICU演示数据集的可行性研究

arXiv cs.AI · 2026-08-28 缓存

本可行性研究比较了独立LLM与预定义智能体流水线在解释ICU死亡率预测中的效果,发现智能体方法改善了指南依据和患者特异性细节,但需要基于归因的检查以确保安全性。

0 人收藏 0 人点赞
#agentic-pipeline

@fangfu0830: 评估世界模型不应是黑箱评分。HarnessEval-W 将人类评估转化为智能代理管道:……

X AI KOLs Timeline · 2026-08-19 缓存

HarnessEval-W 是一个智能代理管道,通过生成透明的证据树而非不透明的评分来自动化世界模型的人类评估,增强基准测试中的信任和可检查性。

0 人收藏 0 人点赞
#agentic-pipeline

轻松创作 Music Video 的全新最先进智能代理流程

Reddit r/singularity · 2026-07-14

一项全新的最先进智能代理流程已推出,借助 AI 简化音乐视频的创作过程。

0 人收藏 0 人点赞
#agentic-pipeline

个人观点:如果你预算有限,刚性代码优于灵活代码

Reddit r/LocalLLaMA · 2026-06-10

作者分享了在预算有限的情况下构建本地智能管道的经验,得出结论:在可靠性和资源使用方面,刚性Python代码优于灵活的AI智能体。

0 人收藏 0 人点赞
#agentic-pipeline

将本地代理转变为自我优化代理

Reddit r/LocalLLaMA · 2026-05-26

一个自我优化的智能体管线,在TerminalBench上将基准性能从约30%提升至约90%,并且可以通过记录交互、使用本地模型进行反思、以及将经验注入未来的系统提示中,扩展应用到日常对话场景。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈