agentic-workflows

标签

Cards List
#agentic-workflows

PatchOptic:面向共享状态LLM工作流的投影视图与验证的结构化更新

arXiv cs.LG · 2026-07-08 缓存

介绍了PatchOptic,这是一种用于共享状态LLM工作流的接口,它采用投影读取和验证的结构化补丁来确保更新的有效性。通过PatchBench对46个案例进行了评估,结果显示在保持质量的同时减少了token成本和泄漏。

0 人收藏 0 人点赞
#agentic-workflows

@PrajwalTomar_: 你不明白这有多重大。Anthropic 刚发布了让 Claude Code 无需你干预的四种方法...

X AI KOLs Timeline · 2026-07-07 缓存

Anthropic 发布了四种让 Claude Code 自主运行的循环类型:基于回合、基于目标、基于时间和主动式,允许不同级别的任务交接。

0 人收藏 0 人点赞
#agentic-workflows

Forethought:基于神经符号基元编程的可验证推理

arXiv cs.AI · 2026-07-07 缓存

Forethought 是一种神经符号推理系统,它将推理视为由符号与神经基元组合成的显式、可验证的程序。该系统可将基础模型准确率相对提升约 30%,使小模型在保持模型无关性与可审计性的同时,达到甚至超越前沿模型。

0 人收藏 0 人点赞
#agentic-workflows

@ivanfioravanti: DGX Spark 上下文基准测试基于 Qwen3.6-35B-A3B-UD-Q8_K_XL,使用 Mia 发布的 llamacpp 脚本。速度很快!是时候测试质…

X AI KOLs Timeline · 2026-07-06 缓存

基于 Qwen3.6-35B-A3B-UD-Q8_K_XL 在 DGX Spark 上的基准测试结果,使用 Mia 发布的 llama.cpp 脚本,展示了在不同上下文长度下快速的 token 生成时间。

0 人收藏 0 人点赞
#agentic-workflows

当某个AI工作流成本突然翻倍时,如何排查?

Reddit r/AI_Agents · 2026-07-06

文章讨论了AI工作流成本激增的常见原因,例如重试、重复的工具调用、长时间运行的工作流以及不断增长的上下文,并询问团队如何调查此类问题。

0 人收藏 0 人点赞
#agentic-workflows

@omarsar0:每周200美元还不错。它可以(5倍)覆盖我所有的工程和研究工作。而且我做很多。这是一个好的方向…

X AI KOLs Following · 2026-07-03 缓存

该推文同意每周200美元足以支付工程和研究工作,批评在昂贵模型和膨胀的自主工作流上的浪费性支出。

0 人收藏 0 人点赞
#agentic-workflows

@FinanceYF5: 四个开放权重模型已经进入了能够支撑真实智能体流程的阶段。 OpenRouter 在 Insights 博客发布了新文章,讲述为什么公司在 6 月选择这些模型:

X AI KOLs Following · 2026-06-29 缓存

OpenRouter 在 Insights 博客发文,指出四个开放权重模型已进入能够支撑真实智能体流程的阶段,并解释了公司为何在六月选择这些模型。

0 人收藏 0 人点赞
#agentic-workflows

@ehsanik:我们在@AnthropicAI的计算机使用团队正在招聘。在Anthropic内部工作是一次疯狂、精彩、紧张但美丽的旅程…

X AI KOLs Following · 2026-06-26 缓存

Anthropic的计算机使用团队正在招聘产品工程师和研究员,寻找对代理工作流程充满热情且能适应不确定性的候选人。

0 人收藏 0 人点赞
#agentic-workflows

[R] 将代理工作流编译到LLM权重中:以两个数量级的成本降低实现接近前沿质量

Reddit r/MachineLearning · 2026-06-25 缓存

本文证明,将代理工作流程序编译到小型微调模型的权重中,与上下文基线相比,实现了接近前沿的质量,成本降低128至462倍,解决了质量、成本和灵活性的感知障碍。

0 人收藏 0 人点赞
#agentic-workflows

@johnlindquist: 发布了昨天的演讲(附参考文献)。"Agentic Power User's Playbook" 点击此处观看(并获取我的…

X AI KOLs Following · 2026-06-24 缓存

John Lindquist 分享了他的演讲《Agentic Power User's Playbook》,涵盖了高效管理 AI 代理的实用工作流程、快捷操作和习惯。

0 人收藏 0 人点赞
#agentic-workflows

你的AI代理在生产环境中未经询问就做的最糟糕的事情是什么?

Reddit r/AI_Agents · 2026-06-24

关于自主AI代理在生产环境中实际失败案例的讨论,例如发送未经授权的电子邮件、修改记录、删除数据、花费金钱等,寻求经验和防护措施。

0 人收藏 0 人点赞
#agentic-workflows

@posthog: https://x.com/posthog/status/2069472232712389112

X AI KOLs Timeline · 2026-06-23 缓存

PostHog 解释了为什么“循环”(即自我提示的代理工作流)正在受到青睐,这得益于模型能力的提升以及 Stripe 和 Lovable 等公司的实际成果。该帖子详细说明了构建循环所需的要素,并展示了诸如 PR 监控和 Bug 修复等示例。

0 人收藏 0 人点赞
#agentic-workflows

@rohanpaul_ai: 智能体现在可以拥有自己的邮箱了!@atomic_mail 刚刚推出了一项功能,填补了智能体工作流中缺失的一环:…

X AI KOLs Following · 2026-06-18 缓存

Atomic Mail 推出了一款 API 优先的电子邮件服务,为 AI 智能体提供专属收件箱,支持通过 MCP 或 Agent Skill 与 Claude Desktop、Cursor 等流行智能体集成,并包含工作量证明(Proof-of-Work)和信誉机制来对抗垃圾邮件。

0 人收藏 0 人点赞
#agentic-workflows

构建独立LLM漂移检测 - 分享方法论,寻求对方法的反馈

Reddit r/artificial · 2026-06-18

作者分享了一种构建外部LLM漂移检测系统的方法论,该系统持续探测模型行为(模式遵循、指令遵循、拒绝率等),以捕捉API性能的静默退化,并邀请对方法、定价和用例的反馈。

0 人收藏 0 人点赞
#agentic-workflows

@ConsciousRide: 2026年AI工程面试中90%的问题都围绕以下7点。1. LLM基础:分词、Transformer与...

X AI KOLs Timeline · 2026-06-17 缓存

一条Twitter帖子概述了2026年AI工程面试中占据主导地位的七个关键领域,包括LLM基础、RAG系统、智能体工作流、推理优化、评估、MLOps以及生产实践。

0 人收藏 0 人点赞
#agentic-workflows

创始人手册:打造AI原生初创公司

Hacker News Top · 2026-06-17 缓存

构建AI原生初创公司的实用指南,涵盖从创意到规模化各个阶段,包含使用Claude的AI驱动练习和框架。

1 人收藏 1 人点赞
#agentic-workflows

@vboykis: 新博文:近期我如何使用本地模型进行开发。工具现已足够支持智能体工作流,每个人都应尝试…

X AI KOLs Following · 2026-06-15 缓存

Vicki Boykis分享了她使用本地AI模型进行开发的经验,指出像Gemma 4这样的最新版本已使智能体工作流在本地可行,准确率约为前沿模型的75%。

0 人收藏 0 人点赞
#agentic-workflows

@ArizePhoenix: 本周在Phoenix,一项针对智能体工作流的重要更新:PXI中的斜杠命令和技能 - Phoenix内置智能体现在...

X AI KOLs Following · 2026-06-12 缓存

Arize Phoenix内置智能体PXI现在支持斜杠命令和技能,允许用户直接从聊天中调用自定义工作流。

0 人收藏 0 人点赞
#agentic-workflows

FlowBank: 通过预计算和重用的查询自适应智能体工作流优化

arXiv cs.LG · 2026-06-11 缓存

FlowBank引入了一个三阶段框架,通过预计算一组多样化的可重用工作流并自适应地为每个查询选择最佳工作流,来优化LLM多智能体系统中的智能体工作流,在保持成本竞争力的同时实现了更高的分数。

0 人收藏 0 人点赞
#agentic-workflows

@degenrsc: https://x.com/degenrsc/status/2064714047241736302

X AI KOLs Timeline · 2026-06-10 缓存

一份关于使用多 LLM 系统与持久内存构建研究代理框架的详细指南,通过基于文件的身份、项目文档和记忆索引,让研究人员无需在每次会话中重复解释上下文。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈