agent

标签

Cards List
#agent

我开源了我的黑客松搜索智能体,但我仍在摸索最适合的评估模型

Reddit r/AI_Agents ↗ · 2026-08-12

作者开源了 hackathon-searcher,这是一个用于发现、评估和帮助申请黑客松的工具,并正在寻求社区关于如何利用开源模型设计其评估层的建议。

0 人收藏 0 人点赞
#agent

@MAXdeg0: 这简直是**的金子——Anthropic 没给 Claude 眼睛,这个仓库修复了它。它叫 AGENT REACH,给了 Claude 能力……

X AI KOLs Timeline ↗ · 2026-08-12 缓存

Agent Reach 是一款免费开源工具,让 Claude 无需付费 API 密钥就能读取 17 个平台(YouTube、GitHub、Reddit、LinkedIn、X、Bilibili、微博等)的实时互联网内容,通过绕过官方 API 来避免费用。

0 人收藏 0 人点赞
#agent

Continuous Interaction Diffusion: A Diffusion-Native Runtime for Asynchronous Tool-Augmented Reasoning

arXiv cs.AI ↗ · 2026-08-12 缓存

Introduces Continuous Interaction Diffusion (CID), a diffusion-native model–runtime architecture that integrates tool interaction into iterative denoising, enabling asynchronous external reads while generation continues without waiting for discrete tool calls.

0 人收藏 0 人点赞
#agent

Grok Bot 简介(6 分钟阅读)

TLDR AI ↗ · 2026-08-12 缓存

xAI 推出 Grok Bot,这是一款能够跨云端的应用和工具自主工作的 AI 队友,现面向部分订阅者提供测试版。

0 人收藏 0 人点赞
#agent

推出 Muse Glimmer:专为常驻本地智能体工作流优化的开放权重模型

Reddit r/LocalLLaMA ↗ · 2026-08-10

Meta 发布 Muse Glimmer,这是一款 30B 开放权重多模态模型,专为本地智能体工作流优化,采用宽松的 Apache 2.0 许可证,支持 4 位量化、推测解码,并提供广泛的生态系统集成。

0 人收藏 0 人点赞
#agent

Meta Muse Glimmer – 开放权重的30B本地编码模型

Hacker News Top ↗ · 2026-08-10 缓存

Meta推出Muse Glimmer,一个采用宽松许可的30B参数模型,专为本地智能体工作流、编码和工具使用而优化,权重已在Hugging Face上发布。

0 人收藏 0 人点赞
#agent

Agent诊断和优化

Reddit r/AI_Agents ↗ · 2026-08-10

作者分享了 agent-design-review Skill,用于系统化诊断和优化 Agent 架构,覆盖 Prompt、工具权限、上下文、安全、记忆、评估、成本、可观测性等多方面,并输出基于证据的 P0/P1/P2 问题,帮助避免常见踩坑。

0 人收藏 0 人点赞
#agent

Macaron-V1:迈向具有自我改进与Mixture-of-LoRA的开放持续学习

Hugging Face Daily Papers ↗ · 2026-08-10 缓存

本文介绍了Macaron-V1,一个开放的持续学习智能体-模型家族,使用Mixture-of-LoRA在冻结的基础模型上组合专家适配器,并具有递归自我改进和模型-框架协同设计。

0 人收藏 0 人点赞
#agent

Codex 是智能体吗?

Reddit r/AI_Agents ↗ · 2026-08-09

作者讲述了使用 OpenAI 的 Codex 在 Snowflake 试用账户之间迁移数据的经历,并提出了 Codex 是否算作智能体的问题。

0 人收藏 0 人点赞
#agent

@tobi:我向人们解释 herdr 最喜欢的方式就是打开一个新工作区,启动一个 agent,然后告诉它:读取 `herdr --…

X AI KOLs Timeline ↗ · 2026-08-09 缓存

@tobi 的一条推文,演示了如何使用 CLI 工具 herdr——启动一个 agent 并运行 `herdr --skill`,来打造一个科幻电影风格的骇客终端界面。

0 人收藏 0 人点赞
#agent

使用AI进行代码审查六个月教会我:“review this”是一个伪装成提示问题的QA问题

Reddit r/AI_Agents ↗ · 2026-08-08

一位开发者回顾了六个月来使用AI进行代码审查的经历,发现模糊的提示会产生看似合理但毫无用处的反馈。解决办法是将审查视为一个带门控的流水线,包含明确的上下文、分范围的检查、验证清单和对抗性自我批评。

0 人收藏 0 人点赞
#agent

修正特征何时起作用?一种用于黑盒预测器上修正特征发现的智能体

arXiv cs.LG ↗ · 2026-08-07 缓存

本文介绍了Crafter,一种用于修正特征发现的智能体,通过组合搜索和LLM生成的特征来挖掘冻结黑盒预测器的残差,在六个数据集和骨干网络上实现了高达27%的错误率降低。

0 人收藏 0 人点赞
#agent

RA-CAD:为状态感知的文本到CAD生成学习执行后批判

arXiv cs.AI ↗ · 2026-08-07 缓存

RA-CAD 提出了一种用于文本到CAD生成的状态感知智能体,采用生成-执行-批判-重写循环,并通过组相对策略优化进行反馈驱动的智能体优化。它在CADFusion和Text2CAD基准上实现了最先进的执行有效性和几何质量。

0 人收藏 0 人点赞
#agent

优化器即智能体:跨提示、程序与机器学习工作流的推理驱动搜索

Hugging Face Daily Papers ↗ · 2026-08-07 缓存

ReASearch 是一个统一框架,其中单个使用工具的智能体内化了用于优化提示、程序和机器学习工作流的搜索策略,在14项任务上优于专门的基线方法。

0 人收藏 0 人点赞
#agent

@GitHub_Daily: 用 Claude Code 写项目,不少人上来就让它开干,写到一半发现架构跑偏了,推倒重来更费时间。 The Architect 这个 Claude Code 插件,专门在写代码之前先做一轮架构设计,产出一份完整的项目蓝图。 它会先问清楚…

X AI KOLs Timeline ↗ · 2026-08-06 缓存

介绍 The Architect,一个 Claude Code 插件,能在写代码前通过访谈生成完整项目蓝图,支持 14 种项目类型,帮助避免架构跑偏和推倒重来。

0 人收藏 0 人点赞
#agent

@FinanceYF5: 北京时间今晚7点(硅谷明早4点),CSDN 创始人蒋涛亲自下场聊Agent 近百个 Vibe Coding 作品之后,真正能上线的 Agent,难点已经不是 Demo 能不能跑,而是能不能接入真实数据、跑完长任务、失败后继续工作。 与 I…

X AI KOLs Timeline ↗ · 2026-08-06 缓存

CSDN 创始人蒋涛将直播讨论 Agent 从演示到真正可交付的难点,与 InfiniSynapse、InsCode 一起拆解如何接入真实数据、跑完长任务并处理失败。

0 人收藏 0 人点赞
#agent

MemArena:一种面向大规模设备端智能个人记忆助手的自我中心基准

arXiv cs.CL ↗ · 2026-08-05 缓存

MemArena 是一种新的自我中心基准,用于评估设备端个人记忆助手,它使用 MASim 智能体模拟器生成多会话对话世界,并在回忆、推理和可信度维度上提供真值。初步结果表明,记忆后端的选择通常比读取器规模更重要,而基于权限的访问仍然是一个普遍挑战。

0 人收藏 0 人点赞
#agent

UrbanAgent: A Tool-Augmented Agent for Cross-System Urban Tasks

arXiv cs.AI ↗ · 2026-08-05 缓存

UrbanAgent is a tool-augmented agent framework that uses LLMs with code execution, API calls, and MCP to handle cross-system urban requests. The authors also introduce UrbanEval, a benchmark for evaluating task results and execution quality, achieving 71% success rate over baselines.

0 人收藏 0 人点赞
#agent

@seclink: 今天搜索到 关于 http://tanka.ai 的6月29日 的一个新闻, 说是 http://tanka.ai 原商业化 CEO , 林凯森 离开了 盛大创新院,重新创办了 另一家新公司 , 做长期记忆智能体。 在 陈老板的指导下工作…

X AI KOLs Timeline ↗ · 2026-08-04 缓存

林凯森离开盛大创新院后创办新公司,专注于长期记忆智能体,并提及在陈老板指导下工作的经历。

0 人收藏 0 人点赞
#agent

RubricReviewer:从直接批判到客观全面的基于评分标准的同行评审

arXiv cs.CL ↗ · 2026-08-04 缓存

介绍了RubricReviewer,一个用于基于大语言模型(LLM)的同行评审的评分标准驱动框架,它显式生成论文自适应的评分标准,并将无训练的证据收集智能体(Scout)与经过训练的人类对齐模型(Aligner)相结合,以产生更全面、更具区分性和更鲁棒的评审意见。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈