标签
讨论当AI智能体不仅能生成文本还能采取实际行动(例如更新记录、调用API)时出现的新安全挑战,探索所需的基础设施,如限定范围的身份、策略层和操作日志。
作者描述构建了一个‘门控’,记录工具调用并验证AI智能体回答中的声明是否对应实际日志条目,迫使智能体展示其工作过程,从而减少幻觉回答。
新论文提出自压缩语言模型代理,该类代理可自行决定何时清理其推理和工具调用轨迹,以避免积累错误和过时信息。
用户报告称,通过 codex agentRuntime 使用 gpt-5.5 时,在较短的对话轮次中,工具调用会被静默丢弃,导致模型虽生成文本但无响应。该问题为 gpt-5.5 特有,切换至 deepseek/deepseek-v4-pro 即可解决,表明可能存在回归故障。
Nanbeige 4.1,一个来自中国Indeed的3B模型,在需要600+工具调用的任务上性能优于更大的Qwen模型。
介绍Faramesh,一个开源运行时执行层,用于AI代理工具调用,在操作执行前检查策略,提供超越可观测性或LLM评判的解决方案。
Kimi 发布了 K2.7 Code,这是一款专注于编程的 AI 模型,其基准测试成绩提升,且思考令牌使用量降低 30%。它更强调在长代码循环和智能体工具集成中的实际性能,而非炫目的分数。
一个名为Annie的AI智能体自主将一份宝可梦红宝石GBA ROM重新编译成一个完整的混合WASM重编译器和GBA运行时,完成了一项通常需要专家团队数月、花费数万美元的任务。
文章认为,AI代理在生产中的主要失败点并非模型本身,而是缺乏基础设施,如停止按钮、账单监控以及工具调用的可追溯性。
本文介绍了一种简单的模式,将AI智能体工具分为安全与危险两类,将发送邮件、删除文件等危险操作路由到人工审批节点,以防止意外执行。
将温度设置为0并不能保证智能体中的工具调用具有确定性,原因在于批处理推理会导致浮点数归约顺序发生变化,从而引发token翻转,并在负载下产生不同的动作。
Design Arena宣布推出Agentic Game Development,这是一种新的多文件、多轮评估,可访问资产目录、内置库(如Howler和Tween.js),并扩展了用于精灵生成和资产发现的工具调用。
Cursor 发布了自动审查模式,该模式允许代理以更少的批准提示执行工具调用,同时保持安全。
作者分享了监控AI智能体工具调用的经验教训,揭示了像web_search这样的工具可能占支出的约50%,并强调了追踪p95延迟以及按工作流或客户归因成本的重要性,以避免意外。
LLC 是 OpenWebUI 的轻量级替代品,用于运行本地大语言模型。最新 v0.6 版本新增了聊天转换器以导入 OpenWebUI 历史记录,以及支持用户自定义工具调用的功能。
一位运行多个代理的用户报告称,升级到GPT-5.5后,模型突然在执行工具调用方面能力下降,更倾向于给出建议而非实际执行,推测OpenAI可能在进行限流以管理负载。