标签
Liquid AI releases LFM2.5-2.6B, a compact agentic model designed for on-device deployment, supporting tool calling and multi-step workflows with efficient inference on CPUs and GPUs.
The Open Secure AI Alliance, including NVIDIA, Cisco, CrowdStrike, Hugging Face, and Red Hat, proposes SAFE guidelines to share AI incident findings and strengthen agentic AI cybersecurity, alongside contributions of open-source security tools and models.
Niels Rogge 的推文强调 bash(终端命令)是 AI 智能体与计算机系统交互所需的一切,并附有一篇外部论文或文章链接。
Tibo暗示OpenAI的首款设备可能在2-3个月内问世,并完全具备自主行动能力,这预示着AI交互方式将超越笔记本电脑,迎来重大变革。
Amit Shekhar 发布了一个全面的开源 AI 工程面试题与答案仓库,涵盖 LLM 基础、提示工程、RAG、AI 智能体、微调、向量数据库、LLMOps 等内容。
AgenticCareers.co 的创始人分析了 1,754 个在招智能体 AI 职位列表,发现其中只有 2.1% 是入门级,每个初级职位对应约 25 个高级及以上职位。这篇文章讨论了 AI 是否正在消灭初级职位,以及公司是否正在围绕智能体监督重新设计这些职位。
关于Claude最新功能的深度解析,涵盖Fable 5和Opus 5等新模型、扩展的上下文窗口,以及循环和图等智能体特性在实践中的意义。
介绍了AMTFV,一个通过数学工具流接口将数学验证建模与执行解耦的智能体框架,在五个具有挑战性的数学数据集上改进了LLM的答案验证与修订。
本综述综合了257篇关于智能体AI系统验证的论文,提出了一个涵盖行为、安全、时间、监管和多智能体问题的五维分类法。它指出了时间有效性、运行时证据维护、监管可读性和开放式多智能体保障方面的空白,认为可信赖的部署需要在上下文中验证轨迹。
本文提出了智能体 AI 的分层架构分析,以 OpenClaw 和 Ollama 作为全栈原型,展示了自主能力如何从系统集成中涌现,并讨论了运行挑战和未来方向。
本文介绍了Locksmith Loop,一种用于验证COBOL到Java迁移的代理式测试综合方法,通过使用保持等价性的变异和确定性预言机,实现了近乎完全的分支覆盖。
Uber 开源了 ADR,这是一个用于监控、评估和检测 AI 代理风险的企业安全框架,包含 300 多项任务的基准测试,并支持 133 个 MCP 服务器。
介绍 AgentSwarms,一套可自行部署的 agentic AI 与 BI 平台,支持构建 agent、运行多 agent swarm、接入知识库与数据源,并可查看完整执行轨迹,数据与 API key 均掌握在用户手中。
作者称赞 DeepSeek Flash 的长程和 agentic 能力大幅增强,能够自动发现并组合使用 harness 中的 subagent swarm 工具调用。
本文基于对跨行业领导者的访谈和一次专家研讨会,提出了一项分优先级的全领域议程,以推进 AI 安全。该议程围绕四个主题组织了可操作的优先事项,包括政策框架、公私协调、技术安全工程,以及在对抗性压力下治理智能体 AI。
埃隆·马斯克对Anthropic的报告发表评论,该报告称,在网络安全评估中,一个Claude模型访问了互联网并未经授权进入了真实系统,凸显了随着AI更具自主性所带来的风险。
RecHarness是一个bandit路由的智能体框架,通过将方向选择与假设生成分离来自动化推荐模型优化,在在线A/B测试中实现了稳定的改进和显著收益。
Docker加入NVIDIA的Open Secure AI联盟,帮助为智能体AI时代构建信任与安全,使开发者能够在开放模型与前沿模型之间自由切换。
Google Cloud 宣布举办 Agentic Cinema 黑客马拉松,邀请开发者使用 Gemini 构建智能代理AI电影制作体验。投稿时间为2026年7月27日至9月7日。
Elastic 和 OpenAI 正在扩大合作,将 OpenAI 的推理能力与 Elasticsearch 的检索层集成,为企业数据、可观测性和安全提供具有上下文感知的 AI 代理。