@LangChain: .@MukilLoganathan’s Interrupt keynote on Sandboxes. https://youtu.be/IIchUA5T3gs In 20 minutes, you’ll learn how to run…
摘要
LangChain 的 Mukil Loganathan 在 Interrupt 大会上介绍 LangSmith 沙箱,用于安全执行代理代码,具备低延迟、安全隔离、持久化和快照恢复等核心功能。
查看缓存全文
缓存时间: 2026/06/01 15:31
.@MukilLoganathan’s Interrupt keynote on Sandboxes. https://t.co/oddQOs0Q6O
In 20 minutes, you’ll learn how to run agent code safely.
Isolated from your runtime, with network controls, persistent state, and snapshot/restore when things go wrong. https://t.co/g2Pvzi824D
TL;DR: LangChain 的 Mukil Loganathan 在 Interrupt 大会上讲解如何用 LangSmith 沙箱安全执行不受信任的代理代码,涵盖编码代理趋势、沙箱必要性及 LangSmith 沙箱的快速启动、安全隔离、持久化和快照等核心能力。
代理正在编写真实代码
过去半年,行业最大的转折点之一是代理开始编写生产级代码。桑达尔·皮查伊提到谷歌 75% 的代码由 AI 生成;GitHub 数据显示今年约 41% 的提交来自 AI;Stripe 每周有 1300 个 PR 由内部 Minions 编码代理完全自主生成。编码代理正成为主流,而软件工程是首个主要用例。
典型案例
- OpenSWE:LangChain 内部使用的开源编码代理,连接 Slack 和 GitHub,已提交数百个 PR。
- Claude Code:Anthropic 的主力产品,效果突出。
- Devin:支持本地编码与云端任务分发,沙箱化做得很好。
- Ramp:其 Insights 代理能自主截屏并转换为代码,人类仅负责审批。
除了编码,代理控制计算机的能力正扩展到更多领域。
代理的更多用途
数据分析
与其提供预定义 SQL 工具,不如让代理直接编写脚本、加载 CSV 数据、生成图表并完成分析。Julius 和 Hex 等产品已在金融领域实践。
安全
Xbow、Koridor 等公司用代理对基础设施自动化渗透测试,自主尝试突破系统,极大节省人力。
浏览器与系统控制
Stagehand 进行非确定性的 Playwright 测试,Claude 的“计算机使用”功能可操控整个桌面系统。
能力越大,责任越大
今年已出现多起安全事故:
- sci-holude 供应链攻击:安装后导出机器所有凭证。
- n8n 沙箱逃逸:利用 JavaScript 技巧跳出限制。
- 提示注入:恶意 README 或 MCP 服务器可引诱代理泄漏环境变量或执行危险操作。
- Google AI 代理浏览器:近期也被发现可通过注入逃离沙箱。
沙箱正成为基础设施原语,将不安全代码从核心运行时中隔离出来。但构建可靠的沙箱面临四大挑战。
LangSmith 沙箱:应对四大挑战
1. 面向用户的低延迟与弹性扩缩
代理正在成为面向用户的产品,用户期望接近实时的响应。LangSmith 沙箱当前中位启动时间为 0.98 秒,并支持动态启动数千个沙箱,无需用户维护计算资源,系统自动编排和缓存。
2. 恶意行为者与安全隔离
仅靠容器不足以防范逃逸攻击(例如 700 字节脚本即可访问完整主机内核)。提示注入、恶意 MCP 服务器也是真实威胁。
LangSmith 沙箱引入 认证代理 概念:所有网络流量通过沙箱,可配置允许/拒绝列表,凭证保留在代理层而非运行时,即使被注入也能抵御。
3. 长时间运行与状态持久
代理运行时间越来越长,需要可中断、可恢复。LangSmith 沙箱提供持久化层,支持随时暂停/恢复。启动速度快,可在不活跃时关闭,仅按实际使用付费。无活动时间上限(其他提供商通常限制 4 小时),适合数小时至数天的后台任务。也支持多个代理共享同一沙箱状态。
4. 代理会犯错:快照与分叉
评估无法避免所有错误。LangSmith 支持随时创建快照,一旦代理执行破坏性操作(如删除 /etc/resolv.conf 搞坏 DNS),可恢复至之前的检查点。还支持分叉:从同一初始状态启动多个不同尝试,用于比较或调试。
快速上手
一行代码即可开始(集成在 LangSmith SDK 中),所有付费计划可用。支持自带文件系统,可复用已有 Docker 镜像。通过 LangGraph 代理、OpenAI SDK、CLI 等方式均可接入。
路线图
产品仍处于早期,计划推出:
- 本地-远程交接:方便开发者切换环境。
- 共享卷:多个代理访问相同代码或文件。
- 完整执行追踪:结合 LangChain 的可观测性能力,查看沙箱内部的活动。
今天即可在 LangSmith 上体验。团队持续收集反馈,Mukil 本人全天在场交流。
Source: https://www.youtube.com/watch?v=IIchUA5T3gs
相似文章
@LangChain: https://x.com/LangChain/status/2060111005917577668
LangChain 的新闻通讯宣布了 Interrupt 2026 的重大产品发布:用于自动诊断和修复 Agent 故障的 LangSmith Engine,以及用于安全代码执行的 Sandboxes 正式版,同时还启动了新的 LangChain Labs 研究计划,并预告了即将举行的活动。
@LangChain: 关于 LangSmith Sandboxes 的 TLDR:硬件虚拟化微虚拟机,内核与你的服务及其他沙箱隔离。同样…
LangSmith Sandboxes,即提供内核级隔离以确保安全的代理代码执行的硬件虚拟化微虚拟机,现已正式发布。该版本包含快照、写时复制分叉、Blueprints 以及其他集成特性。
[N] LangChain Interrupt 2026 公告 [N]
LangChain 在 Interrupt 2026 上发布了 SmithDB(一款专为智能体可观测性设计的分布式数据库)、Context Hub(用于管理智能体上下文的中心化系统,附带开放记忆标准)以及 Deep Agents v0.6。同时还有来自企业案例研究和 Andrew Ng 与 Harrison Chase 的主题演讲。
@LangChain: Interrupt 现在可以按需观看了!观看录制视频:https://interrupt.langchain.com/recordings
LangChain 的 Interrupt 2026 大会录制视频现在可以按需观看,包含 23 场来自 Cisco 和 LinkedIn 等公司在生产环境中部署 AI 代理的团队的演讲。
@LangChain:让代理具备编写代码的能力,能让它们变得极其强大。这也使得安全性问题变得更加棘手。在L…
LangChain的Deep Agents允许不受信任的代理编写的代码通过基于WebAssembly的代码解释器安全运行,提供执行和能力隔离,无需传统沙盒。