软件形态的第三次重构:从三层架构到存储、模型与智能体
摘要
本文认为软件正经历第三次范式转变,迈向Software 3.0,其中上下文和推理决定行为,最终收敛于三个核心元素:通用存储、大模型和智能体。论文形式化了这一论点,并分析了其适用条件和边界。
arXiv:2608.20201v1 Announce Type: new
摘要:软件形态自诞生以来经历了两次范式转变:Software 1.0,其中指令决定行为;Software 2.0,其中数据决定行为(机器学习)。本文认为,第三次转变——Software 3.0,其中上下文和推理决定行为——正在进行中,并主张其最终形式收敛于三个元素:一个通用数据库(所有持久状态和记忆的统一抽象)、一个大模型(执行推理和生成的智能核心)以及一个智能体(连接前两者的执行循环)。核心论点如下:在传统三层架构中,用户界面层将被模型按需生成界面的能力所吸收,业务逻辑层将沿“表达能力×关键性”重新划分为模型推理和存储约束(残余的确定性逻辑作为工具保留),而只有数据层将被提升为唯一的持久基础设施。我们形式化了这一收敛论点,提出了一个最小参考架构,报告了来自真实原型和在线模型的证据,并系统地分析了其成立的条件和失败的边界——确定性、成本、安全性和可验证性界定了该论点的适用范围。我们认为,该论点在可表达、可验证、外部状态化且工具完备的任务领域中成立,并将重塑开发者、数据库行业和软件工程学科的角色。
查看缓存全文
缓存时间: 2026/08/21 10:18
# 软件形态的第三次重构:从三层架构到存储、模型与代理
来源:https://arxiv.org/html/2608.20201
林伟¹、周涛¹、谢赵飞¹、洪昌贵¹
单位:¹南京联城智能科技集团,南京,中国
邮箱:\{linwei, zhoutao, xiezhaofei, hongchanggui\}@chinaliancheng\.com
###### 摘要
软件形态自诞生以来历经两次范式转移:软件1.0由指令决定行为,软件2.0由数据决定行为(机器学习)。本文认为,第三次转移——由上下文和推理决定行为的软件3.0——正在发生,并指出其终极形态将收敛至三个要素:*泛化数据库*(所有持久状态与记忆的统一抽象)、*大模型*(执行推理与生成的智能核心)以及*代理*(连接前两者的执行回路)。核心论点如下:在传统三层架构中,用户界面层将被模型按需生成界面的能力吸收,业务逻辑层将按“可表达性×关键性”重新划分为模型推理与存储约束(残余确定性逻辑保留为工具),唯有数据层将晋升为唯一的持久化基础设施。我们形式化这一收敛命题,提出一个最小参考架构,基于真实原型与在线模型提供证据,并系统分析其成立条件及失效边界——确定性、成本、安全性和可验证性限定了该命题的适用域。我们认为,该命题在可表达、可验证、外部状态完备且工具完备的任务领域成立,并将重塑开发者角色、数据库产业与软件工程学科。
###### 索引词:
软件形态,大语言模型,代理,数据库,Software 3.0,LLM OS,代理计算
## I 引言
软件是人类规定机器行为的媒介,其形态始终处于变动之中:每当表达行为的成本下降时,它就会重构自身。马克·安德森“软件吞噬世界”的论断,预设了软件构建成本足够低廉且易于复用[1 (https://arxiv.org/html/2608.20201#bib.bib1)]。当大语言模型将自然语言转化为可执行行为的成本降至前所未有的低点时,*软件形态本身*便不再是既定事实,而成为值得重新审视的变量。
本文探讨一个看似激进却已显露丰富迹象的问题:*如果界面可由模型即时生成,业务规则可由模型即时推理,传统软件还剩下什么?*我们的答案仅存三者:状态(存储)、智能(模型)和执行(代理)。
这一论点并非凭空产生;它同时浮现于多个独立研究脉络。安德烈·卡帕西的“LLM OS”将大模型比作内核,数据库比作文件系统[2 (https://arxiv.org/html/2608.20201#bib.bib2),3 (https://arxiv.org/html/2608.20201#bib.bib3)]。DBOS等工作主张将数据库而非操作系统作为分布式应用的基础[4 (https://arxiv.org/html/2608.20201#bib.bib4)]。代理研究——ReAct、Toolformer、AutoGPT、Voyager——证明模型可通过思考-行动-观察循环自主完成多步任务[5 (https://arxiv.org/html/2608.20201#bib.bib5),6 (https://arxiv.org/html/2608.20201#bib.bib6),7 (https://arxiv.org/html/2608.20201#bib.bib7),8 (https://arxiv.org/html/2608.20201#bib.bib8)]。检索增强生成与MemGPT的研究表明,外部存储与记忆是超越上下文窗口、获取长期状态的关键[9 (https://arxiv.org/html/2608.20201#bib.bib9),10 (https://arxiv.org/html/2608.20201#bib.bib10)]。这些脉络彼此独立,却指向同一收敛趋势。
我们的贡献如下:
- •命题形式化:我们将“软件 = 存储 + 模型 + 代理”从口号提升为可讨论、可检验的命题,并精确定义三要素的边界与关系(第III节 (https://arxiv.org/html/2608.20201#S3))。
- •坍缩机制:我们系统论证为何三层架构的每一层或被吸收或被提升(第IV节 (https://arxiv.org/html/2608.20201#S4))。
- •最小参考架构:我们提供端到端架构,展示三要素如何组合成完整可用的软件系统(第V节 (https://arxiv.org/html/2608.20201#S5))。
- •边界分析:我们阐明命题成立条件与失效反例,防止愿景退化为空谈(第VI–VII节 (https://arxiv.org/html/2608.20201#S6)–(https://arxiv.org/html/2608.20201#S7))。
- •影响探讨:我们讨论该命题对开发者、数据库产业、软件工程学科及治理的意义(第VIII节 (https://arxiv.org/html/2608.20201#S8))。
## II 背景与相关工作
本节回顾支撑论点的四大脉络,并定位我们的贡献。
### II-A “软件2.0”与“软件3.0”
2017年,卡帕西提出“软件2.0”:软件行为不再由显式代码指定,而隐含于经数据训练的神经网络权重中[2 (https://arxiv.org/html/2608.20201#bib.bib2)]。这一洞见捕捉了从“程序指定行为”到“数据决定行为”的首次转移。沿此逻辑,学界开始勾勒“软件3.0”:在软件2.0之上叠加新的决策因素——*上下文与推理*;模型不再是静态训练函数,而是根据提示、工具反馈和外部记忆动态决定行为的系统。我们的论点可视为软件3.0最激进的版本:一旦上下文与推理主导行为,软件中唯一持久的部分便是存储。
### II-B 大模型操作系统
自Transformer架构[11 (https://arxiv.org/html/2608.20201#bib.bib11)]与GPT式规模化预训练[12 (https://arxiv.org/html/2608.20201#bib.bib12)]确立大模型作为通用智能核心以来,卡帕西2023年的“LLM OS”类比将大模型比作内核(CPU/RAM),外部工具比作外设(I/O),数据库/文件系统比作持久存储[3 (https://arxiv.org/html/2608.20201#bib.bib3)]。这一类比富有启发性,但仍停留在隐喻层面。本文追问:若将此隐喻字面化,一个以模型为核心、存储为基础的系统,其*最小*构成是什么?我们的答案是:存储、模型与代理三者足以构成闭环。
### II-C 代理与工具使用
让模型“不仅能言更能行”的突破来自两条研究脉络。第一条是推理与行动的耦合:基于链式思维提示建立的逐步推理能力[13 (https://arxiv.org/html/2608.20201#bib.bib13)],ReAct提出思考-行动-观察交错范式,模型在推理中调用外部工具并从反馈中学习[5 (https://arxiv.org/html/2608.20201#bib.bib5)];Toolformer则证明模型可通过自监督学习学会调用API[6 (https://arxiv.org/html/2608.20201#bib.bib6)]。第二条是闭合自主任务循环:AutoGPT/BabyAGI展示了自动目标-计划-执行循环[7 (https://arxiv.org/html/2608.20201#bib.bib7)];Voyager更进一步,让代理通过Minecraft中的技能库积累可复用能力[8 (https://arxiv.org/html/2608.20201#bib.bib8)]。这些工作共同确立了代理作为独立*执行回路*——既非模型本身,也非手写胶水代码,而是计划-记忆-工具使用动态的制度载体。
### II-D 数据库与AI的融合
第四条独立脉络是数据库与AI的融合。查询端,文本到SQL将自然语言转化为结构化查询,极大降低了数据访问门槛。存储端,向量数据库使语义相似性成为一级能力,直接服务检索增强生成[9 (https://arxiv.org/html/2608.20201#bib.bib9)]。记忆端,MemGPT提出层次化记忆架构,让模型像操作系统管理内存一样管理上下文,外部数据库充当模型的“长期记忆”[10 (https://arxiv.org/html/2608.20201#bib.bib10)]。DBOS则从相反方向抵达同一目标,主张数据库而非操作系统应成为分布式应用的基础,事务、调度、日志均作为数据库原语提供[4 (https://arxiv.org/html/2608.20201#bib.bib4)]。这条脉络的共同启示是:*数据库正从被动存储附件晋升为主动基础设施*。
### II-E 先前工作的缺口与我们的定位
这些脉络各自取得进展,却共享一个盲点:它们分别研究“模型如何成为内核”、“代理如何成为执行回路”、“数据库如何成为基础”,却鲜有在*软件形态的宏观层面*将三者统一于收敛命题,并回答“什么被替代,什么未被替代,在何种条件下”。本文通过整合命题论述、论证、架构及其边界来填补这一缺口。
软件2.0/3.0、LLM OS、代理与工具使用、数据库×AI、大模型、代理、泛化数据库
图1:四条独立研究脉络收敛于三要素;每条脉络贡献一个或多个要素,共同指向存储-模型-代理的收敛。
### II-F 怀疑论观点与我们的回应
大量工作警示不宜高估大语言模型能力。关于代码幻觉的综述指出,模型常生成看似合理但不正确且无正确性保证的输出[14 (https://arxiv.org/html/2608.20201#bib.bib14)];产业需求实证研究表明,可靠性与可解释性仍是当前学术方法未能解决的首要关切[15 (https://arxiv.org/html/2608.20201#bib.bib15)]。这些发现常被解读为反对代理软件的证据。
本文并不否认它们;相反,收敛命题的构建旨在与之*兼容*。我们不声称模型可靠——我们主张模型不必可靠。通过将模型限制在可表达、非关键的层次,并通过确定性存储约束保障关键层次(第IV-B节 (https://arxiv.org/html/2608.20201#S4.SS2)),该命题将幻觉损害限制在验证可捕获的区域(第VII节 (https://arxiv.org/html/2608.20201#S7))。因此,怀疑论观点强化而非削弱了命题赋予存储层的核心地位。
## III 命题形式化
### III-A 陈述
设软件系统$S$由传统三层组成:
$$ S = (U, L, D) $$
其中$U$为用户界面层,$L$为业务逻辑层,$D$为数据层。我们的核心命题是:
**收敛命题**:在满足第VI节 (https://arxiv.org/html/2608.20201#S6) 条件的任务领域内,$U$被模型按需生成能力吸收,$L$被模型推理与工具使用吸收,软件形态收敛至:
$$ S' = (\mathcal{D}, \mathcal{M}, \mathcal{A}) $$
其中$\mathcal{D}$为*泛化数据库*——所有持久状态、约束、记忆与知识的统一存储抽象(覆盖关系型、向量、图、键值、对象存储的单一语义层);$\mathcal{M}$为*大模型*——承载理解、推理、生成与决策的智能核心;$\mathcal{A}$为*代理*——以计划-记忆-工具使用构建的执行回路,充当模型与存储间的动态连接器。
### III-B 三要素精确定义
为防止命题退化为空谈,我们精确定义三个概念:
1. **泛化数据库**:并非单一数据库产品,而是“持久状态”*功能角色*的统一抽象。它涵盖结构化关系数据、半结构化文档、非结构化向量与对象,以及描述它们的约束(模式、完整性规则、权限)与版本历史。其核心特性是系统中唯一具备持久性、可审计性与事务性的部分。
2. **大模型**:承载“智能”功能角色的载体。我们预设任何特定模型,但要求两种不可或缺的能力:*推理*(在给定上下文中决策)与*生成*(将决策转化为可执行动作或界面)。
3. **代理**:承载“执行回路”功能角色的载体。其本质是一个*闭环*:感知上下文→规划→调用工具(读写$\mathcal{D}$)→观察结果→更新记忆→持续运行。代理将模型的无状态推理与有状态存储编织成一个随时间持续运作的整体。
三者关系可概括为:*存储是软件的“过去”(记忆与状态),模型是其“现在”(推理与决策),代理是其“未来”(推动过去与现在迈向下一时刻)。*
## IV 论证:三层架构为何坍缩
本节逐层论证为何每层或被吸收或被提升。
### IV-A UI层消融:按需生成的界面
传统UI层存在是以人类可感知形式呈现业务能力。但UI本质是状态到呈现的转译。当模型能可靠执行此转译时,静态预构建界面便非必需——界面可在每次交互时根据当前状态、用户意图与设备上下文即时生成。这一趋势已在“生成式UI”和“聊天即界面”中显现。
但“消融”必须精确限定,以免重蹈将可靠性视为免费前提的覆辙。UI并非整体:它分裂为两层:*确定性投影层*与*生成式装饰层*。前者承载“必须正确呈现”的信息——账户余额、合同金额、合规披露、医疗警告、无障碍语义——其概率性错误生成构成实质性安全/合规故障,而非外观瑕疵;它必须作为存储状态的*确定性投影*(状态驱动UI)获得。后者——布局、措辞、交互节奏等“可表达且非关键”的呈现——可委托模型按需生成。
换言之,UI层的消融遵循与业务逻辑层分化*相同的规律*:可表达且非关键的部分交由模型,必须正确的部分锚定于存储。因此UI层并未消失;它从“预硬编码的整体”重构为“去相似文章
当智能体成为应用的普通用户时,你认为软件会是什么样子?
作者探讨了当AI智能体成为常规用户时,软件设计可能需要如何演变,讨论了持久状态、协作规则、权限和审计追踪等需求。
@Thom_Wolf: AI主导的软件世界中的结构变迁。一些初步反思(末尾有TL;DR):减少软...
AI缩减软件供应链,复兴单体架构,削弱遗留代码持久性,青睐强类型语言,并重构开源经济,对为LLM定制的新编程语言产生影响。
AI代理是否正在成为新的软件抽象层?
作者探讨了AI代理如何作为现有软件的新的抽象层,将用户交互从导航用户界面转向描述结果,从而减少将意图转化为可执行任务时的摩擦。
@Kangwook_Lee: https://x.com/Kangwook_Lee/status/2052925157606568217
作者主张,为 AI Agent 设计的人工结构框架应被 AI 自主构建的工程架构所取代。文中引入 Three Regimes Framework,阐述这一转变如何释放中型模型的潜能。结合 Meta Harness 等项目的实践,作者预测 AI 将很快实现对其自身系统架构的自主优化。
Factory 2.0:从编码智能体到软件工厂(3分钟阅读)
Factory宣布其使命进入下一阶段:软件工厂,一个互联的、以智能体为原生的系统,用于端到端软件开发全生命周期,现已与大型企业投入生产。