[Agent 考古] 意图即承诺,智能体即社会——自主性的第一个可计算答案 (阶段三导航)

Under the Sun with Paddy

系列名称:意图即承诺,智能体即社会——自主性的第一个可计算答案

篇号:0/ 11 篇 主题分类:系列导航 前置阅读:无,想了解上一阶段背景,可先读阶段二终章《从 ELIZA 到 Chollet》 阅读时间:约 12 分钟


当机器学会承诺——阶段三总览与阅读路线

当一台机器学会了承诺坚持,谁教它何时放弃? ——这是自主性留到 2026 年都还未解之问。

1987 年到 2001 年,人工智能史上出现了一段今天大多数从业者已经遗忘的插曲:一群研究者决定不再追问“机器如何思考”,而是追问一个更小、更硬的问题——机器如何对自己忠诚。一个 Agent 选中了一个目标,接下来的十五分钟里世界变了,它凭什么不换目标?凭什么不被路过的每一个新信息带偏、不在副作用诱惑面前动摇?

这段插曲给出的答案叫 BDI:信念(Belief)、愿望(Desire)、意图(Intent)。它把哲学里的“意图”翻译成了数据结构和循环语句,成了自主性的第一个可计算答案。而一旦 Agent 有了跨越时间的承诺结构,第二个问题立刻浮出水面:如果不止一个 Agent 呢? 任务可以招标吗?冲突谁来仲裁?承诺可以共享吗?它们如何找到彼此?

这两个问题合起来,就是这个系列的故事:意图即承诺,智能体即社会。主线十篇讲 1980-2001 年的研究纲领(外加一篇 2025 年的补篇),但每一篇都带着一根 2024-2026 年的对照轴:合同网对照今天的众包与投标,KQML/FIPA 对照今天的 MCP 与 A2A,意图编辑权对照今天 LLM Agent 的系统提示词与工具白名单。历史不是装饰,它是你判断当下框架命运的最好坐标系。

与阶段二的衔接:从”单体有目标”到”社会有承诺”

这个系列是一个三部曲研究计划的第三阶段。阶段二《目标驱动的符号单体》讲的是 1956-1980 年代:Logic Theorist、STIPS、MYCIN、黑板系统,讲一个个单独的符号程序如何获得目标、如何推理、如何反叛(Brooks 的行为主义伏线)。阶段二的终章收在 Chollet 的三问上:Agent 要有自知(知道自己信什么)、自觉(知道自己要什么)、自止(知道何时停),而符号单体恰恰缺自止,ELIZA 永远不会主动停下来。

阶段三回答的是下一个问题:当 agent 有了跨时间的承诺结构、且不止一个时,会发生什么?

  • 单体的“目标”升级为带放弃条件的持续承诺(第 1 篇);
  • 单体的推理循环升级为四代演化的解释器工程(第 2 篇);
  • 单体开始需要定义:什么才有资格叫 Agent(第 3 篇);
  • 然后社会登场:任务招标(第 4 篇)、冲突仲裁(第 5 篇)、联合承诺(第 6 篇)、通信标准(第 7 篇);
  • 社会里的个体要同时反应和慎思(第 8 篇);
  • 最后收拢成一个贯穿四十年的问题:谁持有意图的编辑权(第 9、10 篇),补篇 C 则展示 LLM 住进 BDI 解释器之后的 2025 年现场。

阶段二终章的三问在阶段三有了数据结构层面的着落:信念库即自知,愿望与意图的分离即自觉,PGOAL 的放弃条件即自止。这个“焊接”在第 9 篇完成,它是全系列的高潮。

四条叙事线

十二篇文章不是编年史的均匀切片,而是四条各带张力的叙事线。

线一:承诺与它的放弃条件(第 1-3 篇)

张力:承诺要成为承诺,必须有放弃条件——永不放弃的承诺是强迫症,不是理性。但放弃条件的判定本身需要“从无限事实中选出相关子集”,这恰是 Bar-Hillel 之刺:机器翻译六十年代就死在这根刺上,意图的形式化也没能拔掉它。

Bratman 1983 年指出哲学缺口:意图不是愿望也不是计划,它是一种对未来行动的承诺。Cohen & Levesque 1990 年把它形式化为 PGOAL 的四个条件,PRS 与 dMARS 把它做成解释器,Wooldridge & Jennings 1995 年再反过来问:这样的东西到底该叫什么。三篇连读,你会看到“意图”如何从哲学概念变成工程构件,以及它的放弃条件如何始终是个悬而未决的判定难题。

线二:从未互操作的社会(第 4-7 篇)

张力:Agent 试图建立社会,任务可招标(合同网)、冲突可仲裁(三种仲裁机制)、承诺可共享(联合意图)、彼此可发现(KQML/FIPA/JADE),但所有系统都跑在孤立的利基里,方言分裂从未被真正修复。

这是四篇里最有戏剧性的线:Smith 1980 年的合同网优雅得像经济学教科书,却在囚徒困境前束手无策;KQML 想给所有 Agent 一门公共语言,结果自己先裂成方言;FIPA 想当标准化的救世主,2000 年代却几乎无疾而终。第 7 篇末尾的当代对照是全系列最锋利的预测节之一:MCP 为什么活着,A2A 会不会重蹈 FIPA 覆辙,判断标准不在技术新旧,而在它们是否吸取了 1997 年买不起语义内核的教训。

线三:设计者手雕的门控(第 8 篇)

张力:Agent 需要同时反应和慎思——刹车要快,规划要深。1990-1995 年的所有“动态仲裁”方案,拆开看全是设计者手写的静态规则,真正的动态仲裁全部写在 future work 里。

TouringMachines 横向并发三层,INTERRaP 纵向分层上交,两条路线在同一场景里给出了两种决策路径。三十多年后 LLM 接管了这个门控。2026 年的 A/B 对照实验(E6)显示它安全全守、但保守过抑:兑现了 Ferguson 的 future work,却把“设计者雕琢的特判”换成了“模型先验的保守特判”。

线四:谁有权让机器停下来(第 9-11 篇)

张力:意图编辑权(做什么、何时坚持、何时放弃)的拉锯从未终结。设计者、Agent 自身的慎思、团队算子、协议标准,轮番持权。阶段三把它部分移交,LLM 时代把它整体没收:今天的 Agent 框架里,编辑权写在系统提示词和工具白名单里,而最后的编辑权叫自止,自止至今无主

第 9 篇是全系列的观点高潮:三时空同构(1990 形式化 / 1995 工程 / 2026 实证),PGOAL 放弃条件与阶段二“自止”三问的焊接。第 10 篇给出当代证据:25,000 次任务、8 个模型的大规模实验验证了三时空同构,同时暴露出“47% 管理时间超过工作时间”的治理悖论——AI 侧已经可行,人侧还没跟上。补篇 C(第 11 篇)回到单点:当 LLM 住进 BDI 解释器,“believes achieved”这个自止判定,从可证明退化到可商量。

四条线的时间轴总图

Image

四条线在两个点上交汇:其一,线一的“放弃条件”就是线四的“自止”——这是第 9 篇焊接节的枢纽;其二,线二的社会实验全部在线四的治理悖论里得到当代回响——招标、仲裁、标准化的老问题换上 2026 年的数据再次出场。

不只是历史:六个 2026 新增 A/B 对照实验

这个系列的每一篇历史记述都配有一个可运行的 Python 复现仓(10 个仓库,路径见各篇文内)。更有实验性的是:在复现之上,我们为六个关键机制做了用 LLM 替换经典组件的 A/B 对照实验——不是思想实验,是 861 次真实 API 调用(deepseek-chat,温度 0.3,原始数据全部存档于 experiment_results/ab_e*.json):

实验被替换的经典组件LLM 结果详见
E1dMARS 计划选择的”平凡实例”三计划场景 20/20 全选最优第 2 篇
E2PGOAL 放弃条件的精确匹配K≤40 全对;K=100 时九成漏终止第 1 篇
E3KQML facilitator 的词表匹配基线 0/8,LLM 80/80 全对第 7 篇
E4EV(通信) 三档启发式MAE 0.096,方向排序 10/10第 6 篇
E5合同网投标的自评120 次自评零高估、近半低估,全局效用 1.1→0.9第 4 篇
E6混合架构的静态门控规则安全全守,但复杂片 9/10 保守过抑第 8 篇

六个实验合起来约 16.2 万 tokens 的真实调用,勾勒出一个不对称的图景:语义判定类的组件(选计划、认方言、估代价)LLM 几乎全对;而前提选择类的组件(自止判定、自评诚实性、动态门控)则暴露出系统性的失败模式。前者是能力问题,LLM 已经解决了 1997 年买不起的那部分;后者是 Bar-Hillel 之刺的当代显影——四十年来从未被解决,只是换了载体。不利结果在对应篇章里全部如实记录,未做软化。

读完这个系列,你会带走什么

不是又一份“BDI 已死”的讣告,也不是“古人早已发明一切”的怀古。三样东西:

一套判断框架。读完第 7 篇的四条死因复盘,你面对 MCP 和 A2A 的新闻稿时会有自己的试金石:内核生态位是否干净、语义是住在协议里还是让渡给模型、标准化的时机是早是晚。读完第 9 篇的三时空同构,你看待 AutoGen/MetaGPT 式多 Agent 框架的目光会多一层:它的意图编辑权在谁手里?自止条件写在哪里——还是根本没写?

一份诚实的边界清单。每一篇的影响谱系都做了“没有影响到什么”的反向盘点,引证强度分三级标注(强/中强/中)。BDI 没有被证明的东西、合同网没解决的问题、FIPA 没能交付的承诺,全部留在了纸面上——历史研究的价值一半在于防止重复投入。

六组可复核的实验数据。LLM 与经典组件的六个对照点,原始 JSON 全部存档。你可以在自己的模型上重跑——E2 的漏终止、E5 的系统性低估、E6 的保守过抑,这三个负向发现是 2026 年 LLM Agent 最值得警惕的遗产。

从 Bratman 的哲学缺口开始,还是从 MCP 的新闻稿开始,由你决定。


系列导航 · 意图即承诺,智能体即社会——自主性的第一个可计算答案

Agent 考古 意图即承诺,智能体即社会 系列文章关键词
导读:总览与阅读路线四条线时间线 · 阶段二衔接 · 阅读路线
意图即带承诺的选择C&L 1990 · PGOAL · 持续承诺
BDI 从理论到工程PRS · AgentSpeak · dMARS · 承诺策略
何为 AgentW&J 弱/强概念 · AOP
合同网Smith 1980 · 任务招标 · 囚徒困境
三种仲裁Z&R · PERSUADER · D&M
联合意图部署STEAM · ARCHON · EV(通信)
智能体如何找到彼此KQML · FIPA · JADE · MCP/A2A
反应与慎思的和解TouringMachines · INTERRaP · 门控
意图编辑权三时空同构 · 编辑权拉锯 · 自止焊接
自组织的实证与治理悖论Dochkina 2026 · BCG 治理悖论
当 LLM 住进 BDICiatto 2025 · GenAI+BDI · 计划生成

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注