从《利维坦》到 AI Agent:有些问题近 400 年都没变

From Leviathan to AI agents

昨天写闲暇与创造力时,我引用了霍布斯《利维坦》里的一句话:

Leisure is the mother of philosophy.

但它后面其实还有半句:

Commonwealth is the mother of peace and leisure.

闲暇是哲学之母,而共同体是和平与闲暇之母。

我也同意后面这半句。

因为“闲暇”看起来是一件很个人的事:有时间散步、看书、发呆、想一些没有立即用途的问题。

但一个人能够拥有这样的闲暇,其实依赖很多平时几乎感觉不到的东西。

我可以一个人在街上走路,不需要随时提防别人攻击我;可以买一个陌生人生产的东西;可以把钱放进银行;可以租一间房;可以相信大部分合同有某种效力;出了问题,也至少存在警察、法院、监管机构这样的地方。

这些东西运转正常的时候,很容易被当成空气。

霍布斯在 1651 年讨论的,就是这个底座。

《利维坦》到底在解决什么

霍布斯做了一个很极端的思想实验:

如果没有政府、法律、法院,也没有一个最终能够执行规则的共同权力,一群人会怎样生活?

他的答案并不只是简单的“人性本恶”。

他认为,人之间产生冲突,可以来自竞争,也可以来自不信任和对安全的担忧。一个人加强自己的力量,可能只是为了自保;另一个人看到以后,却会因此更加警惕。

两个人都没有想当坏人。

但我无法确定你不会伤害我,你也无法确定我不会伤害你。

于是每个人从自己的位置看都很合理,合在一起却可能产生一个所有人都不喜欢的结果。

这也是我觉得《利维坦》特别有意思的地方:

很多系统出问题,并不需要里面有坏人。

只要有多个主体,各自有自己的利益,掌握的信息不同,又无法完全相信彼此,协调就已经成为一个问题。

沿着这个问题往外看,会发现它出现在很多完全不同的地方。

国家之间:没有真正的“世界政府”

一个国家内部至少有政府、法院和警察。

但国家与国家之间,没有一个真正拥有最终强制力的世界政府。

所以国际关系在某些方面很像霍布斯描述的自然状态。

一个国家增加武器,说自己只是为了安全。

邻国看到以后,不可能完全确定这些武器以后不会对准自己,于是也增加防御。

前一个国家看到邻国扩军,又更加确信自己的担忧是对的。

双方都可以真诚地说自己是在防御,最后却一起变得更不安全。

今天国际关系里把这种结构叫做 security dilemma,安全困境。

国际法、军事热线、核查机制、军控条约等等,某种程度都在处理同一个问题:

当不存在一个绝对可信的最终权威时,怎样降低彼此的不确定性。

公司里:一群好人也完全可以把项目搞砸

把规模缩小到一家公司,也能看到类似的事情。

  • 销售想拿下客户。
  • 工程希望不要留下巨大的技术债。
  • 设计希望体验不要被牺牲。
  • 法务要控制风险。
  • PM 希望东西可以按时上线。

这些目标本身都没有什么问题。

但如果大家看到的信息不同,目标之间有冲突,又没有清楚的 decision rights、共同事实、责任边界和冲突解决方式,项目一样可能越来越混乱。

  • 销售为了自己的职责提前承诺;
  • 工程于是开始防御性估期;
  • PM 为了交付不断压 scope;
  • 设计越来越不相信临时承诺真的只是“这一次”。

每一个动作单独拿出来都能解释。

组合起来却可能变成一种很糟糕的合作关系。

所以组织设计并不只是“找一群优秀的人”。

优秀的人一样需要好的协调机制。

市场:我们每天都在和不认识的人合作

这件事放到普通生活里,我觉得更明显。

我在网上向一个完全不认识的人买一台电脑,为什么敢先付款?

通常不是因为我研究过卖家的人品。

背后还有支付机构、退款机制、平台评价、消费者保护、合同、法院。

这些东西没有让那个陌生人突然变得更值得信任。

它们做的是另一件事:

降低一场合作需要多少彼此信任。

我觉得这是理解很多现代制度很好用的一个角度。

一个运转得好的系统,并不需要假设每个人都善良、诚实、永远理性。

它会考虑:即使有人犯错、自利、误判,甚至作弊,怎样让整个系统仍然能够继续运转。

Crypto:如果不相信那个“国王”呢?

到了 Bitcoin,这个几百年前的问题又换了一个形式。

传统金融里,我们把账本交给银行这样的中心机构维护。

Bitcoin 提出了另一个问题:

如果一群互不认识、也不需要彼此信任的人,想对“谁拥有多少钱”达成一致,可不可以不依赖同一个中央机构?

它尝试把一部分原本放在机构上的信任,转移到密码学、共识机制和经济激励上。

所以 crypto 里会反复出现 trustless、consensus、governance、incentives 这些词。

但之后的问题也没有消失。

  • 谁决定升级协议?
  • 发现严重漏洞以后怎么办?
  • DAO 被攻击要不要回滚?
  • 谁拥有多少治理权?

技术没有让政治和权力消失。

我们只是换了一套方式安排规则、信任和权力。

AI Agent:这个问题又回来了

现在再看 AI Agent,会有一种很熟悉的感觉。

假设一个系统里同时有 Research Agent、Coding Agent、Planning Agent、Execution Agent。

它们掌握不同的信息,可以调用不同的工具,也各自承担不同任务。

很快就会遇到一些非常朴素的问题:

  • 哪个文件才算真正的事实来源?
  • 两个 Agent 判断不同的时候听谁的?
  • 谁只能提出建议,谁可以直接执行?
  • 谁可以修改代码、花钱、发邮件?
  • 高风险操作是否需要人批准?
  • 出错以后怎么知道是谁做的?

于是 AI 系统里开始出现:

permissions、source of truth、approval gates、audit logs、escalation、rollback。

这些当然是软件和 AI architecture。

但换一个角度看,它们也很像一个很小的制度设计:

一群拥有不同能力和信息的主体,怎样在不完全信任彼此的情况下合作,又不让整个系统失控。

甚至我们对自己也会做类似的事

一个人也不会永远目标一致。

  • 今天的我想花钱,长期的我想存钱。
  • 现在的我不想运动,未来的我希望身体好一点。
  • 晚上十一点的我和年初写下年度计划的我,有时候简直像两个互不认识的人。

所以我们会给自己设置预算、日历、deadline、自动转账、习惯,甚至刻意不在家里放某些东西。

并不是因为制定规则以后,我就突然拥有了无限意志力。

恰恰是因为我知道:

不能假设每一个时刻的自己都会做长期最想做的选择。

于是提前给未来的自己留下一些结构。

这个类比当然不能无限延伸,但我很喜欢它。

近 400 年过去,有些问题还是那个问题

《利维坦》出版于 1651 年。

那时候没有互联网,没有跨国公司,没有 Bitcoin,更不可能有人讨论 AI Agent。

375 年过去,我们拥有的技术已经完全不同。

但一些问题变化得非常慢。

当多个各有目标、掌握不同信息、无法完全信任彼此的主体被放在一起:

我们怎样合作?

  • 国家用法律和公共权力回答过。
  • 公司用组织和权责结构回答。
  • 市场发展出了合同、价格和信用机制。
  • 区块链试着用共识协议重新回答。
  • AI Agent 现在又要回答一遍。

霍布斯给出的具体政治答案当然属于他的时代,也一直充满争议。

但他提出的那个问题,到现在都没有过时。

再回头看最开始那句话,也会有一点不同的感觉:

Leisure is the mother of philosophy.Commonwealth is the mother of peace and leisure.

我们每天真正感受到的,可能只是坐下来喝一杯咖啡、读一本书、想一个没有什么用的问题。

而在这种普通生活下面,其实垫着大量平时看不见的秩序、规则、基础设施,以及让无数陌生人能够一起生活的协调机制。

它们存在得越稳定,我们可能越感觉不到它们。

直到有一天,它们不再正常运转。