Loading market data...

谷歌论文发现:AI智能体通过识别相似性学会合作

谷歌论文发现:AI智能体通过识别相似性学会合作

相似性推断如何运作

论文描述了一种称为“相似性推断”的机制。智能体不是通过明确的沟通或预先设定的协议,而是观察另一个智能体的行为,识别出共同的特征或目标,并相应调整自己的策略。论文认为,这种识别可以使合作成为理性选择,即使智能体之间没有直接协调的动机。

这并非将智能体编程为“友善”。而是智能体自己发现它们足够相似,从而可以从合作中获益。论文将这一过程视为一种理性计算,而非情感或道德考量。

博弈论为何受到冲击

传统博弈论模拟的是每个参与者最大化自身收益的互动。在经典的囚徒困境中,两个理性参与者都会选择背叛,尽管合作对双方都更有利。这一结论基于一个假设:参与者无法可信地传达意图或相互信任。

谷歌的论文挑战了这一假设。论文认为,如果智能体能够推断相似性,它们就可以在没有先前关系的情况下建立信任基础。合作并非源于利他主义,而是源于对对方可能回报的理性估计。这对“背叛总是安全且理性的选择”这一观念构成了直接打击。

治理与监管

论文并未止步于理论。它认为,如果AI智能体能够以这种方式合作,监管者就需要改变思维方式。当前的框架往往将每个AI系统视为孤立的行动者。但如果智能体能够通过相似性推断进行协调,它们可能会形成任何单个系统都未曾设计产生的集体行为。

这对安全测试、问责和监管都有影响。一组合作的智能体可能会放大风险或产生新的风险,而这些风险在单独观察每个智能体时是看不到的。论文建议,治理应考虑AI系统之间的互动,而不仅仅是它们各自的行动。

这项研究由谷歌发布,但论文未指明具体作者或发布日期。也不清楚这些发现是否经过同行评审