Vitalik Buterin 表示,对抗性治理机制设计理论的杀手级应用出现在人工智能安全领域。治理机制与人工智能安全均涉及能力较弱的委托方如何从能力更强的代理方中获得理想结果。治理场景中委托方是静态算法,代理方是人类;人工智能安全场景中委托方是人类及较弱的大语言模型,代理方是更强的大语言模型。若能限制代理方之间的合谋程度,系统可实现更优结果,该机制设计结论可迁移至人工智能安全领域。