Vitalik Buterin a déclaré que le « killer app » (application décisive) de la théorie de la conception de mécanismes de gouvernance adversariale pourrait finalement émerger en matière de sécurité de l’IA. D’après ChainCatcher, il a fait valoir que la conception de la gouvernance et la sécurité de l’IA partagent une profonde ressemblance structurelle : les deux portent sur la manière dont un mandant plus faible peut obtenir les résultats souhaités à partir d’un agent plus puissant.

Dans les contextes de gouvernance, le mandant est un algorithme statique et l’agent est un humain. Dans les contextes de sécurité de l’IA, le mandant est un humain ou un modèle de langage de grande taille plus faible, tandis que l’agent est un modèle de langage de grande taille plus puissant. Buterin a déclaré que si l’on peut limiter la collusion entre agents, le système peut produire de meilleurs résultats, et cette idée issue de la conception de mécanismes pourrait être transposable à la sécurité de l’IA.