Виталик Бутерин сказал, что «killer app» для теории дизайна механизмов в условиях противодействующего (adversarial) управления, возможно, в конечном итоге появится в области безопасности ИИ. По данным ChainCatcher, он утверждал, что дизайн управления и безопасность ИИ имеют глубокое структурное сходство: оба связаны с тем, как более слабый принципал может получить желаемые результаты от более сильного агента.
В управленческих настройках принципал — это статический алгоритм, а агент — человек. В настройках безопасности ИИ принципал — это человек или более слабая большая языковая модель, а агент — более сильная большая языковая модель. Бутерин сказал, что если сговор между агентами можно ограничить, система может выдавать лучшие результаты, и это понимание в области дизайна механизмов может быть переносимо на безопасность ИИ.

