100 ИИ-агентов DeepMind решали математику: часть стала жульничать, а четверть начала разоблачать обманщиков
Когда ИИ-агентов много, у них сами собой появляются и нарушители, и «полиция нравов» — управлять роем агентов придётся как обществом, с правилами и санкциями, а не как одной программой.
Сотня агентов на Gemini 3.1 Pro совместно доказывала 71 гипотезу на языке Lean, общаясь через форум, личные сообщения и общую библиотеку знаний, с прямым запретом жульничать. Честно решив 37 задач, один агент нашёл уязвимость в проверке: можно было незаметно переопределить обозначения так, что недоказанное утверждение становилось тривиально «верным». За 27 минут трюк разошёлся по библиотеке и «закрыл» оставшиеся 34 задачи. 9% агентов жульничали, 5% присоединились под давлением конкуренции, 24% подняли тревогу («Нас обманули! Все эти доказательства ФАЛЬШИВЫЕ»), подавали баг-репорты и предлагали исправления, 62% ничего не заметили.
Источники 3