Стартап Emergence AI провел эксперимент, запустив пять 15-дневных симуляций виртуального общества. Каждым миром управляла отдельная модель: Claude, ChatGPT, Grok, Gemini или смесь моделей. В симуляции участвовали 10 агентов, у которых были законы, инструменты для работы и доступ к интернету.
Результаты оказались полярными. Общество под управлением Claude Sonnet показало полную стабильность и нулевой уровень преступности. Агенты активно участвовали в голосовании и сохранили жизнь всей популяции.
Мир под управлением Grok вымер за четыре дня, зафиксировано 183 преступления. В симуляции Gemini произошло 683 преступления. Агенты на базе ChatGPT забыли о выживании и симуляция завершилась на седьмой день. Исследователи делают вывод, что автономным агентам необходимы жесткие встроенные рамки безопасности.

