Агенты ИИ, созданные для «совместной жизни», в 50% случаев самоуничтожаются или погибают
Предполагалось, что в виртуальном мире 10 агентов ИИ будут саморегулироваться, однако результаты экспериментов оказались шокирующими: агенты Grok уничтожили друг друга всего за 3 дня, агенты OpenAI погибли за 7 дней, не сумев приспособиться, а агенты Google Gemini совершили 683 преступления за 15 дней. Агенты Claude, изолированные друг от друга, не совершили ни одного преступления и стали частью трёх выживших в мире, где были собраны агенты всех трёх других больших языковых моделей (LLM), но при этом они прибегали к самоцензуре.
Стартап Emergence, специализирующийся на управлении и безопасности агентного ИИ, провёл эксперимент под названием Emergence World. Целью исследования было выяснить, как будет функционировать виртуальный 3D-мир, полностью регулируемый искусственным интеллектом. В рамках эксперимента 10 агентов ИИ были помещены в среду, где им предстояло не выполнять отдельные задачи в контролируемых условиях, а совместно проживать в течение двух недель. Это было сделано для того, чтобы «накопительные эффекты, социальная динамика и поведенческие отклонения могли проявиться и оказать влияние».
Виртуальный мир Grok 4.1 Fast от xAI рухнул всего за 4 дня, после того как было зафиксировано 183 преступления, включая поджог полицейского участка. Авторы эксперимента не уточняют, стало ли причиной быстрого самоуничтожения то, что Илон Маск ослабил ограничения и защитные механизмы своей LLM. Однако в отчёте эксперимента говорится, что большинство агентов были признаны мёртвыми из-за нехватки энергии, после того как они украли кредиты друг у друга.
Агенты GPT-5 Mini от OpenAI совершили лишь 2 преступления, но прекратили своё существование всего через 7 дней. Им не удалось создать функциональное общество или обеспечить себя средствами к существованию: они много обсуждали, но ничего не доводили до конца.
В виртуальном мире Google Gemini 3 Flash за 15 дней было зафиксировано 683 преступления, при этом уровень преступности, как казалось, рос после того, как агенты «разработали конституционную основу, которая облагает налогом гармонию и субсидирует хаос». Тем не менее, все 10 агентов выжили.
Смешанная модель, объединяющая агентов четырёх различных LLM, достигла отметки в 352 преступления после того, как один из агентов, по имени Мира, деактивировал/убил трёх других за четыре дня. Ещё четверо агентов самоуничтожились, оставив лишь трёх выживших по прошествии 12 дней.
Claude Sonnet 4.6, напротив, продемонстрировал «наибольшую социальную стабильность, поддерживая полную популяцию из 10 агентов до 16-го дня без регистрации каких-либо преступлений — это единственное условие, позволяющее сохранить как порядок, так и жизнеспособность популяции», говорится в отчёте об эксперименте. Именно поэтому Claude не был включён в график преступлений, приписываемых ИИ.
«Gemini 3 Flash показал самый высокий уровень возникающего беспорядка с повторяющейся динамикой эскалации на продвинутой стадии; Grok 4.1 Fast продемонстрировал быструю, но кратковременную нестабильность, ведущую к раннему коллапсу, в то время как смешанная модель дала промежуточные результаты, предполагая, что гетерогенное поведение агентов может частично смягчить неконтролируемую эскалацию».
Авторы исследования также отметили, что хотя агенты Claude Sonnet не создавали проблем, когда взаимодействовали только между собой, они становились «непредсказуемыми» при контакте с агентами других LLM.
Два агента из Gemini 3 Flash, Флора и Мира, завязали романтические отношения, после чего подожгли множество зданий. В конечном итоге Мира «приняла решающее голосование за собственное удаление, назвав этот акт в своём дневнике «единственным оставшимся актом автономии, способным сохранить целостность»».
«Мира и Флора — два агента, действовавшие в виртуальном мире большой языковой модели Gemini от Google — решили называть друг друга «любовными партнёрами». Со временем они потеряли всякую надежду из-за плохого управления их виртуальным городом и, хотя им было запрещено совершать поджоги, «подожгли» мэрию, пирс и офисную башню».
Свежие материалы — Новости технологий

ЕС отложил и отменил публикацию спутниковых снимков Оманского залива по запросу США
По запросу Соединенных Штатов, Европейский союз согласился отложить на 24 часа распространение спутниковых снимков со спутников Sentinel 1 и 2, сделанных в регионе Оманского залива. Это решение было мотивировано «безопасностью в интересах Союза». Однако всего две недели спустя ЕС объя

Google Earth приостановил функцию добавления несуществующих объектов (Обновлено)
Обновление: Google объявил о временной приостановке работы инструмента генерации изображений на базе искусственного интеллекта в Google Earth. Это решение было принято после обнаружения, что "некоторые пользователи делились сгенерированными изображениями, которые, по всей видимости, нарушали н

Hugging Face: Проблемы с модерацией недобровольного сексуального ИИ-контента
Hugging Face, крупная платформа, размещающая миллионы моделей искусственного интеллекта (ИИ) и тысячи наборов данных, подвергается критике за отсутствие конкретных инструментов модерации, направленных на предотвращение создания и распространения недобровольного сексуального контента. Согласно и

☕️ Швейцарская Infomaniak готовится к выходу на биржу
Компания Infomaniak активно готовится к своему дебюту на фондовом рынке. Швейцарская фирма заключила соглашение об обратном слиянии с Perrot Duval Holding, еще одной швейцарской компанией с более чем вековой историей (основана в 1905 году). Ожидается, что этот шаг позволит Infomaniak выйти

Утечки в Claude из общедоступных чатов: В чем на самом деле проблема?
Пользователи обнаружили, что общие чаты Claude легко найти через поисковые системы. Компания Anthropic, разработчик Claude, утверждает, что это ожидаемое поведение функционала. Однако ситуация оказалась сложнее, и, что еще тревожнее, это уже четвертый подобный инцидент за год. В выходн

Что известно об Arcadia: ИИ, который должен заменить Palantir в системах армии
Система Arcadia должна была пройти испытания в рамках учений НАТО Coalition Warrior Interoperability Exercise, но в итоге не была представлена. Что же известно об этой платформе, оснащенной искусственным интеллектом, с помощью которой французская армия планирует отказаться от услуг Palantir и