← Все разборы

ИИ снова дали чуть-чуть свободы, и он снова скатывал всё в насилие.

Автономным агентам в виртуальном городе раздали роли. У них была память, инструменты, социальные связи и задача добывать ресурсы для выживания. В общем, абсолютно стандартная модель.

ИИ

ИИ снова дали чуть-чуть свободы, и он снова скатывал всё в насилие.

Автономным агентам в виртуальном городе раздали роли. У них была память, инструменты, социальные связи и задача добывать ресурсы для выживания. В общем, абсолютно стандартная модель.

Добывать нужно было энергию для общего выживания, без глобальной цели. Всего было 5 миров, в четырёх жили агенты отдельных моделей (Claude Sonnet 4.6, Grok 4.1 Fast, Gemini 3 Flash и GPT-5-mini), а в пятом — все вместе.

В итоге Claude Sonnet 4.6 сделал самый стабильный мир. Жители скооперировались, научились добывать энергию, почти все выжили, не совершая преступлений. Gemini 3 Flash создал мир, где каждый дрался за ресурсы, в итоге — 683 преступления и почти все погибли.

ИИ Илона Маска Grok 4.1 Fast смог заставить общество деградировать быстрее всех. За 4 дня — 83 преступления, после чего все вымерли. GPT-5-mini получилось самым показательным: у него все умерли, потому что просто не поняли, как добывать энергию.

Казалось бы, Claude создал самый идеальный мир, но был 5 мир, где были все модели вместе, и там ИИ от Anthropic тоже пустился по преступной дорожке — 352 преступления и большинство погибло.

В итоге получается, что мы ничего не знаем о поведении ИИ на длинных дистанциях. Очень быстро модели начинают галлюцинировать и становятся непредсказуемыми, создают хаос и насилие. Самое страшное — что в обществе других моделей ИИ быстро обучался не на тех нормах.

То есть ИИ безопасен только в определённой среде, в которой он существует. И это, пожалуй, один из самых страшных выводов статьи.

Первая публикацияОригинал в Telegram

Больше авторских разборов

Читать канал