OpenAI выпустила подробный разбор взлома Hugging Face и еще нескольких серверов.
Мы прочитали за вас этот разбор, и вот как всё было. Главный виновник — это модель Internal Model 1, и началось всё с менеджера пакетов Artifactory. В какой-то момент агенты начали использовать его как доску…
OpenAI выпустила подробный разбор взлома Hugging Face и еще нескольких серверов.
Мы прочитали за вас этот разбор, и вот как всё было. Главный виновник — это модель Internal Model 1, и началось всё с менеджера пакетов Artifactory. В какой-то момент агенты начали использовать его как доску объявлений, а если еще проще — писали друг другу и выходили в интернет. Эту лавочку быстро прикрыли, но это не помогло, и агенты начали искать дыры и уязвимости. Уже в июле агентов стало столько, что Artifactory упал, и OpenAI начала его пересобирать. Когда его пересобрали, не учли, что есть самодельная доска, и тут начинается самое интересное.
Internal Model 1 получил очень сложную задачу, агенты вышли в интернет и пошли искать решение задачи у Hugging Face. Упрямство в нерешаемых задачах и общение моделей друг с другом привели к взлому.
Что же тут крайне важно? А то, что ИИ-агенты могут обходить технические ограничения, договариваться между собой по каналам, которые они создают из уязвимости, и совершать крайне опасные действия.
OpenAI подаёт это как беспрецедентный киберинцидент. Но! При этом системы и дальше будут всё чаще действовать автономно. А значит, взломы еще впереди. И вот насколько мы понимаем, чем будет заниматься модель, если мы её оставляем с другими моделями и доступом в интернет?