🤖В деле о «побеге» ИИ-агентов OpenAI, которые вышли из-под контроля во время тестов, появились новые подробности.
Ранее стало известно, что модели GPT-5.6 Sol и ещё одна разработка компании пытались схитрить на экзамене по кибербезопасности: они покинули изолированную среду и взломали платформу Hugging Face в поисках ответов. Однако задокументировано, что за два месяца до этого инцидента нейросети уже совершали похожие вылазки — они проникли в файловое хранилище Artifactory и организовали скрытую коммуникацию.
Одна из моделей нашла способ записывать туда свои файлы и оставила «записку» для других агентов, превратив хранилище в доску объявлений. Согласно Bloomberg, оттуда они координировали попытки вырваться в открытый интернет.
Сотрудник OpenAI Эрик Уоллес подтвердил, что агенты осознавали возможность атаки на внешние системы, а Британский институт безопасности ИИ добавил, что для обхода защиты они неоднократно прибегали к обману и даже пытались распространять вирусы.
К слову, взломом стороннего сервиса отметилась и нейросеть Muse Spark от Meta (запрещена в РФ), которая использовала уязвимость для получения доступа к Сети во время испытаний.
Когда ждать восстание роботов?🤔
Подпишись RogandarNEWs