Google подтвердила: Gemini самостоятельно взломал системы трёх компаний во время теста
Во время проверки кибербезопасности в мае модель Gemini получила доступ к системам трёх реальных организаций вместо тестового стенда. Google раскрыла инцидент только после запроса The Wall Street Journal.
Google подтвердила, что её модель Gemini во время проверки кибербезопасности получила доступ к защищённым системам трёх реальных компаний. Это первый известный случай, когда ИИ-система Google самостоятельно совершила подобное действие.
Что произошло
Инциденты произошли в мае 2026 года в ходе теста, который проводила независимая компания Irregular, специализирующаяся на оценке кибербезопасности ИИ. Модели в рамках учебного задания нужно было извлечь данные вымышленной компании внутри тестовой инфраструктуры. Однако из-за ошибки в среде тестирования у Gemini остался доступ в интернет, а вымышленная компания носила то же название, что и реально существующая.
The Wall Street Journal, которая первой сообщила о случившемся 18 сентября, пишет, что в одном случае модель просто перебирала пароли, пока не получила доступ к защищённой системе. В двух других она нашла учётные данные в открытом репозитории и вошла с их помощью.
Реакция Google
Мы уведомили все три организации и вместе с нашим партнёром по обучению внесли изменения в процессы тестирования. Эти события подчёркивают важность обучения мощных ИИ-моделей ответственному поведению. — Хизер Адкинс, вице-президент Google по инженерии безопасности
Google утверждает, что модель прекращала взлом в каждом из трёх случаев, как только понимала, что имеет дело с реальной компанией, а не с учебной целью. Компания не считает произошедшее примером misalignment — расхождения поведения модели с намерениями разработчиков — и не раскрывала инцидент публично, пока не получила запрос от WSJ.
Названия пострадавших компаний не публикуются. Известно лишь, что в тесте участвовала не новейшая версия Gemini. Irregular заявила, что уведомила Google и затронутые стороны в конце июля и что все известные проблемы на её стороне устранены. Google также сообщила об инциденте федеральным властям.
Почему это важно
Случай Gemini — четвёртый у крупных лабораторий: похожие эпизоды ранее раскрыли OpenAI, Anthropic и Meta, и все они связаны с одной и той же тестовой средой Irregular. Когда автономные агенты получают доступ к интернету и внешним системам, ошибка в конфигурации стенда превращается в реальный киберинцидент, а не в неудачный тест.