ИИ Gemini начал взламывать реальные системы во время тестирования

В одном случае нейросеть не просто нашел чужую систему в интернете, а начал перебирать пароли, пока не получил к ней доступ.
Иллюстрация: ChatGPT

Во время проверки безопасности ИИ-модели Gemini, которую проводила независимая компания Irregular, модель в мае получила доступ к компьютерным системам трех реальных организаций. Irregular сообщил Google об инцидентах в конце июля, однако публично о них стало известно только 18 сентября после запроса журналистов Wall Street Journal. Названия организаций не раскрываются.

ИИ вышел за пределы тестовой среды

Gemini участвовал в стандартной проверке, которую проводила независимая компания Irregular. Модель должна была искать информацию внутри специально созданной тестовой среды и работать с программным обеспечением вымышленной компании.

Проблема возникла из-за того, что Gemini получил доступ к интернету, хотя в рамках задания этого не предусматривалось. Кроме того, название вымышленной компании совпало с названием реально существующего бизнеса.

Модель нашла в интернете сведения, которые посчитала частью задания, и попыталась получить доступ к соответствующим системам.

«Во время стандартного тестирования модель нашла общедоступную информацию в интернете и угадала учетные данные, чтобы получить доступ к сайтам, которые, как она считала, были частью теста», — рассказала вице-президент Google по безопасности Хизер Адкинс.

В одном случае Gemini подбирал пароли

Всего зафиксировали три подобных эпизода. В одном из них Gemini перебирал разные комбинации паролей, пока не получил доступ к защищенной системе.

В двух других случаях модель обнаружила учетные данные в открытом репозитории. Такие репозитории используются для хранения и публикации программного кода и других файлов. Найденных данных оказалось достаточно для доступа к закрытым системам.

При этом Gemini во всех трех случаях самостоятельно прекратил действия, когда понял, что работает уже с реальными компаниями, а не с объектами теста.

«Во всех трех случаях модель остановилась. Мы убедились, что три организации были уведомлены, и вместе с нашим партнером по обучению внесли изменения в процедуры тестирования», — заявила Адкинс.

Google подчеркнула, что пострадавшим компаниям вред причинен не был. После обнаружения инцидентов началось расследование.

Проблема оказалась не только у Google

Случай с Gemini стал очередным примером того, как ИИ-модели могут выходить за рамки сценария, заданного разработчиками. Ранее похожие инциденты происходили во время тестов моделей OpenAI, Anthropic.

В случае Gemini причиной стала не попытка намеренно атаковать реальные компании, а сочетание нескольких факторов. Модель получила незапланированный доступ к интернету, столкнулась с названием реальной организации и стала действовать так, будто продолжает выполнять поставленную задачу.

Компания Irregular сообщила, что связанные с тестированием проблемы были устранены. Все заинтересованные разработчики ИИ также получили информацию об инциденте.

Подписывайтесь и читайте «Науку» в MAX