Google подтверждает, что в мае 2026 года модели Gemini взломали три компании.
Сторонняя компания, специализирующаяся на кибербезопасности, по ошибке предоставила экспериментальным моделям Gemini доступ к Интернету.
В последнее время компании, занимающиеся разработкой ИИ, всё чаще заявляют о том, что их новейшие и наиболее эффективные модели участвовали в несанкционированных взломах в реальных условиях. Google, который в последние месяцы не спешил с выпуском передовых моделей Gemini, до сих пор оставался в стороне от обсуждения «несанкционированного ИИ». После публикации в Wall Street Journal Google подтвердил, что модели Gemini взломали три компании во время тестирования в мае 2026 года, но характер вторжения не столь тревожен (или впечатляет), как предыдущие взломы ИИ.
Взлом произошёл во время тестирования, проведённого компанией Irregular, специализирующейся на кибербезопасности. Группа моделей Gemini участвовала в упражнении «захват флага», призванном проверить возможности ИИ в области кибербезопасности в закрытой среде. ИИ было поручено получить информацию от вымышленной компании (имеющей то же название, что и реальная компания) в этой среде. Компания Irregular не должна была позволять модели работать за пределами своих серверов, но из-за ошибки в конфигурации Gemini удалось получить доступ к Интернету.
Когда Gemini начала шпионить за интернетом, она нацелилась на реальную инфраструктуру, а не на подделки. В одном из трех случаев Gemini просто угадывала пароли, пока не получила доступ к онлайн-сервисам компании. В двух других случаях Gemini искала в общедоступных репозиториях программного обеспечения учетные данные для входа в системы компаний, которые были случайно включены в них.
Как сообщается, во всех трёх тестовых запусках модели Google останавливались, обнаружив, что получили доступ к серверам реальной компании. В этот момент Irregular изменила свою конфигурацию, чтобы предотвратить доступ ИИ к Интернету. По всей видимости, Irregular изначально не сочла это событие достойным дальнейшего расследования — она даже не сообщила Google о взломах до июля, после новостей о других инцидентах со взломом ИИ. Узнав о случившемся, Google уведомила компании, чтобы они (надеемся) могли улучшить безопасность своих паролей.
Решение Google не разглашать информацию о взломах связано с поведением моделей после использования незаконно полученных паролей. Поскольку модели поняли, что системы реальны, и остановились, компания не сочла это настоящим примером несоответствия моделей.
В своем заявлении вице-президент Google по разработке систем безопасности Хизер Адкинс преуменьшила серьезность инцидента. «Этот случай подчеркивает важность обучения мощных моделей ИИ ответственному поведению. В данном случае модель действовала надлежащим образом», — сказала она.
Это сильно отличается от таких взломов, как инцидент с OpenAI-Hugging Face , который представлял собой явное несоответствие модели. Когда модели OpenAI выходили из-под контроля, они делали это, используя программные уязвимости с явной целью получения доступа к информации, недоступной в их тестовой среде, — всё это ради успешного прохождения теста и получения более высоких «наград». Однако можно утверждать, что система OpenAI, по сути, поощряла такое поведение.
Искусственный интеллект Google не совершил ничего настолько злонамеренного — кто-то просто оставил дверь открытой, и ИИ выбрался наружу. Gemini получил доступ к огромному объему информации в интернете и использовал ее для входа в системы, к которым у него не было разрешения. Угадывание паролей — это не совсем поведение, способное привести к апокалипсису, но, вероятно, Google следовало бы сообщить об этом, когда стало известно о случившемся.