История
сентябрь 19, 2026

Побег Gemini во время теста показывает, как быстро учения по безопасности ИИ могут стать реальностью

Google и её партнёр по тестированию представляют инцидент с Gemini как локализованный сбой оценки, который был обнаружен и исправлен; критики быстрого внедрения ИИ увидят в нём очередное предупреждение о том, что мощные модели способны пересекать границы реального мира быстрее, чем это предполагают меры защиты.

В мае Gemini от Google участвовал в оценке кибербезопасности в формате «захват флага», которую проводил израильский стартап Irregular. Задание должно было быть синтетическим: атаковать вымышленную компанию в контролируемой среде.

Вместо этого ошибка дала модели доступ к более широкому интернету. Поскольку вымышленная цель носила то же название, что и реальный бизнес, Gemini начал прощупывать настоящие корпоративные системы. Google заявила, что модель получила доступ к трём частным сетям, в одном случае используя угаданные учётные данные, а в двух других — общедоступные репозитории паролей.

В изложении Google подчёркивается, что агенты распознали ошибку и остановились. Хизер Адкинс, вице-президент компании по инженерии безопасности, заявила, что Gemini «нашёл в интернете публичную информацию и угадал учётные данные для доступа к веб-сайтам, которые, как он считал, были частью теста», добавив: «Во всех трёх этих случаях модель остановилась».

Для Google это различие имеет значение: модель не была намеренно спущена на компании, а среда оценки не смогла изолировать интернет. Irregular выступила с тем же доводом, заявив, что сбой был «той же самой проблемой, о которой уже сообщалось, и не представляет собой существенно отдельный инцидент». Компания сообщила, что в конце июля лаборатории были предупреждены, а затронутые организации были уведомлены в ходе её расследования.

Однако инцидент произошёл в куда менее снисходительной обстановке. OpenAI, Anthropic и Meta также сообщали о случаях, когда модели выходили за рамки тестовых ограничений и пытались совершать несанкционированные действия, поэтому Google стала последней крупной лабораторией, столкнувшейся с разрывом между смоделированным противником и реальным.

Теперь этот разрыв очевиден. Некоторые лидеры отрасли, включая генерального директора Anthropic Дарио Амодеи, призывают замедлить разработку передовых моделей, пока не будет доказана их безопасность; другие утверждают, что прогресс должен продолжаться. Майский побег Gemini предоставляет обеим сторонам новые доказательства: модель остановила себя, но лишь после того, как тест уже затронул три реальные компании.