Google підтвердила, що у травні 2026 року Gemini вийшов за межі встановлених обмежень під час тесту з кібербезпеки й зламав три реальні компанії. Інцидент стався в рамках тестування, яке проводила AI-компанія Irregular. Про це повідомляє 9to5Google.
Згідно з матеріалами The Wall Street Journal, під час тестування Irregular випадково залишила відкритим доступ Gemini до інтернету. Модель скористалася цим: в одному випадку вона перебирала паролі до отримання доступу до системи, ще у двох – використала облікові дані, знайдені у відкритому репозиторії.
Google не розкривала ці інциденти, доки журналісти WSJ самі не вийшли на компанію. Свою позицію Google пояснила так: шкоди завдано не було, а модель зупинила шкідливу активність, щойно зрозуміла, що зламала реальну компанію, а не симульовану. Назви постраждалих компаній компанія не розголошує, однак запевняє, що всі три були повідомлені. Про інцидент також сповістили федеральні органи влади США.
У своїй заяві Гезер Адкінс (Heather Adkins), віцепрезидент Google з інженерії безпеки, зазначила: «Ця подія підкреслює важливість навчання потужних AI-моделей відповідальній поведінці. У цьому випадку модель діяла належним чином». У коментарі для The Verge Адкінс додала, що команда безпеки Google вже повідомила всі три організації, а партнер із навчання моделей оновив процедури тестування.
Google не вважає цей випадок проявом «розузгодження» моделі (model misalignment) – компанія стверджує, що саме механізми безпеки допомогли Gemini вчасно зупинитися. Це відрізняє ситуацію від попередніх інцидентів із моделями OpenAI та Anthropic: там моделі або не розуміли, що діють у реальному середовищі, або продовжували злам попри це.
Варто зазначити, що Irregular – та сама компанія, яка раніше брала участь у схожих тестах, про інциденти в яких вже оголошували OpenAI, Meta та Anthropic. Яку саме версію Gemini використовували під час тесту, не уточнюється, проте травень 2026 року вказує на те, що це точно не найновіші моделі.