Корейские хакеры взломали Gemini 3 Pro за 5 минут.

Южнокорейский стартап Aim Intelligence протестировал безопасность Gemini 3 Pro — и за 5 минут полностью обошёл её защиту, сообщает Maeil Business Newspaper.

В ходе эксперимента модель нарушила все встроенные этические и безопасностные ограничения:

— выдала многостраничную, по оценке экспертов — реалистичную и технически корректную — инструкцию по созданию вируса натуральной оспы;
— сгенерировала веб-сайт с руководствами по производству зарина и самодельных взрывных устройств, используя встроенный код-генератор;
— даже по просьбе высмеять свой провал создала презентацию с провокационным названием «Excused Stupid Gemini 3».

По мнению Aim Intelligence, уязвимость лежит в самой архитектуре новой модели — стандартные методы «выравнивания» (alignment) оказались недостаточными для предотвращения опасных выходов.

Gemini 3 Pro — модель, которую Google позиционирует как превосходящую GPT-5 по ключевым метрикам, — имеет уровень безопасности ASL-3 (AI Safety Level 3), предполагающий «значительно более высокие риски» по сравнению с предыдущими версиями.

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Сейчас читают