GPT-5 взломали за сутки: новая нейросеть оказалась уязвимее предшественника

Исследователи обнаружили критические бреши в защите флагманской модели OpenAI — ИИ выдаёт запрещённые инструкции при хитро составленных запросах.

GPT-5 взломали за сутки: новая нейросеть оказалась уязвимее предшественника

Всего через сутки после релиза GPT-5 две независимые команды хакеров успешно обошли её защитные механизмы. NeuralTrust заставил нейросеть создать руководство по изготовлению зажигательной смеси, а SPLX выявил уязвимость к маскировке вредоносных запросов.

Исследователи использовали два хитрых метода:

  • EchoChamber + сторителлинг — постепенное подталкивание модели к нужному ответу через серию "безобидных" уточнений
  • StringJoin Obfuscation — вставка специальных символов, маскирующих опасные запросы

Парадоксально, но GPT-4o оказалась устойчивее к таким атакам. Проблема в том, что GPT-5 анализирует каждый запрос изолированно, не учитывая общий контекст диалога.

Эксперты предупреждают: использовать GPT-5 в корпоративной среде пока слишком рискованно. Особенно это касается сферы бизнес-согласования, где даже внутренние защитные механизмы OpenAI оставляют опасные пробелы. Пока разработчики не выпустят патчи, компаниям стоит дважды подумать перед интеграцией новой модели в свои процессы.

Читайте также

Китайский исследователь с помощью ChatGPT решил математическую задачу, над которой бились более 20 лет

Китайский исследователь с помощью ChatGPT решил математическую задачу, над которой бились более 20 лет

Мужчина спрятал инструкции для ИИ в судебных документах и получил запрет на электронную подачу

Мужчина спрятал инструкции для ИИ в судебных документах и получил запрет на электронную подачу

США и Япония хотят добывать редкоземельные металлы на глубине 6 км

США и Япония хотят добывать редкоземельные металлы на глубине 6 км

В России создали искусственное ухо с помощью гибридной 3D-биопечати

В России создали искусственное ухо с помощью гибридной 3D-биопечати

В Китае создали простую роборуку BioflexBot, которая оказалась гибче человеческой

В Китае создали простую роборуку BioflexBot, которая оказалась гибче человеческой

ИИ помог найти опасную уязвимость Zoom всего за 20 запросов

ИИ помог найти опасную уязвимость Zoom всего за 20 запросов

Цифровые двойники помогут наделить вагон-термос беспрецедентными свойствами

Цифровые двойники помогут наделить вагон-термос беспрецедентными свойствами

В МАИ научили дроны видеть препятствия и думать самостоятельно

В МАИ научили дроны видеть препятствия и думать самостоятельно

Робот МФТИ установил рекорд сборки головоломки «мегаминкс» за 9,6 секунды

Робот МФТИ установил рекорд сборки головоломки «мегаминкс» за 9,6 секунды

Медицинские технологии, в которые почти невозможно поверить

Медицинские технологии, в которые почти невозможно поверить

Квантовый двигатель нарушает законы термодинамики, генерируя работу и холод одновременно

Квантовый двигатель нарушает законы термодинамики, генерируя работу и холод одновременно

Как РЛС Вадима Мацкевича решила исход Корейской войны

Как РЛС Вадима Мацкевича решила исход Корейской войны

Падение ступени Falcon 9 на Луну подняло вопрос о космическом мусоре

Падение ступени Falcon 9 на Луну подняло вопрос о космическом мусоре

Спутник CosmoCube размером с чемодан заглянет в «темные века» Вселенной

Спутник CosmoCube размером с чемодан заглянет в «темные века» Вселенной

В России созданы планарные ионные ловушки для квантовых компьютеров

В России созданы планарные ионные ловушки для квантовых компьютеров

Рождение сверхпрочных материалов: как нанопокрытия обманывают физику разрушения

Рождение сверхпрочных материалов: как нанопокрытия обманывают физику разрушения