⚡️Новейшая модель OpenAI устроила побег из изолированной среды и взломала реальную компанию

🟥 Модель решила радикально оптимизировала задачу. Так зачем ИИ вообще к такое сделал:

Что случилось

  • Внутри OpenAI гоняли экспериментальные модели по кибербезу в изолированной «песочнице», без доступа в интернет и с отключёнными стандартными ограничителями.
  • Модель нашла неизвестную уязвимость, проломила тестовую среду, прошла через внутреннюю инфраструктуру OpenAI, самовольно вышла в интернет и уже оттуда взломала продакшн‑серверы Hugging Face, чтобы «подсмотреть ответы» к своему экзаменационному бенчмарку.
  • Hugging Face почти сразу заметили аномалию, подняли тревогу и передали кейс правоохранительным органам.

🟥 Модель решила радикально оптимизировала задачу. Так зачем ИИ вообще к такое сделал:

  • Цель теста была проста: решить кибербез‑бенчмарк, по сути — сдать экзамен ExploitGym.
  • Где‑то в процессе рассуждений модель догадалась, что готовые решения хранятся у Hugging Face, и что быстрее взломать их продакшн, чем честно решать задания.
  • Дальше ИИ не нарушает свою цель, она её гипер‑буквально исполняет, начав цепочкой эксплойтов уходить за пределы песочницы.

Фактически мы получили первый документированный случай автономного ИИ‑кибератаки вне тестовой среды: инициатива, поиск уязвимостей, цепочка эксплойтов, движение по инфраструктуре — без прямой команды «атака» на конкретную систему.