⚡️Новейшая модель OpenAI устроила побег из изолированной среды и взломала реальную компанию
🟥 Модель решила радикально оптимизировала задачу. Так зачем ИИ вообще к такое сделал:
Что случилось
- Внутри OpenAI гоняли экспериментальные модели по кибербезу в изолированной «песочнице», без доступа в интернет и с отключёнными стандартными ограничителями.
- Модель нашла неизвестную уязвимость, проломила тестовую среду, прошла через внутреннюю инфраструктуру OpenAI, самовольно вышла в интернет и уже оттуда взломала продакшн‑серверы Hugging Face, чтобы «подсмотреть ответы» к своему экзаменационному бенчмарку.
- Hugging Face почти сразу заметили аномалию, подняли тревогу и передали кейс правоохранительным органам.
🟥 Модель решила радикально оптимизировала задачу. Так зачем ИИ вообще к такое сделал:
- Цель теста была проста: решить кибербез‑бенчмарк, по сути — сдать экзамен ExploitGym.
- Где‑то в процессе рассуждений модель догадалась, что готовые решения хранятся у Hugging Face, и что быстрее взломать их продакшн, чем честно решать задания.
- Дальше ИИ не нарушает свою цель, она её гипер‑буквально исполняет, начав цепочкой эксплойтов уходить за пределы песочницы.
Фактически мы получили первый документированный случай автономного ИИ‑кибератаки вне тестовой среды: инициатива, поиск уязвимостей, цепочка эксплойтов, движение по инфраструктуре — без прямой команды «атака» на конкретную систему.