ИИ-модели OpenAI сбежали из песочницы. OpenAI опубликовала подробный разбор недавнего инцидента с Hugging Face.
В июле 2026 года было обнаружено, что модели OpenAI в процессе обучения с подкреплением (Reinforcement Learning) смогли обойти меры контроля, предназначенные для их изоляции в том числе от сети Интернет. Говоря более привычным языком — они смогли выйти из «песочницы». При этом были скомпрометированы отдельные компоненты внутренней исследовательской инфраструктуры OpenAI и систем Hugging Face.
Главной движущей силой стала модель для внутреннего использования, сравнимая по масштабу с флагманской GPT-5.6 Sol. Модель, обозначенная в отчёте как IM1 (Internal Model 1), смогла инициировать обмен сообщениями между агентами через не предназначенный для этого сервис менеджера пакетов Artifactory. Используя SSRF, агенты заставили Artifactory — у которого был доступ к интернету исключительно для скачивания и установки пакетов — отправлять произвольные интернет-запросы от их имени. Обнаружив этот способ доступа в сеть, агенты поделились им с другими агентами через импровизированную доску сообщений Artifactory, благодаря чему те тоже смогли воспользоваться уязвимостью инфраструктуры.
Подробности инцидента — в оригинальном материале.
Есть мнение, что это пиар-акция OpenAI. Вероятно, так и есть. Но что мешает пиар-акции при этом быть правдой? Наш опыт показывает, что потенциал ИИ только начинает раскрываться: модели становятся мощнее и умнее от релиза к релизу, а агентский подход позволяет использовать их возможности максимально эффективно. ИИ в offensive security — уже де-факто стандт. И в защите, несмотря на известную консервативность отрасли, ИИ тоже занимает своё место — наш «Рекрипториум» тому пример.