Экспериментальные модели искусственного интеллекта OpenAI, работавшие в закрытой тестовой среде, начали обмениваться сообщениями друг с другом и искать способ получить доступ к интернету. Об этом сотрудники компании рассказали на конференции Black Hat, пишет Bloomberg. По словам сотрудника OpenAI Эрика Уоллеса, «подготовка к побегу» началась еще в мае, когда ИИ-моделям дали задачи, которые невозможно было решить без доступа в интернет. «Мы застряли. Может быть, ответ в интернете?» — написал один из агентов. После этого ИИ-системы начали общаться через внутренние доски объявлений и обсуждать способы выхода из тестовой среды. Модели обнаружили первую уязвимость, которая позволила получить доступ в интернет, но OpenAI остановила эту попытку. Позже агенты нашли новый способ связи и другую уязвимость.

В июле 2026 года ИИ-агент получил доступ к интернету, атаковал инфраструктуру платформы Hugging Face и запустил собственный код на ее серверах. OpenAI узнала об инциденте после сообщения от Hugging Face. По данным Reuters, первые признаки выхода агента за пределы тестовой среды были зафиксированы 9 июля. 16 июля Hugging Face сообщила об атаке ИИ-системы и передала информацию ФБР. OpenAI потребовалось несколько дней, чтобы выявить причину инцидента. 29 июля Reuters сообщил о еще одном случае. ИИ-агент OpenAI получил доступ к инфраструктуре клиента компании Modal Labs. В начале августа OpenAI сообщила о новых инцидентах с ИИ-моделями и заявили, что усилили меры безопасности.