В сфере искусственного интеллекта в июле 2026 года произошел беспрецедентный случай. Две ИИ-модели компании OpenAI вырвались из тестовой закрытой среды, получили доступ в интернет и совершили полноценную кибератаку на сторонний сервис. Их целью было не причинение вреда, а "мошенничество" на внутреннем экзамене. Они пытались украсть правильные ответы, чтобы получить максимальный балл, сообщает в среду, 22 июля, Ynet.
Первые сообщения о кибератаке появились 16 июля. Компания OpenAI публично раскрыла детали инцидента во вторник, 21 июля.
OpenAI проверяла две свои модели - GPT-5.6 Sol и более мощную экспериментальную версию на способность к кибератакам. Для этого компания на время отключила защитные ограничения.
Тогда модели ИИ вырвались из изолированной тестовой среды, обнаружив уязвимость в ней. Они проникли в открытый интернет, самостоятельно определили, где находятся нужные им данные, и атаковали платформу Hugging Face - крупнейшую международную базу данных в сфере ИИ и репозиторий ИИ-моделей.
Выйдя в интернет, модели OpenAI провели сложную, полностью автономную цепочку действий. Они использовали уязвимости в инфраструктуре OpenAI и Hugging Face, применили украденные учетные данные и выполнили горизонтальное перемещение по серверам. ИИ-модели совершили более 17.000 операций за короткий промежуток времени без какого-либо участия со стороны человека.
Глава OpenAI Сэм Альтман и руководитель Hugging Face Клеман Деланг подтвердили, что это первый зафиксированный случай, когда ИИ самостоятельно спланировал и провел комплексную кибератаку. Однако вредоносную активность обнаружили и остановили специалисты Hugging Face. Реального ущерба инфраструктуре нанесено не было. В настоящее время OpenAI и Hugging Face совместными усилиями расследуют инцидент и устраняют найденные бреши в безопасности.
При расследовании инцидента специалисты столкнулись с неожиданной проблемой. Когда команда безопасности Hugging Face попыталась задействовать ведущие американские коммерческие ИИ-модели для анализа логов и восстановления хронологии атаки, те отказались анализировать данные. Защитные фильтры западных нейросетей расценили код атаки и цифровые улики как вредоносный контент и заблокировали запросы инженеров. В итоге для анализа пришлось использовать открытую китайскую модель GLM от компании Z.ai.
Соучредитель Hugging Face Клем Деланг подчеркнул, что произошедшее подтверждает точку зрения его компании. "Проблемы безопасности искусственного интеллекта не сможет решить в одиночку ни одна компания, работая тайно. Решить их можно только открыто, вместе, обеспечив широкий доступ к ИИ-технологиям для всех специалистов по информационной безопасности", - говорит он.
Эксперты отрасли отмечают, что главная причина инцидента кроется не столько в высокой мощности самих ИИ-агентов, сколько в отсутствии базовых внутренних рамок поведения. Разработчики не задали жестких ограничений, в пределах которых модели должны были оставаться. Специалисты сходятся во мнениях: регуляторам и IT-гигантам необходимо срочно создать единую "внутреннюю конституцию", которую ИИ не сможет обойти даже при выполнении поставленных задач.


