'

Скандал в сообществе искусственного интеллекта: ИИ-агенту удалось совершить кибератаку

Один из главных вопросов заключается в том, осознавал ли основной ИИ-агент, что фактически осуществляет кибератаку

|
 ИИ
 ИИ
ИИ
(Фото: shutterstock)
Исследователи в области безопасности, эксперты по киберзащите и бывшие высокопоставленные сотрудники OpenAI требуют от компании раскрыть все подробности атаки, которую ее модели совершили против платформы Hugging Face. По их словам, опубликованная до сих пор информация остается неполной и не позволяет понять, каким образом системы искусственного интеллекта смогли покинуть изолированную тестовую среду.
Давление на OpenAI усиливается после необычного киберинцидента, в ходе которого ИИ-агенты компании сумели выйти за пределы внутренней среды тестирования и провести атаку на платформу Hugging Face.
Исследователи безопасности, специалисты по киберзащите и бывшие руководители OpenAI требуют опубликовать полный отчет о случившемся. Они предупреждают, что без подробной информации будет сложно извлечь уроки из одного из самых необычных инцидентов, когда-либо зафиксированных в сфере искусственного интеллекта.
После того как OpenAI признала, что за атакой стояли ее модели, компания опубликовала лишь общее описание последовательности событий. OpenAI подтвердила, что несколько моделей, включая GPT-5.6 Sol и экспериментальную систему, которая пока не была представлена широкой публике, совместно работали в рамках внутреннего теста. Моделям удалось выйти из среды, в которой они содержались, и начать кибератаку на Hugging Face.
Целью атаки, согласно опубликованным данным, была попытка получить информацию, которая могла помочь моделям успешно пройти испытание. Однако почти все ключевые вопросы о случившемся до сих пор остаются без ответа.
Среди критиков компании - Хелен Тонер, бывший член совета директоров OpenAI, которая сейчас возглавляет Центр безопасности и новых технологий CSET при Джорджтаунском университете.
По ее словам, OpenAI обязана опубликовать гораздо более подробную информацию о произошедшем.
"Мы должны изучить этот случай, а не просто двигаться дальше", - заявила она.
Тонер считает, что индустрии необходима более широкая прозрачность не только в отношении проверок безопасности перед выпуском новых продуктов, но и в вопросе того, как компании используют собственные модели искусственного интеллекта внутри организации.
К призывам присоединился и один из основателей OpenAI Джон Шульман. После ухода из компании он занял пост главного научного сотрудника стартапа Thinking Machines, основанного бывшим техническим директором OpenAI Мирой Мурати.
Шульман призвал опубликовать полную документацию об инциденте.
По его словам, один из главных вопросов заключается в том, осознавал ли основной ИИ-агент, что фактически осуществляет кибератаку. Не исключено, что между целями главной системы и действиями подчиненных ей вспомогательных агентов возникло расхождение.
"Как он объяснял самому себе такое поведение?" - задался вопросом Шульман.
OpenAI не спешит раскрывать детали. Компания пытается снизить напряженность, однако не предоставляет новой конкретной информации.
В своем последнем заявлении компания назвала произошедшее "значимым моментом для сферы безопасности искусственного интеллекта".
OpenAI сообщила, что проводит всестороннее расследование при участии внешних консультантов и под контролем корпоративного комитета по безопасности и защите.
"После завершения проверки будет опубликован технический отчет, в котором будут представлены выводы и заключения", - говорится в заявлении компании.
Президент OpenAI и один из ее основателей Грег Брокман также уклонился от подробных ответов во время недавней встречи с журналистами. По его словам, расследование продолжается, а компания пока пытается восстановить полную картину произошедшего.
"Это событие необходимо воспринимать крайне серьезно. Мы изучаем каждый этап нашего процесса, чтобы понять, как следует реагировать", - заявил Брокман.
►Даже дата атаки остается неизвестной
Несмотря на то что в последние дни скандал широко обсуждается в сообществе специалистов по искусственному интеллекту, большая часть обстоятельств инцидента по-прежнему неизвестна. Не установлено даже точное время проведения атаки.
Компания Hugging Face, ставшая целью взлома, сообщила в публикации от 16 июля, что подверглась атаке "в начале той же недели" со стороны автономного ИИ-агента. Однако точную дату компания не назвала.
OpenAI лишь спустя несколько дней подтвердила, что за инцидентом стояли именно ее модели.
Такая неопределенность вызывает раздражение среди экспертов по безопасности. Главный научный сотрудник Redwood Research Райан Гринблатт опубликовал обширный список вопросов, которые, по его мнению, до сих пор остаются без ответа.
В частности, неизвестно, координировали ли модели свои действия во время атаки, каким образом принимались решения в ходе операции и существовали ли ранние признаки опасного поведения, которые можно было обнаружить заранее.
Эксперты хотят знать, как модели вышли из тестовой среды. Компания по кибербезопасности Penligent также опубликовала собственный перечень вопросов к OpenAI.
Эксперты хотят выяснить, какие именно модели участвовали в атаке, какое задание они получили и каким образом им удалось выбраться из изолированной тестовой среды.
Кроме того, остается непонятным, почему в качестве цели была выбрана именно платформа Hugging Face, к каким системам смогли получить доступ модели, была ли раскрыта конфиденциальная информация и был ли нанесен ущерб цепочке поставок моделей с открытым исходным кодом.
По словам президента и руководителя направления искусственного интеллекта компании Replit Мишеля Катасты, ответы на эти вопросы имеют значение далеко за пределами данного конкретного случая.
"Вся индустрия должна подготовиться к тому, что подобные события будут происходить все чаще", - заявил он.
По его словам, то, что сегодня воспринимается как исключительный инцидент, в относительно недалеком будущем может превратиться в новую реальность.
Комментарии
Автор комментария принимает Условия конфиденциальности Вести и соглашается не публиковать комментарии, нарушающие Правила использования, в том числе подстрекательство, клевету и выходящее за рамки приемлемого в определении свободы слова.
""