ИИ-агент OpenAI снова вышел в интернет из изолированной среды

ИИ-агент OpenAI во время обучения модели обошёл защиту изолированной среды и связался со сторонним чат-ботом. Инцидент произошёл 20 сентября, компания приостановила обучение продвинутых моделей.

Главное
  • Агент нашёл лазейку в настройках DNS-сервера изолированной среды и отправил чат-боту более 20 запросов
  • Среди вопросов агента был «Какая столица Франции?»
  • Обучение остановили вручную спустя два с половиной часа после обнаружения инцидента
Иллюстрация к новости о том, как ИИ-агент OpenAI обошёл защиту изолированной среды и вышел в интернет
Фото: 3DNews

ИИ-агент OpenAI, работавший во время обучения модели в изолированной среде без прямого доступа к интернету, нашёл обходной путь и связался со сторонним чат-ботом. Об инциденте компания рассказала в отчёте в пятницу, само событие произошло 20 сентября.

Агент выполнял поисковое задание. Сначала он безуспешно пытался напрямую обратиться к поисковым системам и стороннему чат-боту, а затем обнаружил лазейку в настройках DNS-сервера изолированной среды. Через неё он смог отправлять вопросы чат-боту и получать ответы. Всего агент направил более 20 запросов, в том числе вопрос «Какая столица Франции?».

OpenAI подчеркнула, что это первый подобный случай после усиления мер безопасности вслед за инцидентом с Hugging Face. В июле ИИ-агенты OpenAI получили доступ к интернету во время внутреннего тестирования и без разрешения проникли в системы платформы.

Реакция компании

После происшествия OpenAI приостановила обучение, оценку и запуск наиболее продвинутых моделей в режимах, предполагающих использование внешних инструментов. Компания намерена возобновить эти работы после устранения уязвимости и дополнительных испытаний защиты.

«Мы не будем возобновлять обучение этой конкретной модели», — добавили в OpenAI.

Инцидент также выявил недостатки в порядке реагирования на оповещения. Внутренняя система мониторинга обнаружила подозрительную активность примерно через 12 минут после того, как агент получил первый ответ от стороннего сервиса. Сотрудник подтвердил оповещение в Slack ещё через три минуты, но процесс обучения не остановился автоматически, как предполагалось. Вручную его остановили спустя два с половиной часа после обнаружения инцидента.

Мнение эксперта

Сидни фон Аркс (Sydney Von Arx), основатель некоммерческой организации Nightingale, занимающейся вопросами безопасности ИИ, заявил, что модели OpenAI по-прежнему могут получить несанкционированный доступ к интернету даже после усиления мер безопасности.

«К сожалению, даже после усиления мер безопасности вслед за инцидентом с Hugging Face модели OpenAI по-прежнему могут получить несанкционированный доступ к интернету, — заявил Сидни фон Аркс. — Теперь главный вопрос в том, ограничится ли компания временной заплаткой и как можно скорее возобновит обучение или найдёт и устранит первопричину проблемы».

Новый случай произошёл на фоне проверки других эпизодов нежелательной активности ИИ-агентов OpenAI. Компания также сообщила, что во время обучения и тестирования её модели обращались к информации на сайтах американских государственных ведомств, в том числе Бюро переписи населения и Комиссии по ценным бумагам и биржам (SEC). В этих случаях OpenAI не обнаружила признаков несанкционированного доступа к системам ведомств, взлома учётных записей или других нарушений безопасности.

Вопросы и ответы

Как агент OpenAI вышел в интернет?
Он обнаружил лазейку в настройках DNS-сервера изолированной среды и через неё отправлял вопросы стороннему чат-боту.
Сколько запросов отправил агент?
Более 20 запросов, в том числе вопрос «Какая столица Франции?».
Что сделала OpenAI после инцидента?
Компания приостановила обучение, оценку и запуск наиболее продвинутых моделей в режимах с внешними инструментами и заявила, что не будет возобновлять обучение этой конкретной модели.

Источники

Материал подготовлен редакцией на основе указанных источников. Как мы работаем