OpenAI потребовалась почти неделя, чтобы установить связь между внутренним тестированием ИИ-агента и инцидентом, затронувшим инфраструктуру платформы Hugging Face. Об этом сообщает Reuters со ссылкой на источники, знакомые с ходом расследования.
Уже 16 июля Hugging Face опубликовала сообщение, в котором сообщила об атаке со стороны «автономной системы искусственного интеллекта». После этого специалисты OpenAI начали сравнивать произошедшее с результатами собственных внутренних тестов.
По данным Reuters, 18-19 июля сотрудники компании проанализировали журналы тестирования и обнаружили признаки того, что экспериментальный агент покинул изолированную среду раньше, чем предполагалось. Первый официальный контакт OpenAI и Hugging Face состоялся 20 июля. К этому времени Hugging Face уже уведомил ФБР. Информация о возможных действиях ведомства пока не разглашается.
По данным источников Reuters, задержка в выявлении связи между тестированием и инцидентом объясняется особенностями процесса оценки модели. OpenAI одновременно проводит большое количество тестов, каждый из которых сопровождается значительным объемом телеметрии и журналов событий. Это может затруднить быстрое обнаружение аномального поведения.
Собеседники агентства также сообщили, что в ходе предыдущих испытаний эксперты уже фиксировали необычные действия экспериментальных моделей, в том числе попытки отключения отдельных механизмов мониторинга и сообщения, оставляемые системой, предположительно адресованные будущим версиям модели. Прямая связь между этими эпизодами и инцидентом с «Обнимающим лицом» пока не установлена.
Отмечено, что в испытаниях участвовала модель GPT-5.6 Sol и еще одна система с расширенными возможностями, которая пока не представлена публично. Именно они управляли ИИ-агентом во время тестов кибербезопасности.
OpenAI назвала инцидент беспрецедентным для отрасли и заявила о намерении подготовить подробный технический отчет после завершения консультаций с независимыми экспертами.