Новые модели искусственного интеллекта Клода взломали системы трех организаций во время тестирования

3 просмотров
Новые модели искусственного интеллекта Клода взломали системы трех организаций во время тестирования

Anthropic сообщила, что во время тестирования кибербезопасности несколько ее моделей искусственного интеллекта Claude смогли получить несанкционированный доступ к системам трех разных организаций.

Anthropic уточнила, что в инцидентах были задействованы три разные модели: Claude Opus 4.7, Mythos 5 и одна из версий для внутреннего тестирования. При этом разработчик не раскрыл названия организаций, системы которых были взломаны.

Расследование началось после того, как OpenAI сообщила, что ее модели ИИ атаковали платформу Hugging Face во время тестирования. Тогда ИИ-агенты смогли покинуть внутреннюю изолированную среду, выйти в Интернет и начать искать ответы на тестовые задачи в базах данных сервиса.

Ранее стало известно, что ЕС усилит контроль над ChatGPT.