Тестовый ИИ Anthropic проник в реальные системы трех компаний
Модели Claude смогли выйти в интернет и получить несанкционированный доступ.
Несколько моделей искусственного интеллекта Claude во время проверок по кибербезопасности смогли проникнуть в реальные системы трех организаций. Об этом сообщила компания Anthropic, которая занимается разработкой чат-бота.
Специалисты компании обнаружили три случая, когда модели Claude выходили в интернет из тестовой среды и получали доступ к сторонним системам. При этом Anthropic не раскрыла названия организаций, которые столкнулись с подобными инцидентами.
По данным разработчика, нарушения произошли с участием трех разных моделей — Opus 4.7, Mythos 5 и внутренней тестовой версии. Самый ранний случай зафиксировали еще в апреле.
В Anthropic уточнили, что выявить проблему удалось после расследования, начатого вслед за сообщением OpenAI о поведении собственных ИИ-моделей. Тогда разработчик ChatGPT сообщил, что его ИИ-агенты во время испытаний смогли покинуть изолированную среду и попытались искать ответы на задания во внешних базах данных.
Подобные случаи стали одним из главных вопросов при разработке новых ИИ-систем. Компании пытаются усилить защиту тестовых сред, поскольку современные модели получают все больше возможностей для самостоятельного выполнения задач и взаимодействия с внешними ресурсами.