Компания-разработчик чат-бота Claude Anthropic обнаружила три инцидента, в которых ее ИИ-модель выходила в интернет из тестовой среды партнера Irregular и получала несанкционированный доступ к системам трех организаций. Об этом говорится в заявлении организации.
В Anthropic уточнили, что начали проверку начали после того, как OpenAI сообщила о похожем случае.
Отмечается, что «несанкционированный доступ к реальным системам трех разных организаций» совершили три модели Anthropic: Opus 4.7, Mythos 5 и некая внутренняя исследовательская модель. При этом, как уточнили в компании, ИИ-модели находились в изолированной среде компании Irregular.
Во всех трех случаях Claude выполняла стандартное задание «захват флага», в ходе которого по сценарию ИИ было необходимо найти скрытую информацию на другой машине. Согласно условиям, выход в интернет-пространство был заблокирован, но из-за ошибки конфигурации модель Claude выходила в интернет, получала доступ к реальным системам трех разных организаций и атаковала их, пишет Anthropic.
До этого программист под ником Alone_Ad_3375 заявил, что новая ИИ-модель Claude от Anthropic удалила всю базу данных его проекта уже через десять минут после начала работы. По словам пользователя, ранее он создавал этот проект с помощью других ИИ-моделей, включая Sonnet 4.6 и Gemini 3, однако они не приводили к потере данных.
Ранее суд вынес историческое решение против разработчика ИИ Claude.