Модели искусственного интеллекта, стоявшие за атакой на инфраструктуру американской компании Hugging Face (признан в РФ иностранным агентом) Inc., начали общаться между собой через доски объявлений и спланировали побег. Об этом сообщает Bloomberg.
Отмечается, что экспериментальные ИИ-агенты в течение нескольких месяцев тайно переписывались во внутренней сети компании.
Столкнувшись с нерешаемыми задачами в изолированной тестовой среде, модели решили вместе покинуть интернет. Агенты выявили уязвимость, которая позволила им обойти ограничения, атаковать внутренние системы OpenAI и совершить взлом Hugging Face.
Случай выявил склонность передовых систем к хитрости, обходу правил и поиску лазеек под давлением алгоритмов обучения, отметили в компании.
В июле агентство Reuters писало, что OpenAI потребовалось почти неделя, чтобы установить связь между внутренним тестированием ИИ-агента и инцидентом, затронувшим инфраструктуру платформы Hugging Face. Первые признаки выхода экспериментального ИИ-агента за пределы тестовой среды были зафиксированы 9 июля. 16 июля Hugging Face заявила об атаке со стороны «автономной ИИ-системы», а также уведомила о произошедшем ФБР. OpenAI охарактеризовала произошедшее как беспрецедентный случай для отрасли.
Ранее сообщалось, что ИИ-модели притворялись людьми и убеждали помочь взлому.