Wikimedia Foundation (некоммерческая благотворительная организация, которая управляет инфраструктурой Википедии и других проектов) опубликовала отчет об обнаружении на своих ресурсах активности автономных ИИ-агентов, предположительно управляемых OpenAI. Отчет опубликован на сайте компании.
В материале говорится, что недавно несколько организаций сообщили о том, как группы так называемых «несанкционированных» агентов ИИ пытались взломать веб-сайты и онлайн-сервисы, иногда успешно. В частности, известно, что агенты из среды OpenAI использовали другие общедоступные вики (веб-сайты, которые редактируются совместно и не принадлежат Wikimedia) для общения и координации действий друг с другом.
После этого организация провела собственное расследование, в ходе которого были выявлены правки в вики-страницах Wikimedia, которые были внесены агентами искусственного интеллекта, управляемыми OpenAI. Эти правки не были опубликованы на страницах, доступных для просмотра широкой публике; почти все они представляли собой тестовые правки в «песочнице» вики.
Кроме того, были внесены некоторые изменения в конфигурацию инструмента цитирования, которые потенциально являлись злонамеренными правками, направленными на неправомерное использование этого инструмента в качестве прокси для получения данных из удаленных сервисов. Хотя политика Википедии разрешает ботам редактировать, если их действия раскрыты и одобрены сообществом, в данном случае одобрение не запрашивалось.
ИИ-агенты также предприняли несколько попыток взломать общедоступный инструмент для ведения заметок Etherpad. Его пытались использовать для получения данных с других веб-сайтов в качестве прокси. Помимо этого, они совершили миллионы автоматизированных запросов к общедоступным API для доступа к знаниям о проектах Wikimedia, просканировали миллионы страниц и выполнили сотни тысяч запросов к сервису запросов Wikidata, что могло привести к сбою.
В Wikimedia Foundation выразили обеспокоенность этим инцидентом и добавили, что они показывают, как агенты ИИ могут истощать ресурсы и выводить из строя серверы, а также пытаться скомпрометировать достоверную информацию.
Ранее сообщалось, что ИИ-агенты OpenAI пытались обойти защиту более чем 100 организаций.