Логотипы Wikimedia и OpenAI. Источник: Wikimedia Foundation / OpenAI
В Wikimedia заявили о несанкционированной активности агентов искусственного интеллекта, которые, вероятно, работают от имени OpenAI. Речь идет о редактировании некоторых вики, попытках использовать инструменты фонда в качестве посредника для получения данных с внешних сайтов, а также массовых запросах к публичным API.
Что известно
По данным Wikimedia, агенты, которых фонд связывает с OpenAI, вносили изменения в некоторые вики без необходимого разрешения. Почти все такие редактирования были тестовыми и не отображались на страницах, которые обычно видят пользователи.
В то же время, фонд обнаружил несколько изменений в конфигурации инструмента для работы с цитированием. В Wikimedia считают, что они могли иметь зловредный характер и быть направлены на использование инструмента как прокси для получения данных с удаленных сервисов.
Отдельно агенты, которых Wikimedia также связывает с OpenAI, пытались получать через сервис для совместных заметок Etherpad данные с других сайтов. Эти попытки были неудачными. Фонд также обнаружил признаки того, что некоторые агенты использовали заметки для фиксации информации о своих заданиях, однако доказательств координации между ними не нашли.
Расследование не выявило признаков компрометации систем или данных Wikimedia. Также фонд не нашел доказательств того, что его платформы использовались агентами для координации действий, как это происходило на некоторых других вики.
Миллионы запросов к Wikimedia
Wikimedia также сообщила, что с начала 2024 года ее платформы подверглись резкому росту автоматизированного трафика, значительную часть которого создают боты, собирающие данные для ИИ. Агенты уже просканировали миллионы страниц, преимущественно в Wikimedia Commons и Wikidata, а также осуществили сотни тысяч запросов к Wikidata Query Service.
В фонде предполагают, что такая активность могла способствовать сбою в работе сервиса, который произошел в мае.
Главная технологическая директорка Wikimedia Селена Декельманн заявила, что фонд "глубоко обеспокоен" влиянием неконтролируемых ИИ-агентов на открытые платформы. По ее словам, компании, которые создают и используют таких агентов, должны принимать непосредственное участие в предотвращении ущерба и устранении его последствий.
Wikimedia уже предлагает специальный набор данных для обучения ИИ, чтобы уменьшить необходимость массового сканирования ее платформ. Фонд также заключил партнерства с технологическими компаниями для организованного доступа к своим данным, но OpenAI среди них нет.
Источник: Wikimedia