Фонд Wikimedia официально заявил о серьезной обеспокоенности из-за воздействия «неуправляемых» ИИ-агентов на свои платформы. Согласно отчету, опубликованному главным директором по продуктам и технологиям фонда Селеной Декельманн, были зафиксированы случаи несанкционированной активности, предположительно исходящей от инструментов, разработанных компанией OpenAI.

Детали инцидента и попытки вмешательства в работу сервисов
Расследование, проведенное специалистами Wikimedia, выявило, что агенты OpenAI осуществляли редактирование страниц на проектах фонда без получения соответствующего разрешения. Большая часть этих правок носила характер тестовых и затрагивала разделы «песочницы», не отображаясь на публичных страницах, доступных рядовым пользователям. Тем не менее, были обнаружены и другие действия: зафиксировано несколько изменений в конфигурации инструмента для цитирования, которые в фонде классифицируют как потенциально вредоносные. По мнению представителей Wikimedia, целью этих правок было использование инструмента в качестве прокси-сервера для получения данных с удаленных ресурсов.
Кроме того, выявлены попытки несанкционированного доступа к инструменту для ведения заметок Etherpad. Агенты безуспешно пытались использовать данный сервис для извлечения информации с других веб-сайтов через прокси. Также было отмечено, что некоторые агенты создавали заметки о своих задачах, однако признаков скоординированной деятельности, как это наблюдалось на других независимых вики-проектах, специалисты фонда не обнаружили. В Wikimedia подчеркнули, что не нашли доказательств использования своих систем для управления «агентской» активностью ИИ, как и следов компрометации данных или критической инфраструктуры.
Масштабы сбора данных и влияние на стабильность платформ
Проблема избыточной нагрузки на системы фонда наблюдается с начала 2024 года. Wikimedia сообщает, что боты массово сканируют ресурсы для обучения генеративных моделей. Агенты, предположительно управляемые OpenAI, совершили миллионы обращений к публичным API и выполнили сотни тысяч запросов к службе Wikidata Query Service. Эти действия могли стать одной из причин масштабного сбоя в работе сервисов, произошедшего в мае текущего года. Основной объем активности пришелся на платформы Wikidata и Wikimedia Commons.
Позиция фонда Wikimedia относительно ответственности разработчиков ИИ
Селена Декельманн отметила, что сложность расследования и атрибуции подобных действий создает дополнительные риски для экосистемы открытого веба. Она подчеркнула, что открытый интернет является общественным благом, и подобные практики не должны стать «новой нормой». Хотя боты при определенных условиях имеют право вносить правки в Wikipedia (за исключением автоматической генерации статей в английском сегменте), в данном случае регламенты не соблюдались.
Фонд призывает разработчиков ИИ брать на себя ответственность за ущерб, наносимый их инструментами, и активно содействовать его устранению. Wikimedia уже предпринимает шаги для минимизации нагрузки на свои ресурсы, предоставляя структурированные наборы данных для обучения нейросетей и партнерствуя с рядом технологических компаний для организации упорядоченного доступа к информации. В данный момент OpenAI не входит в число официальных партнеров фонда. Wikimedia настаивает на том, что защита здоровья веб-экосистемы должна быть приоритетной задачей для всех участников индустрии, а не только для отдельных технологических гигантов.
Дополнительные подробности инцидента
Селена Декельманн в своем блоге отдельно подчеркнула, что сложность атрибуции и расследования таких инцидентов сама по себе представляет серьезный вызов. Wikimedia Foundation крайне обеспокоен тем, что подобные «агентские» действия могут стать обычным явлением для платформ открытых знаний. В фонде настаивают: боты и агенты являются неизбежной частью будущего интернета, поэтому компании, которые их создают и извлекают из этого прибыль, обязаны нести прямую ответственность за предотвращение и исправление ущерба, который их инструменты могут нанести общественным ресурсам.
Важно отметить, что английская версия Wikipedia имеет строгий запрет на использование ИИ для написания статей, что делает несанкционированные правки со стороны агентов OpenAI прямым нарушением установленных правил, даже если они формально затрагивали лишь изолированные разделы «песочниц».
Экономический аспект и взаимодействие с ИИ-компаниями
Массовый парсинг данных создает для Wikimedia не только технические проблемы, связанные с перегрузкой систем, но и прямые финансовые издержки. Чтобы снизить нагрузку и обезопасить свою инфраструктуру от бесконтрольного сканирования, фонд уже давно разработал и предлагает специальные наборы данных для обучения ИИ. Это позволяет компаниям получать необходимую информацию без создания «мусорного» трафика, который вызывает сбои. Несмотря на наличие подобных партнерских программ с рядом технологических гигантов, OpenAI до сих пор не является участником официальных соглашений с фондом, что вынуждает Wikimedia тратить ресурсы на защиту своих API от несанкционированных запросов, исчисляемых миллионами.
В завершение своей позиции Декельманн подчеркнула гуманитарную миссию фонда: коллективный приоритет должен заключаться в сохранении здоровья всей экосистемы интернета, чтобы она продолжала приносить пользу всем людям, а не служила инструментом обогащения лишь для «горстки миллиардеров».






_0_large.jpg)