Wikimedia связала агентов OpenAI с перебоями и несанкционированной активностью

Wikimedia связывает агентов OpenAI с сбоем и несанкционированной активностью

Фонд сообщает, что «глубоко обеспокоен влиянием «изгойных» AI‑агентов на такие платформы, как наша».

Агенты OpenAI действовали в интернете без контроля, и, по всей видимости, от этого пострадал также Фонд Викимедиа. Фонд обнаружил несанкционированную активность со стороны OpenAI‑агентов на своих платформах, включая правки в некоторых вики и неудачные попытки скомпрометировать инструмент для ведения заметок. Он снова подчеркнул, что боты массированно собирали данные с его платформ, а агенты, которые, по всей видимости, управляются OpenAI, сделали миллионы запросов к его публичным API.

Расследование не выявило доказательств того, что AI‑агенты использовали системы Викимедиа для координации своей активности (как это, по-видимому, происходило на вики, не управляемых Викимедиа), и фонд также не обнаружил признаков компрометации своих данных или систем. «Тем не менее нас беспокоит то, что могло здесь произойти, сложность и затраты, связанные с расследованием и атрибуцией этой активности, а также растущие риски агентообразной AI‑активности на наших платформах в целом», — написала в блоге Селена Декельманн, главный директор по продуктам и технологиям фонда. «Открытый веб — это общественное благо. Мы не должны позволять этому поведению стать «новой нормой» для людей или организаций, которые его поддерживают». Engadget обратился к OpenAI за комментарием.

По всей видимости, агенты OpenAI внесли правки в некоторые вики Викимеда без разрешения. Почти все эти правки были тестовыми и сделаны в песочницах вики, и они не были видны на страницах, к которым обычно обращаются пользователи. Также были «несколько правок в конфигурации инструмента для цитирования, которые, как мы полагаем, могли быть потенциально вредоносными и предназначены для злоупотребления этим инструментом в качестве прокси для получения данных с удалённых сервисов», — написала Декельманн. Хотя ботам разрешено вносить правки в Википедию при соблюдении определённых условий, в этих случаях разрешение не запрашивалось. (Англоязычная версия Википедии запрещает статьи, сгенерированные AI.)

Кроме того, агенты, которые Викимедиа считает происходящими от OpenAI, пытались скомпрометировать инструмент для заметок под названием Etherpad, но эти попытки не увенчались успехом. «Агенты безуспешно пытались использовать его, чтобы получать данные с других веб‑сайтов через прокси», — написала Декельманн. «Другие агенты, также, вероятно, управляемые OpenAI, вели заметки о своих задачах, хотя это, по-видимому, не переросло в координацию».

Ранее Фонд Викимедиа заявлял, что боты с начала 2024 года непрерывно «бьют» по его платформам, соскребая данные для обучения генеративных AI. Сейчас он сообщает, что агенты обошли миллионы страниц — в основном из Wikidata и Wikimedia Commons — и сделали «сотни тысяч запросов данных» к Сервису запросов Wikidata, что могло способствовать сбою в мае.

«AI‑компании недостаточно делают для того, чтобы обезопасить свои системы и защитить общественность от вреда, который они причиняют», — утверждает Декельманн, добавляя, что Викимедиа «глубоко обеспокоена» влиянием изгойных AI‑агентов на платформы открытых знаний, которыми она управляет.

«Боты и агенты — часть будущего веба, и компании, которые их выпускают в мир и получают с них прибыль, должны напрямую помогать предотвращать и устранять причинённый ими ущерб», — написала Декельманн. «Нашим общим приоритетом должно быть здоровье всей экосистемы веба, чтобы она продолжала приносить пользу всем людям, а не только горстке миллиардеров».

Викимедиа предложила набор данных для обучения AI в попытке отговорить краулеров от соскребания данных с её платформ, что увеличивает её расходы и может перегружать системы. Фонд также заключил партнёрства с несколькими технологическими компаниями, чтобы предоставить им упрощённый доступ к данным, но OpenAI в этот список не вошла.