«Википедия» намерена добиться справедливой компенсации, чтобы покрыть затраты на серверы, связанные с парсингом открытой базы знаний ИИ-компаниями. Об этом заявил соучредитель онлайн-энциклопедии Джимми Уэйлс. Модели ИИ продолжают обучаться на данных некоммерческой организации, и «Википедия» может начать применять технические средства для ограничения парсинга ИИ, сказал он в интервью на саммите Reuters NEXT в Нью-Йорке.
«Википедия» сотрудничает с крупными технологическими корпорациями, заключая соглашения, подобные сделке с Google, поделился соучредитель онлайн-энциклопедии Джимми Уэйлс в интервью на саммите Reuters NEXT в Нью-Йорке. Он отметил, что использование ИИ-компаниями общедоступных знаний для обучения своих языковых моделей (LLM) приводит к возрастанию расходов, которые несет некоммерческий оператор «Википедии».
«Боты с искусственным интеллектом, сканирующие «Википедию», обходят весь сайт… Поэтому нам требуется больше серверов, больше оперативной памяти и хранилища для кэширования, а это стоит нам непропорционально много», — добавил Уэйлс. Он напомнил, что контент «Википедии» остается бесплатным для частных лиц согласно лицензии, но автоматизированный доступ к нему в больших объемах со стороны коммерческих организаций — это совершенно другое дело. Сооснователь онлайн-энциклопедии подчеркнул, что уже достигнута договоренность с материнской компанией Google — Alphabet, а переговоры с другими IT-компаниями продолжаются.
Фонд «Викимедиа», управляющий «Википедией», в 2022 году подписал соглашение с Google, по которому технологический гигант будет оплачивать доступ к образовательным материалам. Эти материалы являются важной частью данных, которые такие компании, как OpenAI и Meta Platforms (признана в России экстремистской и запрещена) используют для обучения своих искусственных интеллектов. По словам Уэйлса, основным источником дохода фонда являются небольшие пожертвования от частных лиц — они не предназначены для финансирования разработки многомиллиардных коммерческих продуктов на основе ИИ.
«Википедия» поддерживается волонтерами. Эти люди жертвуют деньги на ее поддержку, а не на субсидирование OpenAI, что обходится нам в значительные суммы. Это несправедливо», — отметил Уэйлс.
На вопрос о том, будет ли «Википедия» подавать иски против компаний, занимающихся ИИ и использующих ее контент без оплаты доступа к обучению, Уэйлс ответил: «Я не знаю. Мне кажется, что наша способность стыдить их с помощью «мягкой силы» довольно эффективна».
Уэйлс добавил, что «Википедия» могла бы также рассмотреть использование технических средств, таких как AI Crawl Control от Cloudflare, которые позволяют клиентам ограничивать доступ к своему контенту для ботов с ИИ, собирающих информацию в интернете. Он признал, что это может стать проблемой, учитывая идеологическую приверженность «Википедии» открытому доступу к знаниям, но подчеркнул, что необходимо решить вопрос с растущими финансовыми нагрузками.
Фонд опирается на глобальное сообщество редакторов-волонтеров и пожертвования пользователей, чтобы предоставлять информацию бесплатно. Однако платформа постоянно сталкивается с трудностями при сохранении нейтральной позиции, особенно в спорных политических и социальных темах. Уэйлс отметил, что сохранять спокойствие и нейтралитет во время крупных глобальных конфликтов непросто, но сообщество «в целом неплохо справляется с этой задачей, даже в таких условиях».
Фото: hi-tech.mail.ru

