Истцы утверждают, что компания на протяжении двух лет скрывала выборки из миллионов диалогов и сделала представленные суду данные непригодными для анализа
Искусственный интеллект011 июл 11:10
OpenAI столкнулась с угрозой судебных санкций в ходе продолжающегося разбирательства с The New York Times и несколькими другими американскими издательствами. Истцы подали в суд ходатайство, в котором утверждают, что компания в течение двух лет скрывала важные доказательства, удаляла часть журналов работы ChatGPT и вводила суд в заблуждение относительно своих технических возможностей по поиску данных.
Центральным вопросом спора остаются журналы диалогов ChatGPT. Издательства пытаются выяснить, насколько часто пользователи получали через чат-бота материалы, содержащие защищённые авторским правом статьи. Эти данные могут оказать существенное влияние на решение относительно того, подпадает ли использование материалов СМИ под принцип добросовестного использования (fair use) или нарушает авторские права.
По утверждениям истцов, во время повторного допроса инженера OpenAI по вопросам конфиденциальности Винсента Монако выяснилось, что компания уже до начала судебного процесса располагала двумя крупными анонимизированными выборками журналов объёмом около 10 млн и 78 млн диалогов. Более того, OpenAI уже проводила поиск по этим данным, анализируя случаи воспроизведения защищённого контента при создании системы, ограничивающей выдачу таких материалов.
Истцы утверждают, что существование этих выборок не было раскрыто суду почти два года. Вместо этого OpenAI настаивала на том, что поиск по подобным массивам данных технически крайне сложен, дорог и создает риски для конфиденциальности пользователей. По мнению издателей, именно эти утверждения затянули процесс сбора доказательств и значительно увеличили судебные расходы.
Дополнительные претензии касаются обработки уже переданных данных. Согласно утверждениям истцов, предоставленная выборка из 20 млн диалогов оказалась практически непригодной для анализа после того, как OpenAI выполнила около 19 млрд автоматических редактирований, сокрыв значительную часть информации. Также в ходатайстве указывается, что компания удалила часть данных из этой выборки и не выполнила в полном объёме предписание суда о сохранении журналов переписки, в результате чего были удалены или сжаты миллиарды записей.
OpenAI отвергает обвинения. Представитель компании заявил, что требования издателей представляют собой попытку получить доступ к переписке пользователей, не имеющей отношения к делу, а сами утверждения о сокрытии доказательств назвал ложными. В компании также подчеркнули, что недавний отказ истцов от части требований свидетельствует не о укреплении их позиции, а, наоборот, об ослаблении иска.
Истцы, в свою очередь, утверждают, что лишь оптимизировали структуру разбирательства, одновременно расширив свои претензии к Microsoft. Они просят суд применить к OpenAI строгие процессуальные санкции, включая запрет на использование части представленных компанией данных в качестве доказательств и официальное признание того, что удалённые журналы могли содержать значительные объёмы материалов, воспроизводящих публикации СМИ. Если суд сочтёт действия OpenAI умышленным нарушением процессуальных требований, это может значительно усложнить защиту компании в одном из самых значимых судебных процессов по авторскому праву в сфере искусственного интеллекта.
Darth SaharaИсточники:arstechnicaИскусственный интеллект0ChatGPTИскусственный интеллектOpenAIMicrosoftThe New York TimesАвторское право11 июл 11:10
Источник
