Домой ИИ и технологии OpenAI грозят санкции из-за сокрытия улик по иску The New York Times

OpenAI грозят санкции из-за сокрытия улик по иску The New York Times

Истцы требуют наказать разработчика нейросетей за удаление данных, которые могли доказать нарушение авторских прав.

OpenAI оказалась под угрозой серьезных судебных санкций в рамках продолжающегося разбирательства с The New York Times и рядом других крупных американских издательств. Истцы направили в суд ходатайство, в котором обвиняют компанию в намеренном сокрытии улик, удалении важных журналов работы ChatGPT и введении суда в заблуждение относительно реальных технических возможностей поиска по своим базам данных.

Суть претензий: скрытые журналы диалогов

Основным предметом конфликта стали логи переписки пользователей с ChatGPT. Издательства стремятся выяснить, как часто нейросеть выдает материалы, дословно воспроизводящие статьи, защищенные авторским правом. Эти сведения критически важны для определения того, подпадает ли обучение моделей на данных СМИ под принцип добросовестного использования (fair use) или является прямым нарушением прав.

Согласно версии истцов, в ходе повторного допроса инженера OpenAI по вопросам конфиденциальности Винсента Монако выяснилось, что компания располагала двумя значительными массивами обезличенных диалогов объемом около 10 млн и 78 млн записей еще до начала судебного процесса. Более того, OpenAI уже проводила поиск по этим данным, пытаясь оценить случаи цитирования защищенного контента в процессе разработки системы фильтрации выдачи.

логотип OpenAI на фоне юридической документации
Изображение сгенерировано: Nano Banana Источник: ixbt.com

Изображение сгенерировано: Nano Banana

Сокрытие данных и манипуляции с доказательствами

Истцы подчеркивают, что существование данных выборок скрывалось от суда на протяжении почти двух лет. Все это время представители OpenAI настаивали, что анализ подобных массивов информации технически невозможен, требует огромных затрат и несет риски для приватности пользователей. По мнению издателей, подобная тактика искусственно затянула сбор доказательств и привела к неоправданному росту судебных издержек.

Дополнительные претензии касаются качества переданных OpenAI данных. Истцы утверждают, что выборка из 20 млн диалогов была фактически непригодна для полноценного исследования: компания применила к ней около 19 млрд автоматических правок, скрыв ключевую информацию. Кроме того, в ходатайстве указано, что OpenAI не выполнила в полном объеме предписание суда по сохранению журналов переписки, что привело к удалению или сжатию миллиардов записей.

Позиция OpenAI и возможные последствия

В OpenAI категорически отвергают все обвинения. Представитель компании заявил, что требования истцов — это лишь попытка получить доступ к личной переписке пользователей, которая не имеет прямого отношения к делу, а утверждения о сокрытии улик назвал лживыми. Также в компании отметили, что недавнее сокращение части претензий со стороны истцов свидетельствует об ослаблении их позиции, а не об успехе стратегии.

Истцы настаивают, что лишь оптимизировали структуру разбирательства, одновременно расширив объем претензий к Microsoft. Они требуют от суда применения к OpenAI жестких санкций, вплоть до запрета на использование компанией части представленных данных в качестве доказательств. Также издатели добиваются официального признания того, что удаленные журналы могли содержать существенные объемы материалов, прямо воспроизводящих публикации СМИ. Если суд признает действия OpenAI умышленным нарушением, это может фатально осложнить защиту компании в одном из самых знаковых процессов по авторскому праву в сфере искусственного интеллекта.

Источник: https://www.ixbt.com