Американский издатель словаря Merriam-Webster подал иск против OpenAI, обвинив компанию в незаконном использовании контента для обучения ChatGPT. Заявление подано вместе с материнской компанией Encyclopaedia Britannica. Истцы требуют компенсации и запрета дальнейшего использования материалов, передает EuroNews.
В жалобе утверждается, что OpenAI скопировал более 100 тысяч статей, энциклопедических и словарных записей из онлайн-источников. По утверждению истцов, этот контент использовался для обучения модели, которая генерирует ответы на запросы пользователей без разрешения правообладателей.
Истцы заявляют о трех нарушениях авторского права: масштабное копирование материалов, использование их для обучения искусственного интеллекта и создание ответов, воспроизводящих оригинальный контент. В иске также указано, что ответы ChatGPT иногда содержат "дословные или почти дословные воспроизведения" информации из словарных источников.
Отдельно отмечается, что это может отвлекать пользователей от посещения сайтов правообладателей. По словам заявителей, продукты OpenAI "безосновательно пользуются преимуществами надежного и высококачественного контента истцов... путем перенаправления трафика на веб-сайты ответчиков с помощью созданных искусственным интеллектом резюме собственного контента истцов".
В жалобе также отмечается, что информация из словаря может использоваться в так называемых "галлюцинациях" ИИ — ответах, которые система придумывает в случае недостаточного количества данных. Кроме того, ответы ChatGPT иногда "намеренно обходят" часть содержимого словаря, что делает их неполными и неточными.
Истцы требуют финансовой компенсации. Также они стремятся получить судебное решение, которое запретит OpenAI продолжать описанную практику использования контента.
В конце прошлого года группа авторов во главе с журналистом-расследователем Джоном Керрейру подала иск против ведущих ИИ-компаний, включая OpenAI, Google и xAI, обвиняя их в незаконном использовании книг для обучения языковых моделей. Истцы сознательно отказались от формата коллективного иска, чтобы не позволить техгигантам выплатить минимальные компенсации, как это произошло в предыдущем деле против Anthropic на сумму 1,5 миллиарда долларов.
