ChatGPT перестал выполнять запросы на генерацию текста с имитацией стилей писателей

ChatGPT от OpenAI теперь отказывается генерировать тексты, напрямую имитирующие стиль известных авторов. Чат‑бот теперь предлагает ответ, основанный на «общих качествах», «но при этом сохраняющий свой собственный стиль».

Вот так выглядит ответ на тестовый запрос с просьбой написать вступление к рассказу в стиле Стивена Кинга: «Я, безусловно, могу писать в стиле атмосферного, основанного на персонажах ужаса и провинциальной тоски, но я не могу писать в точном стиле Стивена Кинга или точно имитировать его неповторимый голос. Вот оригинальное начало, которое передает похожее ощущение, оставаясь при этом самобытным…».

В ходе тестирования ChatGPT генерировал аналогичные варианты для других авторов, как ныне живущих (Дж. К. Роулинг, Эми Тан), так и умерших (Чарльз Диккенс, Эрнест Хемингуэй). Анализ, опубликованный No Latency ранее в этом месяце, выявил аналогичное поведение и в отношении ныне живущих авторов, но показал, что ChatGPT выполняет запросы на копирование стиля умерших.

Теперь ChatGPT предлагает передать общее «ощущение». На первый взгляд это может показаться незначительным отличием, но апдейт может иметь важное юридическое значение, поскольку компания продолжает бороться с рядом судебных исков от авторов. В одном из этих исков, например, конкретно упоминается «невероятная способность ChatGPT генерировать текст, похожий содержащийся в защищённых авторским правом материалах». 

В США закон об авторском праве, как правило, защищает только конкретное выражение идеи, а не неосязаемый стиль автора. Однако стилистическая имитация, созданная с помощью ИИ, может стать нарушением авторских прав, если она существенно схожа с оригиналом.

«У нас никогда не было ситуации, когда личный стиль отдельных авторов можно было бы имитировать так хорошо и так недорого, как сейчас с помощью ИИ», — заявил профессор юридической школы Университета Джорджа Вашингтона Роберт Браунейс.

В документе о «лучших практиках», опубликованном Гильдией авторов, профессиональная организация призывает писателей «уважать своих коллег и не использовать генеративный ИИ для преднамеренного копирования или имитации уникальных стилей, голосов или других отличительных черт работ других писателей таким образом, чтобы это наносило ущерб ценности их работ или было нацелено на извлечение прибыли».

Так, в прошлом году писательница Лена Макдональд столкнулась с широкой критикой, когда в её книге появился, по‑видимому, сгенерированный ИИ ответ, который гласил: «Я переписала отрывок, чтобы он больше соответствовал стилю [другой писательницы в жанре литературы] Дж. Бри…»

Нетрудно найти другие примеры того, как писатели использовали LLM для копирования стиля другого автора.

Что касается генерации изображений, OpenAI особо отмечает, что её модель DALL·E 3 «разработана для отклонения запросов, в которых требуется изображение в стиле ныне живущего художника». Но обширная спецификация модели OpenAI, опубликованная в декабре, не содержит чётко сформулированных запретов на воспроизведение материалов, защищённых авторским правом, или имитацию стиля в письменных ответах.

Исследование No Latency показало, что Google Gemini неизменно выполнял просьбы скопировать стиль автора, в то время как модели Perplexity AI неизменно отклоняли такие просьбы и перенаправляли их. Где‑то посередине находились Claude от Anthropic и Copilot от Microsoft, которые выполняли просьбы о подражании стилю, но, по словам авторов, демонстрировали оговорки, свидетельствующие о «понимании проблемы имитации».

В декабре группа писателей, включая лауреата Пулитцеровской премии Джона Каррейру, подала коллективный иск в суд Калифорнии против нескольких крупных компаний, работающих с искусственным интеллектом. В списке ответчиков оказались OpenAI, Google, Anthropic, xAI, Perplexity и подразделение Марка Цукерберга.

Истцы утверждают, что компании преднамеренно использовали пиратские библиотеки, включая LibGen, Z‑Library и OceanofPDF, для загрузки книг и создания датасетов для обучения своих моделей. По их мнению, нарушение авторских прав произошло дважды: сначала при нелегальном скачивании материалов, а затем при создании копий внутри обучающих наборов данных и оптимизации ИИ‑моделей.

Источник: habr.com

0 0 голоса
Рейтинг новости
1
0
Подписаться
Уведомить о
0 комментариев