Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → the new york times

The New York Times обвинила ИИ-стартап Perplexity в создании «дословных копий» своих статей

Издательство The New York Times (NYT) подало судебный иск на «систему ответов» ИИ-стартапа Perplexity. NYT утверждает, что Perplexity «незаконно сканирует, копирует, извлекает и распространяет» материалы с сайта издательства. По словам истца, ответы, предоставляемые ИИ-поисковиком Perplexity являются «дословными или существенно похожими копиями» материалов NYT, защищённых авторским правом.

 Источник изображения: unsplash.com

Источник изображения: unsplash.com

«Копируя защищённый авторским правом контент The Times и создавая на его основе замещающую продукцию, устраняя необходимость посещения веб-сайта The Times или покупки газеты, Perplexity незаконно присваивает себе значительные возможности получения дохода от подписки, рекламы, лицензирования и партнёрских программ, которые по праву принадлежат исключительно The Times», — говорится в иске NYT.

Иск был подан после неоднократных требований в адрес Perplexity о прекращении использования контента с сайта NYT. Такие уведомления направлялись неоднократно в течение последних двух лет, но были проигнорированы. NYT требует возмещения ущерба и просит суд навсегда запретить Perplexity заниматься подобной деятельностью. Газета Chicago Tribune также подала в четверг иск о нарушении авторских прав против Perplexity.

Perplexity стала объектом нескольких судебных исков после того, как Forbes и Wired обвинили стартап в обходе платного доступа к их сайтам и использования их контента. NYT выдвигает аналогичные обвинения в своём иске, заявляя, что роботы Perplexity «намеренно игнорировали или обходили технические меры защиты контента», такие как файл robots.txt, который прямо указывает на разделы сайта, которые боты не должны сканировать и индексировать.

В июне британская корпорация BBC (Би-би-си) пригрозила иском Perplexity, заявив, что «базовая модель искусственного интеллекта» американского стартапа «была обучена с использованием контента BBC». Для телекомпании это стало первой попыткой пресечь деятельность технологических стартапов, использующих огромные запасы контента BBC для обучения нейросетей.

В августе компания Cloudflare обвинила стартап Perplexity в массовом скрапинге веб-сайтов, которые явным образом запрещают сбор данных. Согласно исследованию Cloudflare, опубликованному 4 августа, боты Perplexity игнорировали технические ограничения, установленные в файле robots.txt, и продолжали извлекать и копировать контент с десятков тысяч доменов, создавая миллионы запросов ежедневно.

В сентябре «Британская энциклопедия» (Encyclopedia Britannica) и её дочерняя компания Merriam-Webster подали иск в федеральный суд Нью-Йорка против компании Perplexity AI, обвинив её в нарушении авторских прав и товарных знаков. В иске обе компании утверждают, что система ответов Perplexity копирует их сайты, крадёт интернет-трафик и занимается плагиатом их материалов, защищённых авторским правом.

«Издатели судятся с новыми технологическими компаниями уже сто лет, начиная с радио, телевидения, интернета, социальных сетей, а теперь и ИИ, — заявил представитель Perplexity Джесси Дуайер (Jesse Dwyer). — К счастью, это никогда не работало, иначе мы бы все говорили об этом по телеграфу». Тем не менее, Perplexity попыталась смягчить ситуацию, запустив в прошлом году программу по разделению доходов от рекламы с издателями.

В конце октября Perplexity подписала многолетнее лицензионное соглашение с Getty Images, которое позволяет Perplexity отображать защищённый авторским правом контент в результатах своего поиска на основе искусственного интеллекта. Эта сделка знаменует заметный сдвиг в политике Perplexity, которая неоднократно подвергалась обвинениям в нарушении авторских прав и плагиате, и сигнализирует о стремлении компании к установлению более формальных партнёрских отношений в сфере контента.

OpenAI случайно удалила потенциальные улики по иску об авторских правах

В конце прошлого года началось судебное разбирательство, в рамках которого The New York Times и другие крупные издатели обвинили OpenAI в том, что компания без разрешения использовала публикуемые ими материалы для обучения своих нейросетей. Теперь же стало известно, что инженеры OpenAI случайно удалили данные, которые потенциально могли стать доказательством вины разработчика ИИ-алгоритмов в нарушении авторских прав.

 Источник изображения: OpenAI

Источник изображения: OpenAI

В сообщении сказано, что юристы новостных изданий потратили более 150 часов на изучение данных, которые OpenAI использует для обучения своих нейросетей. Цель их работы заключалась в том, чтобы найти случаи, когда для обучения ИИ-алгоритмов использовались новостные статьи изданий, защищённые законом об авторском праве. Какую именно информацию удалили инженеры OpenAI, точно неизвестно. Компания признала ошибку и попыталась восстановить данные, но сделать это в полном объёме не удалось. Те же данные, что удалось восстановить, не позволяют определить, что публикации изданий были задействованы при обучении нейросетей. Юристы OpenAI охарактеризовали удаление данных как «сбой», а представители The New York Times заявили, что у них «нет оснований полагать», что это было сделано преднамеренно.

В декабре прошлого года The New York Times обвинила OpenAI и её крупнейшего партнёра в лице Microsoft в том, что они создали свои ИИ-алгоритмы путём «копирования и использования миллионов статей» издания. Компания требует привлечь OpenAI к ответственности за «миллиарды долларов установленных законом и реальных убытков» за якобы копирование статей издания. The New York Times уже потратила более $1 млн на борьбу с OpenAI в суде. В это же время OpenAI успела договориться и заключить соглашение с другими изданиями, такими как Axel Springer, Conde Nast и Vox Media. Это говорит о том, что многие издатели предпочитают сотрудничество, а не судебные разбирательства.


window-new
Soft
Hard
Тренды 🔥
Google начала навязывать ИИ-режим в поиске — некоторые развёрнутые ответы от ИИ теперь показываются автоматически 2 ч.
Календарь релизов — 31 августа – 6 сентября: The Blood of Dawnwalker, Onimusha и Serious Sam 3 ч.
Балканизация виртуализации: VMware теряет клиентов из-за стратегии Broadcom, но та не собирается ничего менять 3 ч.
Недавнее обновление для Windows 11 сломало курсор и обои рабочего стола 3 ч.
DLSS 5 заработала на видеокартах GeForce RTX 2000 и RTX 3000, но очень медленно 8 ч.
Take-Two отчиталась о «бурном развитии» расследования по поиску виновника утечек GTA VI 8 ч.
ИИ-направление принесло Cloud.ru более половины выручки в I полугодии 2026 года 9 ч.
Instagram объявила войну ИИ-аккаунтам, выдающим себя за реальных людей 9 ч.
Sony подтвердила сентябрьскую презентацию State of Play — покажут Final Fantasy VII Revelation и игры от PlayStation Studios 9 ч.
Windows 11 начала обманывать, что антивирус Defender отключён — на самом деле он работает 10 ч.
Новая статья: 10 флагманских процессоров Intel за 10 лет 2 ч.
AOC выпустила 27-дюймовый игровой монитор Agon AGP277KXM с подсветкой Mini-LED и двумя режимами: 5K@180 Гц и 1440p@360 Гц 2 ч.
Apple потеряла ключевого руководителя накануне смены гендира: Фил Шиллер оставил пост главы App Store 3 ч.
Тим Кук эмоционально обратился к сотрудникам Apple в свой последний день на посту генерального директора 6 ч.
Meta внедряет роботов в ЦОД для замены людей, но пока процесс идёт очень медленно 7 ч.
CXMT запустила пробное производство памяти HBM3E 7 ч.
В недрах Марса обнаружилась массивная «тепловая аномалия» — возможно, это результат древнего космического ДТП 8 ч.
Никому ни слова: операторы ЦОД в США всё чаще заключают тайные соглашения в властями, прикрываясь NDA 9 ч.
Российским операторам разрешили строить 5G на частотах LTE — сети скоро появятся в городах-миллионниках 10 ч.
TSMC намерена в 50 раз повысить производительность ИИ-систем — помогут 3D-чипы и кремниевая фотоника 10 ч.