Сегодня 02 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

New York Times обвинила OpenAI в сокрытии улик по делу об обучении ИИ на чужих материалах

Утверждения OpenAI о том, что разработчик ChatGPT не имеет возможности производить поиск по перепискам пользователей и чат-бота с искусственным интеллектом, а также по массивам обучающих данных, не соответствуют действительности, заявили представители газет New York Times и The Daily News.

 Источник изображений: Mariia Shalabaieva / unsplash.com

Источник изображений: Mariia Shalabaieva / unsplash.com

Издания уже два года судятся с разработчиком систем ИИ, утверждая, что компания нарушила авторское право, обучая свои генеративные ИИ-модели на их материалах, которые воспроизводятся дословно в ответах на запросы пользователей. Всё это время OpenAI утверждает, что у неё нет возможности искать информацию в обучающем массиве. Она также настаивает, что поиск или воспроизведение переписки пользователей с ChatGPT были бы технически обременительными и вызвали бы опасения по поводу конфиденциальности пользователей — журналы чатов пришлось бы извлекать, обрабатывать и обезличивать. Издания запрашивали эти сведения, чтобы определить, присутствуют ли их защищённые авторским правом публикации в обучающих массивах OpenAI, и генерирует ли ChatGPT ответы, используя и воспроизводя их контент.

В ходе допроса, проведённого в апреле по решению суда, инженер по защите данных в OpenAI Винни Монако (Vinnie Monaco) якобы сообщил, что компания всё-таки производила поиск и оценку данных в обучающем массиве, чтобы выявить присутствие защищённых авторским правом журналистских работ. По его словам, ещё до подачи New York Times иска OpenAI уже собрала базу из 78 млн обезличенных переписок с ChatGPT, которую использовала, чтобы определить степень нарушения авторских прав на чужие работы. После подачи иска компания также предположительно внедрила фильтр Bloom в наборе средств Project Giraffe, который фиксировал повторения во выходных данных.

Первоначально истцы запрашивали выборку из 120 млн журналов переписки, но OpenAI договорилась сократить её объем до 20 млн. В декабре компания представила эти данные, но они, как определил суд, были настолько вымараны, что стали «непригодными для использования». После подачи иска OpenAI, утверждают истцы, удалила несколько миллиардов ответов ChatGPT, нарушив тем самым постановление суда о сохранении данных; а несколько миллионов журналов компания просто заменила. Другими словами, она неоправданно затруднила передачу уже собранной информации.

«Если бы OpenAI действительно считала, что копировать журналистские материалы наших клиентов — это честно и по закону, она бы не скрывала правду, что сделала это», — заявил адвокат истцов. New York Times и The Daily News просят судью вынести OpenAI наказание за сокрытие доказательств и вмешательство в процесс раскрытия информации. Они ходатайствуют, чтобы OpenAI запретили использовать массив из 20 млн журналов чатов как доказательство, утверждая, что этот набор данных ненадёжен; чтобы суд принял как факт, что журналы переписок ChatGPT показали бы существенное повторение материалов истцов; чтобы OpenAI лишилась возможности утверждать что в представленных ей журналах переписок не демонстрируется существенное повторение материалов; и чтобы OpenAI оплатила судебные издержки за поиск этих доказательств.

Представитель OpenAI отверг обвинения, обвинив истцов в попытке получить доступ к частной переписке пользователей, потому что позиция истцов ослабла. «По мере ослабления позиции Times и вынужденного отказа от претензий к нам они продолжают свои попытки вторгнуться в частную жизнь людей, не имеющих к этому делу никакого отношения, в том числе путём выдвижения этих заведомо ложных обвинений. Мы и далее будем защищать конфиденциальность наших пользователей и давно установленные принципы добросовестного использования», — подчеркнул он.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Samsung внезапно стала блокировать аккаунты владельцев Galaxy — причина массовой деактивации пока неизвестна 7 мин.
Слухи: спустя 11 лет ожиданий StarCraft 3 всё-таки может стать реальностью, но без участия Blizzard 51 мин.
Представлена ИИ-модель Meta Muse Voice Transcribe для расшифровки речи 2 ч.
Ozon, Wildberries и «Яндекс Маркет» начали принимать цифровые рубли 2 ч.
Google хочет обучать ИИ-модели на голливудских фильмах и сериалах 2 ч.
Цены на ИИ-токены рекордно упали 2 ч.
OpenAI: грядущая ИИ-модель Astra станет первой с «критическим» уровнем возможностей в сфере кибербезопасности 2 ч.
Perplexity повторила за Apple: теперь часть задач будет выполняться в облаке, а часть — локально на ПК 2 ч.
Расширенный показ GTA VI покорил подписчиков Netflix в 87 странах — более 31 миллиона просмотров за четыре дня 3 ч.
Apple разрешила разработчикам приложений для macOS отказаться от поддержки процессоров Intel 4 ч.
AWS объявила о доступности инстансов EC2 R9g и R9gd на базе фирменных Arm-процессоров Graviton5 9 мин.
Google разогнала разработку ИИ-чипов — TPU теперь будут обновляться дважды в год, но и этого может быть мало 14 мин.
PwC: глобальные инвестиции в ИИ-инфраструктуру составят $31,6 трлн к 2050 году 25 мин.
Китай отстаёт от ASML на 15 лет — и страна вряд ли освоит EUV-литографию раньше 2040 года 52 мин.
Dell анонсировала игровые QD-OLED-мониторы Alienware AW3226Q и AW2527HX 2 ч.
Электрический внедорожник Range Rover Electric наконец поступит в продажу после двухлетней задержки 2 ч.
Представлен ноутбук Dell 14S — ещё один недорогой конкурент Apple Macbook Neo 2 ч.
Выручка от продаж корпоративных SSD за квартал взлетела вдвое 2 ч.
Марсу понадобился свой интернет: NASA поручило Blue Origin построить там телекоммуникационную сеть 4 ч.
Dell зарабатывает на ИИ больше, чем на ПК — компания резко повысила прогноз выручки до $192 млрд 4 ч.