Сегодня 13 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Чат-бот Claude AI станет прекращать «вредоносные или оскорбительные диалоги с пользователями»

Anthropic научила свой чат-бот Claude AI прекращать общение, которое он сочтёт «вредоносным или оскорбительным». Эта возможность уже доступна в моделях Opus 4 и 4.1. Она позволит чат-боту завершать разговоры в качестве крайней меры после неоднократных попыток пользователя сгенерировать вредоносный или оскорбительный контент. Anthropic хочет добиться «потенциального благополучия» моделей ИИ, прекращая беседы, в которых Claude испытывает «явный дискомфорт».

 Источник изображения: Anthropic

Источник изображения: Anthropic

После прекращения диалога со стороны Claude, пользователь не сможет отправлять новые сообщения в этом чате, но создание новых чатов будет по-прежнему доступно. Anthropic отметила, что разговоры, вызывающие подобную реакцию, являются «крайними случаями», добавляя, что большинство пользователей не столкнутся с этим препятствием даже при обсуждении спорных тем.

В ходе тестирования Claude Opus 4 у чат-бота было отмечено «стойкое и последовательное отвращение к причинению вреда», в том числе к созданию сексуального контента с участием несовершеннолетних, насильственным действиям и терроризму. В этих случаях, по данным Anthropic, Claude демонстрировал «явную тревожность» и «тенденцию прекращать вредоносные разговоры, когда предоставлялась такая возможность».

Claude получил прямое указание не завершать разговоры, если пользователь проявляет признаки желания причинить «неминуемый вред» себе или другим. В таких случаях Anthropic привлекает онлайн-сервис кризисной поддержки Throughline, чтобы помочь разработать ответы на запросы, связанные с самоповреждением и психическим здоровьем.

На прошлой неделе Anthropic обновила политику использования своего чат-бота, поскольку быстро развивающиеся модели ИИ вызывают всё больше опасений по поводу безопасности. Теперь компания запрещает использовать Claude для разработки биологического, ядерного, химического или радиологического оружия, а также для разработки вредоносного кода или эксплуатации уязвимостей сети.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
США жертвуют экологией ради ИИ: администрация Трампа ослабила требования — это может затронуть миллионы людей 11 ч.
NewPhotonics представила оптический движок NPC50506 на 6,4 Тбит/с с интегрированным лазером 12 ч.
ASUS выпустила СХД высокой плотности OJ340A-RS60 на базе AMD EPYC Genoa 12 ч.
Asus представила монитор ProArt Display OLED PA27UCDV для профессионалов 14 ч.
Biostar внезапно начала продвигать видеокарту GeForce GT 730 на чипе из 2014 года 15 ч.
Утекли характеристики Lenovo Googlebook 15 — он не сможет быть дешёвым 20 ч.
ИИ-гигастройка обходится Oracle слишком дорого — компания потратит ещё $700 млн на увольнения сотрудников 20 ч.
Anthropic спрогнозировала три сценария развития ИИ — от умеренного роста экономики до массовой безработицы 22 ч.
iPhone Duo не спасёт рынок складных смартфонов — Apple заберёт почти четверть рынка, но он почти не вырастет 24 ч.
AMD ворвалась в тройку крупнейших бесфабричных чипмейкеров — но до Nvidia ещё очень далеко 24 ч.