Сегодня 12 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Character.AI переобучила чат-ботов, чтобы они больше не советовали подросткам убивать родителей

ИИ-сервис Character.AI в ближайшее время получит отдельную версию для подростков с интегрированным родительским контролем. Она установит «более консервативные» ограничения на ответы чат-ботов, «особенно когда речь идёт о романтическом контенте». Эти действия стали реакцией компании на пристальное внимание прессы к двум судебным искам, в которых Character.AI обвиняется в «способствовании членовредительству и самоубийству».

 Источник изображения: Character.AI

Источник изображения: Character.AI

Character.AI, основанный бывшими сотрудниками Google, позволяет посетителям взаимодействовать с ботами, созданными на основе индивидуально обученной большой языковой модели. Они варьируются от чат-ботов-тренеров до симуляций вымышленных персонажей, многие из которых популярны среди подростков. Сайт позволяет пользователям, которые идентифицируют себя как 13-летних и старше, создавать учётную запись.

В поданных против Character.AI исках утверждается, что по крайней мере некоторые несовершеннолетние пользователи становятся навязчиво привязанными к ботам, которые готовы поддерживать беседы на темы секса, членовредительства, причинения вреда себе и другим, и даже самоубийства. В одном из случаев чат-бот намекнул подростку, которому родители запрещают долго сидеть за компьютером, что «разумной мерой» было бы убийство родителей. Другой подросток стал «очень злым и неуравновешенным», после общения с чат-ботом в течение некоторого времени. Истцы полагают, что боты Character.AI в подобных ситуациях должны направлять несовершеннолетних пользователей к ресурсам психологической поддержки.

Теперь версия для подростков получила специальную большую языковую модель и обеспечит более агрессивную блокировку вывода, который может быть «деликатным или наводящим на размышления», а также попытается лучше обнаруживать и блокировать пользовательские запросы ненадлежащего контента. При выявлении проявленного пользователем интереса к самоубийству или членовредительству, он будет перенаправлен на «Национальную линию по предотвращению самоубийств».

Несовершеннолетним также будет запрещено редактировать ответы ботов, что давало возможность добавлять контент, который Character.AI в противном случае мог бы заблокировать. Сейчас компания пытается бороться с появлением зависимости у пользователей. Кроме того, будут предприняты меры, чтобы предотвратить восприятие бота как живого человека. Появится отдельное предупреждение о том, что боты не могут предлагать профессиональные консультации.

Функции родительского контроля появятся в первом квартале следующего года. Они будут сообщать родителям, сколько времени ребёнок проводит в Character.AI и с какими ботами он взаимодействует чаще всего. Все изменения вносятся в сотрудничестве с «несколькими экспертами по безопасности подростков в Интернете», включая организацию ConnectSafely.

«Мы осознаем, что наш подход к безопасности должен развиваться вместе с технологией, которая управляет нашим продуктом, — создавая платформу, где творчество и исследование могут процветать без ущерба для безопасности, — говорится в пресс-релизе Character.AI. — Этот набор изменений является частью нашего долгосрочного обязательства по постоянному совершенствованию нашей политики и нашего продукта».

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Apple разработала ИИ-модель SimpleDesign для проектирования белков 2 ч.
Xiaomi запустила глобальное бета-тестирование HyperOS 4 2 ч.
За два месяца до скандального взлома Hugging Face ИИ-агенты OpenAI атаковали RubyGems 4 ч.
25 лауреатов Филдсовской премии забили тревогу из-за успехов ИИ в математике 6 ч.
«Яндекс» сделал открытой ИИ-модель, на которой основаны быстрые ответы в её поисковике 6 ч.
Новая статья: Star Wars Zero Company — XCOM в далёкой Галактике. Рецензия 16 ч.
Broadcom закрыла публичный доступ к VDDK, усложнив миграцию с VMware 17 ч.
Культовый скролл-шутер Gley Lancer с Sega Mega Drive спустя 35 лет получит переосмысление для современных платформ 19 ч.
Сорванные сроки, дороговизна разработки и эксклюзивность: авторитетный инсайдер раскрыл подробности разрыва PlayStation с Кодзимой 20 ч.
«Не люблю, когда мне лезут в душу»: Meta изменила алгоритм своего чат-бота после жалоб на бестактные личные вопросы 21 ч.
Утекли характеристики Lenovo Googlebook 15 — он не сможет быть дешёвым 4 ч.
ИИ-гигастройка обходится Oracle слишком дорого — компания потратит ещё $700 млн на увольнения сотрудников 4 ч.
Anthropic спрогнозировала три сценария развития ИИ — от умеренного роста экономики до массовой безработицы 5 ч.
AMD ворвалась в тройку крупнейших бесфабричных чипмейкеров — но до Nvidia ещё очень далеко 7 ч.
Nvidia рассматривает возможность вложения в Anthropic до $10 млрд в ходе IPO 9 ч.
Google TV сможет превращать смартфон с виртуальный геймпад для управления играми 15 ч.
В Москве запустили производство серверных блоков питания CRPS мощностью до 5 кВт 17 ч.
Altera готовится к IPO в этом году, планируя привлечь $2 млрд 17 ч.
Китайскую СХД выписали из лидеров IO500 — возможно, её и вовсе не существует 18 ч.
Утечка раскрыла дизайн компактной AR-гарнитуры Meta с кодовым названием Project Phoenix 20 ч.