Сегодня 10 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI представила две почти открытые модели для систем безопасности

OpenAI представила две рассуждающие модели искусственного интеллекта, предназначенные для обнаружения различных угроз безопасности на интернет-платформах. Они доступны по лицензии с открытыми весами.

 Источник изображения: Andrew Neel / unsplash.com

Источник изображения: Andrew Neel / unsplash.com

Новые открытые модели OpenAI получили названия gpt-oss-safeguard-120b и gpt-oss-safeguard-20b — последние показатели свидетельствуют о числе параметров. Это адаптированные версии анонсированных в августе бесплатных gpt-oss. Новые варианты также доступны с открытыми весами, то есть предлагают пользователям прозрачность и контроль, но это не модели с полностью открытым исходным кодом.

Организации могут настраивать их в соответствии со своими требованиями политики — модели выводят цепочки рассуждений, а значит, у разработчиков будет представление о том, как они приходят к тому или иному результату. Так, на сайте с обзорами модели серии gpt-oss-safeguard помогут для фильтрации отзывов, которые они сочтут поддельными; аналогичным образом на игровом форуме они смогут автоматически удалять сообщения о читерских схемах.

OpenAI разработала их совместно с Discord, SafetyKit и организацией ROOST, которая специализируется на инфраструктуре безопасности для систем ИИ. Модели доступны в формате предварительных версий для исследователей — OpenAI хочет собрать отзывы экспертов.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Visa, Mastercard и Ant создадут единый стандарт для ИИ-агентов, которые тратят деньги пользователей 2 ч.
Ubisoft наконец перестанет принуждать пользователей Steam устанавливать лаунчер Ubisoft Connect 2 ч.
Россия лидирует по количеству утечек баз данных 2 ч.
Claude сам взломал чужую систему и добыл пароль — Anthropic раскрыла новый тревожный инцидент 2 ч.
«Сбер» представил GigaChat 3.5 Reasoning — первую российскую открытую ИИ-модель с режимом рассуждений 2 ч.
Anthropic открыла властям ЕС доступ к модели Mythos после трех месяцев ожидания 2 ч.
«Выглядит намного лучше»: 15 минут мультиплеерных баталий орков и некронов в Warhammer 40,000: Dawn of War 4 порадовали фанатов 3 ч.
«Погибнет большинство людей»: новый эксперт OpenAI по безопасности предрёк катастрофу в случае выхода ИИ из-под контроля 4 ч.
OpenAI потребовала ввести обязательные общенациональные нормы безопасности ИИ в США 4 ч.
Кооперативное приключение Hela: of Mice & Magic отправит нести добро в мир скандинавского фольклора — новый трейлер и дата выхода 5 ч.