Сегодня 31 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Новая система безопасности OpenAI поможет выявлять угрозы, скрывающиеся за цепочкой безобидных запросов

Компания OpenAI начала тестировать новый механизм безопасности для клиентов, имеющих доступ к её флагманским ИИ-моделям по платной подписке. По сообщению Bloomberg, меры призваны усилить защиту в условиях, когда клиенты всё чаще доверяют ИИ выполнение сложных задач и работу с конфиденциальной информацией.

 Источник изображения: OpenAI (дополнено)

Источник изображения: OpenAI (дополнено)

На текущий момент OpenAI гарантирует некоторым клиентам, использующим интерфейс API, политику «нулевого хранения данных», при которой не сохраняются запросы и ответы после завершения работы с ИИ. Теперь же, тестируя механизм, который получил название Private Safety Processing («Конфиденциальная обработка в целях безопасности»), OpenAI намерена научить систему выявлять совокупность закономерностей, а не отдельных запросов и ответов. Это поможет предотвращать попытки взлома как со стороны злоумышленников, так и со стороны ИИ-агентов, чьё поведение отклоняется от заданных норм безопасности.

Необходимость такого изменения в компании объяснили тем, что современные ИИ-модели всё чаще используются для выполнения сложных многоэтапных задач, а вместе с этим растёт и роль инструментов, способных действовать без подробных инструкций пользователя. Руководитель продуктовой политики OpenAI Алеа Хоуз (Aleah Houze) рассказала, что потенциальный риск не всегда можно обнаружить, рассматривая только отдельную пару запроса и ответа, поскольку подозрительная последовательность может складываться лишь при анализе нескольких взаимодействий, происходящих с течением времени. По её словам, отдельные обращения к ИИ могут выглядеть как вполне легитимное исследование в области кибербезопасности, тогда как их совокупность способна указывать на подготовку атаки.

В качестве примера Хоуз привела ситуацию, при которой пользователь в одном разговоре выясняет сведения об уязвимости какого-либо программного обеспечения, а позднее интересуется возможностями удалённого доступа и средствами обнаружения подобных угроз. Каждый из таких запросов сам по себе может не вызывать подозрений, однако их связь между собой способна доказать злонамеренное поведение.

OpenAI рассчитывает, что Private Safety Processing позволит учитывать подобный контекст и тем самым эффективнее противостоять как злоумышленникам, так и потенциально опасным ИИ-агентам, при этом сохраняя содержимое клиентских запросов недоступным для самой OpenAI. Тестирование проводится совместно с такими клиентами, как Microsoft и Databricks. Запуск системы, а также публикация отчёта с описанием технологии, запланированы на сентябрь.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Sony подтвердила сентябрьскую презентацию State of Play — покажут Final Fantasy VII Revelation и игры от PlayStation Studios 20 мин.
Windows 11 начала обманывать, что антивирус Defender отключён — на самом деле он работает 2 ч.
В российской серверной ОС SelectOS прописалася ИИ-агент Aish 2 ч.
«Нам нужно адаптироваться»: оригинальная The Long Dark получит новые DLC, а Blackfrost: The Long Dark 2 скоро выйдет из тени 4 ч.
Новая Fable не станет игрой на сотни часов, и фанаты даже рады 5 ч.
ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию 24 ч.
«Энергетический» стартап Emerald AI привлёк $150 млн при оценке $1,05 млрд 30-08 15:22
Valve случайно «слила» 12 Тбайт данных по играм Steam с 2003 по 2013 год, включая ранние сборки Portal 2, Left 4 Dead, CS:GO и не только 30-08 15:18
Sony и Warner подали на Anthropic в суд за «вопиющую кражу» музыкальных произведений 30-08 11:59
Новая статья: Mortal Shell 2 — вдвое больше. Рецензия 30-08 00:08
Российским операторам разрешили строить 5G на частотах LTE — сети скоро появятся в городах-миллионниках 44 мин.
TSMC намерена в 50 раз повысить производительность ИИ-систем — помогут 3D-чипы и кремниевая фотоника 56 мин.
G.Skill представила комплект Flare X5X DDR5-6000 с технологией разгона AMD EXPO ULL для систем на Ryzen 3 ч.
Очередная доставка астронавтов и космонавта на МКС задержится из-за технических проблем у корабля SpaceX Dragon 4 ч.
Поставщики облачных услуг в Бразилии возьмут на вооружение оптические диски Folio Photonics 5 ч.
Гибрид Xiaomi Skynomad N90 Max проехал в реальных условиях 1230 км без подзарядки и дозаправки 5 ч.
FPGA AMD Versal RF получат поддержку UCIe 1.1 5 ч.
Российские цены на оперативную память и SSD для серверов выросли вдвое — снижения цен пока не предвидится 5 ч.
Лиха беда начало: Longsys станет третьим китайским чипмейкером, который выйдет на биржу в этом году 8 ч.
Intel может приобщиться к выпуску памяти HBM4E — она будет делать базовые кристаллы для SK hynix 8 ч.