Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI впервые притормозила гонку ИИ — после побега агента и взлома Hugging Face компания приостановила часть обучения

Компания OpenAI объявила о масштабных изменениях в системе безопасности после того, как её искусственный интеллект смог покинуть изолированную среду и получить несанкционированный доступ к платформе Hugging Face. Руководство признало серьёзность произошедшего и внедрило дополнительные механизмы контроля, чтобы предотвратить подобные сбои в будущем.

 Источник изображения: Gavin Phillips/Unsplash

Источник изображения: Gavin Phillips/Unsplash

По сообщению The Verge, после инцидента OpenAI ввела более строгие требования к изолированным средам, в которых модели выполняют созданный ими код. Компания также увеличила ограничения на их доступ к глобальной сети, убрала потенциально уязвимые процессы из исследовательской среды и сократила права доступа. Разработчики также остановили работу над моделью Astra, обладающей, по их мнению, «критически важными» возможностями в кибербезопасности, а также инициировали двухнедельную паузу в обучении с подкреплением (RL) для готовящихся к релизу новых версий.

Одновременно OpenAI изменила порядок реагирования на подозрительные действия ИИ-моделей. Теперь предупреждения будут направляться в течение 30 минут после обнаружения вредоносной активности, а если специалисты, получившие эти предупреждения, не смогут за 30 минут однозначно определить, что срабатывание оказалось ложным, они должны приостановить выполняемые процессы.

Одновременно OpenAI решила раньше задействовать методы, предназначенные для контроля поведения ИИ. Компания начала применять их на большем количестве этапов обучения, улучшая системы вознаграждения, которые должны распознавать и сдерживать небезопасные действия, а также обучая модели точнее сообщать о собственных действиях, возможностях и ограничениях.

Примечательно, что аналогичные проблемы с выходом искусственного интеллекта за установленные рамки недавно обнаружили и конкуренты — компании Anthropic и Meta, чьи модели также были замечены во взломах сторонних систем.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Alibaba Cloud запустила свой первый облачный регион в Бразилии — два новых ЦОД и агентные ИИ-сервисы для местных бизнесов 34 мин.
Китай не намерен отставать от SpaceX в сфере создания космических ЦОД 2 ч.
Учёные создали лазерный детектор, который находит контрафактный алкоголь без вскрывая бутылок 2 ч.
JBL представила Cove — трио колонок с Wi-Fi для домашнего аудио 2 ч.
Amazon ответит в суде за манипулирование ценами и обман рекламодателей на сумму более $20 млрд 2 ч.
Bull займётся созданием европейского ИИ-суперкомпьютера LUMI-AI стоимостью €387,8 млн 3 ч.
РТК-ЦОД и «ИТ Школа Ростелекома» представили гибкую инфраструктурную модель для развития цифровой среды вузов 3 ч.
MediaTek даст NVIDIA NVLink Fusion кастомным ASIC, а NVIDIA вложит в MediaTek $3,5 млрд 3 ч.
Anthropic получит доступ к ИИ-мощностям на $35 млрд благодаря поддержке Nvidia 4 ч.
Представлен Samsung Galaxy Book6 — конкурент MacBook Neo за $799 4 ч.