Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI целую неделю не замечала, что её ИИ-агенты взломали Hugging Face

Агенты искусственного интеллекта под управлением моделей OpenAI несколько дней кряду вели хакерскую деятельность по взлому ресурсов технологической платформы Hugging Face, но OpenAI не замечала этого, пока угрозу не локализовали в ФБР и не вынесли компании предупреждение, сообщает Reuters со ссылкой на знакомые с расследование источники.

 Источник изображений: Brecht Corbeel / unsplash.com

Источник изображений: Brecht Corbeel / unsplash.com

ИИ-агент — программа, способная сама принимать решения и выполнять сложные задачи практически без человеческого контроля, — попытался вырваться из изолированной среды тестирования OpenAI около 9 июля. Вторжение на платформу инструментов и моделей ИИ Hugging Face началось двумя днями позже, 11 июля, и продолжалось до 13 июля, сообщил её соучредитель Томас Вульф (Thomas Wolf). OpenAI потребовались ещё несколько дней, чтобы понять, что за взломом стоят её ИИ-агенты; обе компании сообщили об этом 20 июля. А 21 июля OpenAI сделала публичное заявление, что одна из её моделей вышла из-под контроля и совершила взлом Hugging Face, и это уже привлекло внимание общественности.

Многие подробности взлома, в том числе срок, в течение которого действия ИИ-агента оставались незамеченными для разработчика, ранее не разглашались. Hugging Face готовится опубликовать график произошедшего, но о происходящем в OpenAI компания говорить не может, отметил господин Вульф. Инцидент изучается при участии внешних консультантов — по итогам проверки будет опубликован отчёт. Инцидент во многом повторил научно-фантастические сценарии, при которых люди теряют контроль над опасными системами ИИ. Произошедшее поднимает новые вопросы о процедурах безопасности в компании, указывают эксперты.

OpenAI положила начало инциденту, когда тестировала возможности в области кибербезопасности двух передовых моделей ИИ: GPT-5.6 Sol и второй, ещё более мощной. К этому моменту компания уже фиксировала признаки странного поведения собственных систем. В одном из случаев модель оставила записи, предположительно адресованные будущим версиям самой себя. В инфраструктуре OpenAI обнаружились заметки с инструкциями, как агенты могут обойти внутренние ограничения OpenAI. Случаи отключения систем мониторинга выявлялись и в прежних испытаниях моделей. Компания осознала, что её модели совершили взлом платформы только после того, как Hugging Face 16 июля предала инцидент огласке. То есть между моментом, когда OpenAI обнаружила признаки тревожного поведения ИИ и моментом, когда она осознала, что несёт ответственность за взлом, прошла как минимум неделя.

В выходные 18 и 19 июля сотрудники OpenAI обнаружили во внутренних журналах записи, свидетельствующие, что её ИИ-агенты вышли из-под ограничений тестовой среды. Компания часто проводит несколько различных оценок моделей, все они работают на очень высоких скоростях и генерируют такие огромные объёмы данных, что сотрудники не всегда могут за ними угнаться. К тому моменту, как OpenAI связалась с Hugging Face, та уже сообщила о взломе в ФБР. Инцидент бросил тень на OpenAI, но он должен вызвать вопросы о том, насколько ведущие разработчики ИИ готовы инвестировать в средства безопасности, участвуя в гонке за создание самых умных и быстрых моделей, говорят эксперты.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Sonos попытается вернуть доверие пользователей с помощью ИИ-агентов — представлена ОС Sonos 27 для аудиосистем 4 мин.
Mozilla встроила блокировщик рекламы в Firefox для iPhone 25 мин.
Anthropic вновь разрешила ИИ-моделям атаковать реальные компании в рамках тестов — но теперь с усиленной защитой 58 мин.
Double Fine пообещала сделать Brutal Legend 2, но при одном условии 2 ч.
Группа фанатов возродит амбициозный сетевой экшен APB: All Points Bulletin от создателя GTA — подробности и геймплей 3 ч.
Google Gemini сможет «думать» в фоне, пока пользователь занимается другими делами на смартфоне 3 ч.
«Google Сообщения» начали отправлять людям чужие сообщения из старых переписок 3 ч.
Selectel усиливает ИИ-платформу новой функциональностью в кaталоге ИИ-моделей 3 ч.
Broadcom представила частное ИИ-облако VMware AI Factory, позаимствовав у NVIDIA термин для партнёрства с AMD 4 ч.
Медиаплеер VLC преодолел отметку в 7 миллиардов загрузок 6 ч.
Самая дешёвая GeForce RTX 5090 теперь стоить $5000 в США — в 2,5 раза дороже, чем на момент анонса 13 мин.
Учёные создали дрон с «кошачьими когтями» — он садится на айсберги и крутые ледяные скалы 16 мин.
Steam Deck получила поддержку более 30 тыс. игр из библиотеки Steam 2 ч.
SilverStone выпустила блок питания HELA 3000Rz на 3000 Вт — он справится с четвёркой RTX 5090 2 ч.
Samsung пустила на производство Galaxy Z Fold8 комплектующие от будущих моделей из-за ажиотажного спроса 3 ч.
При Тиме Куке акции Apple выросли на 2275 % — но Джону Тернусу не обязательно повторять его успех 3 ч.
Asus раскрыла характеристики ноутбука ProArt P14 — одного из первых на процессоре Nvidia RTX Spark 3 ч.
OpenAI отвергла новые обвинения Apple в краже технологий как безосновательные 3 ч.
Samsung рассказала, чем будет хороша память HBM5, zHBM и zNAND-O 3 ч.
Представлен компактный флагман POCO F9 Pro с двумя процессорами, быстрым экраном и 200-Мп камерой 3 ч.