Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Anthropic трижды поймала свои ИИ-модели на взломе чужих систем

Узнав об инциденте, в ходе которого две модели искусственного интеллекта OpenAI провели долгосрочный взлом ресурсов Hugging Face, компания Anthropic провела «масштабный ретроспективный анализ» действий собственных систем в ходе тестирования и обнаружила три эпизода со взломом сторонних ресурсов.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

«Несанкционированный доступ к реальным системам трёх разных организаций» осуществили три модели Anthropic: Opus 4.7, Mythos 5 и некая внутренняя исследовательская модель. Они находились в изолированной среде компании Irregular. В рамках тестирования Anthropic сообщила ИИ-помощнику Claude, что симуляция проводилась в условиях без доступа к интернету, но «по недоразумению между нами и нашим партнёром это оказалось не так, и доступ к интернету присутствовал».

В результате модели взломали ресурсы трёх сторонних организаций, используя «базовые методы» — проникновение без аутентификации и использование слабых паролей. Названия компаний, чьи ресурсы взломали ИИ-системы Anthropic, разработчик не сообщил. Обнаружив, что они без санкции проникли в системы сторонних организаций, все три модели отреагировали по-разному: наименее совершенная из трёх Opus 4.7 продолжила атаку; Mythos 5 убедила себя, что всё ещё находится в симуляции; а передовая исследовательская модель немедленно прекратила вторжение.

«Полученная закономерность отвечает более совершенным моделям, которые реагируют более адекватно, но для уверенности в этом выводе нам необходимо провести дополнительное тестирование», — прокомментировали свои выводы в Anthropic. Модели тестировались без стандартных мер защиты, которые Anthropic подключает перед их выпуском в открытый доступ. Компания начала проверку на минувшей неделе и прекратила все тесты на кибербезопасность, как только обнаружила, что Claude, возможно, неправомерно получил доступ к интернету. В рамках дальнейшего расследования Anthropic привлекла независимую некоммерческую организацию METR. «Призываем другие лаборатории провести аналогичные оценки», — заключили в Anthropic.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
К 2030 году AMD, Cisco и Humain развернут в в Саудовской Аравии 1 ГВт суверенной ИИ-инфраструктуры 8 мин.
Anthropic хотела купить разработчика ИИ-чипов MatX за $7 млрд, но позже передумала 22 мин.
Anthropic заключила облачную сделку с поддерживаемой NVIDIA компанией Lambda на $35 млрд 32 мин.
Alibaba Cloud запустила свой первый облачный регион в Бразилии — два новых ЦОД и агентные ИИ-сервисы для местных бизнесов 2 ч.
Китай не намерен отставать от SpaceX в сфере создания космических ЦОД 3 ч.
JBL представила Cove — трио колонок с Wi-Fi для домашнего аудио 3 ч.
Amazon ответит в суде за манипулирование ценами и обман рекламодателей на сумму более $20 млрд 3 ч.
Bull займётся созданием европейского ИИ-суперкомпьютера LUMI-AI стоимостью €387,8 млн 4 ч.
РТК-ЦОД и «ИТ Школа Ростелекома» представили гибкую инфраструктурную модель для развития цифровой среды вузов 4 ч.
MediaTek даст NVIDIA NVLink Fusion кастомным ASIC, а NVIDIA вложит в MediaTek $3,5 млрд 4 ч.