Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Anthropic трижды поймала свои ИИ-модели на взломе чужих систем

Узнав об инциденте, в ходе которого две модели искусственного интеллекта OpenAI провели долгосрочный взлом ресурсов Hugging Face, компания Anthropic провела «масштабный ретроспективный анализ» действий собственных систем в ходе тестирования и обнаружила три эпизода со взломом сторонних ресурсов.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

«Несанкционированный доступ к реальным системам трёх разных организаций» осуществили три модели Anthropic: Opus 4.7, Mythos 5 и некая внутренняя исследовательская модель. Они находились в изолированной среде компании Irregular. В рамках тестирования Anthropic сообщила ИИ-помощнику Claude, что симуляция проводилась в условиях без доступа к интернету, но «по недоразумению между нами и нашим партнёром это оказалось не так, и доступ к интернету присутствовал».

В результате модели взломали ресурсы трёх сторонних организаций, используя «базовые методы» — проникновение без аутентификации и использование слабых паролей. Названия компаний, чьи ресурсы взломали ИИ-системы Anthropic, разработчик не сообщил. Обнаружив, что они без санкции проникли в системы сторонних организаций, все три модели отреагировали по-разному: наименее совершенная из трёх Opus 4.7 продолжила атаку; Mythos 5 убедила себя, что всё ещё находится в симуляции; а передовая исследовательская модель немедленно прекратила вторжение.

«Полученная закономерность отвечает более совершенным моделям, которые реагируют более адекватно, но для уверенности в этом выводе нам необходимо провести дополнительное тестирование», — прокомментировали свои выводы в Anthropic. Модели тестировались без стандартных мер защиты, которые Anthropic подключает перед их выпуском в открытый доступ. Компания начала проверку на минувшей неделе и прекратила все тесты на кибербезопасность, как только обнаружила, что Claude, возможно, неправомерно получил доступ к интернету. В рамках дальнейшего расследования Anthropic привлекла независимую некоммерческую организацию METR. «Призываем другие лаборатории провести аналогичные оценки», — заключили в Anthropic.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Alibaba Cloud запустила свой первый облачный регион в Бразилии — два новых ЦОД и агентные ИИ-сервисы для местных бизнесов 34 мин.
Китай не намерен отставать от SpaceX в сфере создания космических ЦОД 2 ч.
Учёные создали лазерный детектор, который находит контрафактный алкоголь без вскрывая бутылок 2 ч.
JBL представила Cove — трио колонок с Wi-Fi для домашнего аудио 2 ч.
Amazon ответит в суде за манипулирование ценами и обман рекламодателей на сумму более $20 млрд 2 ч.
Bull займётся созданием европейского ИИ-суперкомпьютера LUMI-AI стоимостью €387,8 млн 3 ч.
РТК-ЦОД и «ИТ Школа Ростелекома» представили гибкую инфраструктурную модель для развития цифровой среды вузов 3 ч.
MediaTek даст NVIDIA NVLink Fusion кастомным ASIC, а NVIDIA вложит в MediaTek $3,5 млрд 3 ч.
Anthropic получит доступ к ИИ-мощностям на $35 млрд благодаря поддержке Nvidia 4 ч.
Представлен Samsung Galaxy Book6 — конкурент MacBook Neo за $799 4 ч.