Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Яндексу» приписали создание тестов на традиционные ценности для ИИ

«Яндекс» представил правительству концепцию набора тестовых заданий и эталонных данных для тестирования ИИ-систем на предмет их соответствия традиционным духовно-нравственным ценностям в соответствии с законом «О поддержке развития технологий искусственного интеллекта в России», сообщил «Коммерсантъ».

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

На совещании рабочей группы по регулированию и административным барьерам ИИ, прошедшем 13 августа, возник спор по поводу того, насколько публичным должен быть набор тестов. По словам источника, ФСБ настаивает на закрытом формате, чтобы разработчики не могли настроить ИИ-модели для прохождения тестов. Но по мнению представителей бизнеса, тесты должны быть публичными, поскольку закрытый формат может быть «несообразно сложным для прохождения и не позволит быстро развивать модели».

В итоге сошлись на комбинированном формате — когда для публичного тестирования будет предложен открытый бенчмарк, а для финальной проверки — закрытый, с идентичными тематиками, но с разными формулировками вопросов. Это позволит разработчикам проводить предварительную проверку моделей в лабораториях и обеспечить достоверность итоговой оценки при сохранении её объективности.

Также пока не определились с тем, кто будет определять содержание бенчмарка. IT-сообщество предлагает сформировать для этого совместную комиссию с участием органов власти, бизнеса и экспертных организаций.

В аппарате профильного вице-премьера Дмитрия Григоренко и Минцифры сообщили «Коммерсанту», что в данный момент все предложения находятся на этапе обсуждения и о конкретных решениях говорить рано.

По мнению бизнес-архитектора проектов ИИ «Авандок» (входит в ГК «Корус Консалтинг») Алексея Борщова, закрытые эталонные ответы являются обязательным условием для безопасности модели, поскольку любой публичный бенчмарк со временем могут взломать даже обычным скриптом. Вместе с тем разработчик должен знать, какие категории проверяются, в какой пропорции и с какими порогами, иначе тест становится лотереей.

В свою очередь, директор по ИБ GreenData Роман Перепонов отметил, что для оценки соответствия ценностям чёткого эталона, как, например, для программирования, быть не может — здесь требуется рубрикаторная или экспертная оценка.

Обновлено

Комментарий от пресс-службы Яндекса:

«Яндекс не представлял концепцию национального датасета и набор тестов для проверки ИИ-моделей. На рабочей встрече в Минцифры представители нескольких компаний обсуждали возможные подходы к такой проверке. Яндекс был одним из участников обсуждения и высказал свою позицию – содержание датасета должно быть открытым по общепринятым принципам отрасли».

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Alibaba Cloud запустила свой первый облачный регион в Бразилии — два новых ЦОД и агентные ИИ-сервисы для местных бизнесов 34 мин.
Китай не намерен отставать от SpaceX в сфере создания космических ЦОД 2 ч.
Учёные создали лазерный детектор, который находит контрафактный алкоголь без вскрывая бутылок 2 ч.
JBL представила Cove — трио колонок с Wi-Fi для домашнего аудио 2 ч.
Amazon ответит в суде за манипулирование ценами и обман рекламодателей на сумму более $20 млрд 2 ч.
Bull займётся созданием европейского ИИ-суперкомпьютера LUMI-AI стоимостью €387,8 млн 3 ч.
РТК-ЦОД и «ИТ Школа Ростелекома» представили гибкую инфраструктурную модель для развития цифровой среды вузов 3 ч.
MediaTek даст NVIDIA NVLink Fusion кастомным ASIC, а NVIDIA вложит в MediaTek $3,5 млрд 3 ч.
Anthropic получит доступ к ИИ-мощностям на $35 млрд благодаря поддержке Nvidia 4 ч.
Представлен Samsung Galaxy Book6 — конкурент MacBook Neo за $799 4 ч.