Сегодня 09 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Математический прорыв OpenAI оказался под вопросом — учёные нашли расхождение в доказательстве

Математический прорыв OpenAI начал вызывать вопросы. Учёные сравнили опубликованное доказательство по уравнениям Навье — Стокса с его алгоритмической Lean-версией и нашли расхождения: в нескольких ключевых местах машинный вариант, проверяемый на компьютере, содержит более слабые утверждения. Это ещё не опровержение, но почва для сомнений уже вполне плодородная

 Источник изображения: Thomas T /unsplash.com

Источник изображения: Thomas T /unsplash.com

По словам математиков, расхождение вовсе не означает, что доказательства неверны или что OpenAI неправильно решила задачу, но это ставит под сомнение, всегда ли можно полагаться на математические результаты, генерируемые моделями искусственного интеллекта.

«Что нужно сделать со всеми этими большими доказательствами, созданными на основе языковой модели, так это то, что они должны быть прочитаны людьми, и это создает огромную дополнительную нагрузку на математиков», — сообщил руководитель команды Андерс Хансен (Anders Hansen).

Процесс поиска расхождений занял у команды около двух недель. При этом математики использовали подсказки ChatGPT. Напомним, что у OpenAI на решение задачи ушло 88 часов.

Математики указали на расхождение в части доказательств, называемой леммой 8.6. В доказательстве на естественном языке уравнение в этой части требует, чтобы определённое значение было меньше m + 4, где m - целое число, а в Lean‑версии — меньше m + 5, что математически слабее, поскольку допускает больше возможных решений и не эквивалентно первому.

Представим, что вас попросили решить уравнение x + 3 = 6, ответом на которое является x = 3. Можно написать доказательство того, что x должно быть меньше 4, а также того, что x должно быть меньше 5. Оба эти математических утверждения абсолютно верны, но последнее допускает больше возможных ответов для x, что делает его математически более слабым.

По словам Хансена, неправильный перевод мог возникнуть из-за того, что ИИ стремится к тому, чтобы компьютерный код был полностью самосогласован и не выдавал ошибок. Если в процессе автоматической формализации ИИ обнаружит часть доказательства, которая не компилируется, он попытается найти обходной путь, даже если это означает отклонение от доказательства, написанного на естественном языке.

Кевин Баззард (Kevin Buzzard) из Имперского колледжа Лондона сообщил, что можно надёжно формализовать в Lean саму формулировку теоремы и затем проверить, компилируется ли доказательство. Но это не гарантирует, что текстовое доказательство в PDF корректно передаёт логику. То есть Lean‑код может быть внутренне согласован, но не соответствовать тому, что написано в статье. «Я уверен, что проблема Навье — Стокса была решена правильно, — говорит Баззард. — Я гораздо менее уверен в том, что доказательство, описанное текстом, является правильным».

OpenAI сообщила ресурсу New Scientist, что ей известно о несоответствии между доказательством на естественном языке и в виде кода, и что это не означает, что ни одно из них недействительно.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Продюсер Konami рассказал о планах на продолжение Silent Hill 29 мин.
ИИ-агенты ошибаются опаснее чат-ботов — они сливают личные данные и совершают покупки без разрешения 52 мин.
Представлена операционная система KvadraOS Desktop для корпоративных рабочих мест 2 ч.
Математический прорыв OpenAI оказался под вопросом — учёные нашли расхождение в доказательстве 2 ч.
Ubisoft закроет серверы Rainbow Six Mobile — мобильный шутер не продержится и года 3 ч.
Anthropic прокачала Claude — теперь он визуализирует данные и создаёт анимацию прямо в чате 4 ч.
Суровая средневековая стратегия Stronghold 4 получила дату выхода в раннем доступе Steam и новую демоверсию 5 ч.
Продажи EA Sports FC 27 превысили $714 млн — футбольный симулятор возглавил топ игровых бестселлеров 2026 года 5 ч.
Беспилотник повредил второй дата-центр «Яндекса» подряд — на этот раз в Калуге 5 ч.
«От меня не скроешься»: в Steam вышла демоверсия кафкианского immersive sim о побеге от милиционера-великана Militsioner 6 ч.
Международная пропускная способность интернета достигла 2259 Тбит/с 2 ч.
Selectel выпустила серверную платформу на базе AMD EPYC 9005 Turin 2 ч.
Умное кольцо Natura Interface позволит отдавать поручения ИИ-агентам, не доставая смартфон 4 ч.
Tesla пришлось «обделить» роботов памятью — Optimus лишился трети оперативки 4 ч.
«Железное сердце Яндекса»: ЦОД компании в Калуге пострадал от атаки беспилотника 4 ч.
Чёрные дыры, пульсары и сверхновая: «Роскосмос» показал космос глазами рентгеновского телескопа ART-XC 4 ч.
Apple переоценила спрос на новые iPhone — выпуск iPhone 18 Pro и Pro Max урезали на 20 % 5 ч.
Трамп вручил медали Маску, Хуангу и другим техноиммигрантам — за вклад в науку и технологии 6 ч.
Три астронавта и космонавт миссии SpaceX Crew-12 вернулись на Землю после восьми месяцев на МКС 6 ч.
Samsung решила свернуть разработку чипов Exynos для автомобильной электроники 9 ч.