OpenAI объявила, что её внутренняя модель нашла решение задачи Навье-Стокса — одной из семи «проблем тысячелетия», которая оставалась нерешенной около 90 лет. Об этом компания сообщила в блоге во вторник, 25 марта. По словам OpenAI, модель, которая мощнее недавно выпущенной GPT-6 Astra, работала с 10 000 параллельных агентов. Обучение началось 28 августа, и модель показала «беспрецедентную производительность» на внутренних тестах, включая математику.

Задача Навье-Стокса описывает движение жидкостей и газов и является одной из самых сложных в математической физике. Её решение имеет огромное значение для аэродинамики, климатических моделей и многих других областей. За решение каждой из «проблем тысячелетия» Математический институт Клэя предлагает $1 млн, но OpenAI заявила, что не будет претендовать на приз.

Однако объявление сопровождается скандалом. За день до публикации OpenAI, 24 марта, математик Тристан Бакмастер из Нью-Йоркского университета вместе с Левентом Алпёге, исследователем из Anthropic, опубликовал результаты по смежной задаче. Бакмастер утверждает, что связался с OpenAI после того, как узнал, что компания была в курсе их прогресса. Он обнаружил, что доказательство OpenAI для уравнения Навье-Стокса использует подход, над которым он и Алпёге работали с помощью OpenAI Codex и Anthropic Claude.

Задача Навье-Стокса — одна из семи «проблем тысячелетия», за решение каждой полагается $1 млн.

OpenAI заявляет о решении задачи Навье-Стокса, но вспыхнул спор о плагиате
· Источник: The Verge AI

Бакмастер выразил обеспокоенность, что OpenAI могла получить доступ к их данным в Codex, куда они складывали все черновики проекта. В своём заявлении он пишет: «Я спросил, обучалась ли модель на наших сессиях в Codex или имела к ним доступ. Мне ответили, что модель не обращалась к пользовательским данным. Я спросил снова, насчёт обучения, и ответа не получил».

OpenAI в ответ заявила, что «никакие конкретные пользовательские данные не были использованы для решения этой задачи», но добавила: «Хотя это маловероятно, мы не можем исключить, что обезличенные данные, полученные из их использования наших продуктов, помогли улучшить наши модели». Себастьен Бубек, технический сотрудник OpenAI, сказал: «Мы не видели их работы, пока они не опубликовали её вчера вечером. Ретроспективно видно, что наши доказательства существенно различаются, и даже точные результаты разные».

Бакмастер ответил на это в Mastodon, заявив, что OpenAI «открыто признаёт, что использовала обучающие данные из периода после того, как мы получили наш результат». Спор поднимает вопросы о прозрачности использования данных в обучении ИИ-моделей, особенно когда речь идёт о научных исследованиях. Пока неясно, будет ли проведено независимое расследование, но инцидент уже привлёк внимание к этическим аспектам использования пользовательских данных в ИИ.