Epoch ИИ, создатель бенчмарка FrontierMath, сообщила о втором решении в наборе FrontierMath: Open Problems. При этом в двух самых сложных категориях — Major Advance и Breakthrough — модели не решили ни одной задачи. Это не мешает ИИ работать на уровне PhD: профессор Абхишек Саха из Queen Mary University of London провёл день с GPT-5.5 Pro и закрыл рутинную задачу, на которую раньше ушли бы недели. По его словам, математик всё чаще становится «дирижёром», а не «целым оркестром».

Новые возможности демонстрирует и академическая математика. В апреле 2026 года команда Carnegie Mellon University опубликовала решение открытой проблемы в теории Рамсея, объединив SAT-решатели, код, сгенерированный языковыми моделями, и формальную проверку доказательств. Авторы считают, что это начало «золотого века», который предсказал лауреат Филдсовской премии Тимоти Гоуэрс в 2000 году. Сам Гоуэрс признаётся, что его ожидания сбываются быстрее, чем он думал: GPT-5.6 Pro дважды решил задачу с первой попытки, над которой он сам работал долгое время. Это ощущение он назвал «странным и не особенно приятным».

Реакция профессионального сообщества неоднородна. Одни, как Саха, видят в ИИ ускоритель и ожидают, что часть коллег адаптируется, а часть будет сопротивляться до конца, как герой фольклора Джон Генри. Другие, как Гоуэрс, опасаются «разрушения математической культуры»: если глубокую экспертизу перестанут выращивать годами, литература раздуется за десятилетие-другое, а людей, способных её понять, не останется. Чтобы задать правила, Международный математический союз поддержал Лейденскую декларацию; её подписали более 3000 математиков. Документ призывает к прозрачности при использовании ИИ, защите прав авторов и сохранению ответственности человека за результаты.

Математик Абхишек Саха потратил день на GPT-5.5 Pro и сделал работу, на которую раньше ушли бы недели.

Image description
Image description · Источник: The Decoder

Ограничения тоже заметны. Математик Трефор Базетт отмечает, что ИИ хорошо справляется с задачами в теории графов, но в других областях прогресс минимален. По данным Epoch ИИ, в категориях Major Advance и Breakthrough решений пока нет. До шести нерешённых задач тысячелетия, каждая из которых оценивается в $1 млн, ИИ не добрался.