OpenAI представила десять результатов в математике и теоретической информатике, полученных с помощью новой модели Astra. Они охватывают несколько направлений, включая квантовую теорию игр и упаковку сфер в пространствах с числом измерений больше трёх.
До этого прорывы ИИ в математике появлялись по одному. Теперь компания опубликовала сразу несколько сотен страниц с решениями задач, над которыми работали профессиональные математики. Собеседники The Verge заявили: один такой результат мог бы обеспечить человеку успешный старт академической карьеры. Автору всех десяти достижений сразу поверили бы с трудом.
Доказательства перевели в Lean — язык, который позволяет компьютеру проверить каждый логический шаг. Специалисты из затронутых областей изучили материалы и не обнаружили оснований отвергать заявленные результаты.
При этом публикация вызвала спор об авторстве. Сначала OpenAI написала, что по одной из задач не было прогресса десять лет. В самой работе говорилось, что решение опирается на недавние результаты двух исследователей. Позже компания тихо изменила формулировку. Математики сочли научные материалы корректными, но раскритиковали пресс-релиз за преувеличение новизны.
Главный неизвестный параметр — цена десяти успехов. OpenAI не раскрыла, сколько задач получила модель и сколько попыток ей потребовалось. Поэтому публикация подтверждает способность Astra выдавать сильные доказательства, но не показывает, насколько стабильно она справляется с новой задачей с первого раза.
Современные модели ошибаются в арифметике, датах и простом счёте, но уже строят сложные абстрактные рассуждения. В математике это работает особенно хорошо: результат можно формально проверить.
Теперь спор идёт не только о качестве модели. Математикам предстоит понять, как изменятся научные гранты, подготовка молодых исследователей и сама роль человека в выборе новых задач. Десять доказательств опубликованы, но производительность Astra за пределами этой подборки остаётся закрытой.