OpenAI обнародовала сотни новых математических открытий, сгенерированных внутренней передовой моделью, что представляет собой одну из самых передовых технологий, разработанных компанией. Всего организация опубликовала 722 рукописи на GitHub, объединив 372 набора результатов по задачам, которые десятилетиями ставили в тупик математиков.
Это обнародование происходит на фоне интенсивных дебатов о применении искусственного интеллекта в научных областях. Хотя компания проконсультировалась с независимым коллективом математиков для установления руководящих принципов публикации, она не приняла все предоставленные предложения.
Компиляция охватывает различные области, включая теорию чисел и алгебраическую геометрию. Среди наиболее примечательных моментов выделяется решение гипотезы Какея в четырех измерениях, а также улучшения в вычислительных алгоритмах и прогресс, связанный с так называемой «квази-гипотезой Римана».
Результаты также включают три из пяти Проблем тысячелетнего приза, которые до сих пор не имеют решения. Для достижения этих результатов модель предприняла попытки решения примерно 4 тысяч задач.
Реакция научного сообщества
Масштаб этого обнародования привлек внимание математического сообщества. Алекс Конторович, профессор Университета Ратгерса, прокомментировал в X, что если бы человек представил доказательство, касающееся «квази-гипотезы Римана», этого было бы достаточно, чтобы гарантировать ему немедленную Медаль Филдса.
Однако важно подчеркнуть, что материал все еще требует тщательной оценки экспертами. Математическая значимость и обоснованность доказательств зависят от независимо проведенного анализа.
Для структурирования публикации OpenAI обратилась за помощью к Консультативной группе по математике и искусственному интеллекту (AGMAI), состоящей из независимых экспертов. Компания утверждает, что следовала рекомендациям группы по распространению открытий, но решила не внедрять конкретную рекомендацию о приостановлении тестирования сложных математических задач в своих проприетарных моделях.
Репозиторий содержит формализации доказательств с использованием Lean, языка программирования, который позволяет проверять математические доказательства с помощью вычислений. Также были предоставлены резюме рассуждений модели, оценки потребления вычислительных ресурсов и статистика, относящаяся к протестированным задачам.
OpenAI сообщила, что публикация на GitHub включает протоколы как для рецензирования статей, так и для правильного цитирования работ. По данным самой компании, каждый результат потребовал в среднем вычислительной мощности, эквивалентной примерно трем часам использования ChatGPT Pro.
Кроме того, компания планирует финансировать семинары, конференции и программы, посвященные анализу открытий, полученных с помощью ИИ. Репозиторий будет обновляться новыми формализациями по мере их получения.
Это обнародование следует за серией дискуссий о применении ИИ для решения математических задач. Предыдущий спор, связанный с OpenAI, усилил требование большей прозрачности и возможности воспроизведения результатов.
Позиция относительно продвинутых тестов
Консультативная группа предлагала лабораториям прекратить тестирование сложных математических задач в собственных моделях. OpenAI проигнорировала это указание, отстаивая важность продолжения оценки своих передовых внутренних моделей в математике и других науках.
Более того, компания не раскрыла точных временных затрат на каждую задачу или использованные команды (промпты). Это упущение усиливает мнение математического сообщества о необходимости тщательного изучения доказательств, прежде чем присваивать им окончательное значение.
Следующий шаг лежит на исследователях, которые должны проверить доказательства, воспроизвести результаты, когда это возможно, и определить, какие из них представляют собой значительный прорыв для математики.
