Нерелизованная модель Anthropic продвинулась в решении одной из главных нерешённых задач математики — гипотезы Римана
Более 150 лет гипотеза Римана остаётся одной из главных нерешённых задач математики — давней загадкой о распределении простых чисел. Сейчас за рабочее общее доказательство гипотезы назначена награда в 1 миллион долларов, которая до сих пор не востребована. Гипотеза, сформулированная ещё в 1859 году, тесно связана с поведением дзета-функции и находит приложения в теории чисел, криптографии и других областях, что делает её особенно значимой и для практики.
Современные ИИ-модели решить её тоже пока не могут, однако способны продвинуться в этом направлении гораздо дальше, чем можно было бы ожидать, — вывод, который, вероятно, заново откроет давние вопросы о способности современного ИИ открывать новые научные и математические идеи. Если модели действительно могут генерировать проверяемые математические рассуждения и находить новые подходы, это меняет представление о границах автоматизированного открытия.
В понедельник Anthropic объявила, что ещё не выпущенная модель добилась значительного прогресса в отношении гипотезы Римана, существенно повысив нижнюю границу решений, для которых гипотеза выполняется. Это не означает полного доказательства, но заметно сужает неисследованную область и даёт математикам новые ориентиры.
Ещё более впечатляет то, как был достигнут этот прогресс: сотрудник Anthropic без серьёзной математической подготовки попросил модель «по-настоящему попытаться» доказать гипотезу, а затем оставил модель координировать задачу в течение следующих полутора дней. Модель фактически работала в автономном режиме, самостоятельно планируя следующий шаги и привлекая помощников.
В общей сложности модель проверила 650 различных идей решения задачи, координируя работу 60 субагентов и потратив в сумме 31 миллион выходных токенов. Такой масштаб вычислений демонстрирует, что современные языковые модели способны вести длительные многоагентные исследовательские процессы, а не только отвечать на отдельные запросы.
«Из 60 субагентов двое отвечали за разработку ключевых математических идей, — поясняется в сноске к статье. — 13 внесли идеи для этих агентов, 30 пытались (но не смогли) разработать новые идеи, 13 выступали в роли валидаторов, проверявших корректность аргументов, а последние двое помогали написать первоначальную статью». Такое распределение ролей напоминает организацию большой исследовательской группы, где одни генерируют гипотезы, другие проверяют, а третьи оформляют результат.
Результат был подтверждён двумя штатными математиками Anthropic и формализован с помощью ассистента доказательств с открытым исходным кодом Lean. Формализация в Lean делает проверку прозрачной: корректность рассуждений можно перепроверить механически, а не полагаться только на экспертную оценку.
Это последний из серии математических прорывов, совершённых большими языковыми моделями (LLM). Ряд задач Эрдёша был решён ИИ-моделями в течение этого года, а выход более мощных моделей привёл к более впечатляющим результатам. OpenAI недавно выпустила набор из 10 крупных результатов, доказанных её внутренней моделью «Astra», а отдельная работа Anthropic опровергла давнюю гипотезу Якобиана.
Растущий корпус результатов вызывает в математическом сообществе и воодушевление, и тревогу. В публичной декларации, подписанной в июне, группа видных математиков выразила опасения, что ИИ может подорвать ключевые ценности этой области — в частности, стандарт, согласно которому истинные математические доказательства должны быть «приписаны конкретным авторам, которые берут на себя ответственность за своё открытие и отвечают за его корректность».
Но сообщество по-прежнему разделено в вопросе о том, как математикам следует относиться к новым исследовательским методам. В ответ на декларацию в блоге лауреат Филдсовской премии Тимоти Гауэрс задался вопросом, может ли влияние ИИ изменить математику более сложным и позитивным образом.
«Если мы придём к миру, где математические теоремы больше не ассоциируются с математиками, возможно, это будет не более проблематично, чем тот факт, что звёзды не названы в честь астрономов, а большинство из них вообще никак не названы», — написал Гауэрс. Его позиция отражает более широкий взгляд: возможно, важнее само открытие и его доказательство, чем вопрос о том, кто именно его совершил.
По материалам TechCrunch
