Неанонсированная исследовательская версия Claude от Anthropic смогла продвинуться в математической задаче, связанной с гипотезой Римана. Полного доказательства одной из главных нерешенных проблем математики модель не нашла, но улучшила важную нижнюю оценку доли нулей дзета-функции, которые соответствуют гипотезе.
Гипотеза Римана остается недоказанной с 1859 года и входит в список «Задач тысячелетия», за решение каждой из которых назначен приз в $1 млн. Сотрудник Anthropic предложил Claude сделать реальную попытку доказательства. В итоге модель не решила саму гипотезу, но неожиданно получила продвижение в смежной области.
Claude улучшила оценку с 41,6% до 67,2%. Речь идет о доле нулей дзета-функции Римана, которые удовлетворяют условиям гипотезы. Такой результат проверили два математика Anthropic, а также сторонние специалисты Брайан Конри и Дэн Голдстон. Это важно, потому что речь идет не о простом ответе модели в чате, а о работе, которую дополнительно оценивали эксперты.
Процесс был крайне ресурсоемким. Работа заняла две сессии в Claude Code и потребовала 31 млн выходных токенов. Сначала модель предложила и проверила 650 идей, но ни одна из них не дала результата. Затем Claude почти двое суток координировала около 60 субагентов, которые выполнили 2400 команд в терминале и написали сотни Python-скриптов для проверки подходов на известных нулях дзета-функции.
Anthropic подчеркивает, что полученный метод, скорее всего, не приведет к доказательству гипотезы Римана. Поэтому новость не стоит воспринимать как решение знаменитой задачи. Гораздо важнее другой вывод: современные ИИ-модели уже способны вести длительную исследовательскую работу, перебирать гипотезы, писать код, проверять вычисления и находить нетривиальные улучшения в сложных математических задачах.
Для науки это может стать важным направлением применения ИИ. Такие системы пока не заменяют математиков, но могут помогать искать идеи, проверять варианты, автоматизировать вычисления и находить неожиданные связи в уже известных исследованиях. При этом любые результаты ИИ в математике все равно требуют строгой проверки людьми, потому что ошибка в доказательстве или вычислении может выглядеть убедительно, но не иметь научной ценности.
Главный вывод простой: Claude не доказала гипотезу Римана, но улучшила связанную с ней математическую оценку с 41,6% до 67,2%. Результат проверили эксперты, а сама работа показала, что агентные ИИ-системы становятся все более полезными в сложных исследовательских задачах, где нужно долго проверять идеи, писать код и анализировать промежуточные результаты.