Добавить в корзинуПозвонить
Найти в Дзене

Claude сдвинул гипотезу Римана на 25 пунктов — математика не верит

Anthropic собрал 60 субагентов Claude Code и за полтора дня сдвинул нижнюю границу нулей дзета-функции с 41,6% до 67,2%. Математики двигали её 37 лет — и сдвинули меньше чем на один пункт. Модель, кстати, сомневалась в успехе. Пришлось подбадривать фразами keep going и believe in yourself — причём подбадривал не математик. Сотрудник Anthropic Джаред Самнер, не математик, как-то предложил Claude «серьёзно попытаться» решить гипотезу Римана. Проблема открыта с 1859 года, за её решение Clay Mathematics Institute обещает миллион долларов. Премия висит в воздухе уже четверть века, а нули этой функции, той самой, которую математики ищут как клад уже полтора века, упорно не хотят выстраиваться в строй. Claude попробовал. Сгенерировал около 650 идей подхода — и все провалились. На этом месте обычный чат-бот сказал бы «извините, задача слишком сложная». Но Самнер сказал keep going — и Claude собрал целую команду. Вместо того чтобы биться в одиночку, Claude скоординировал около 60 субагентов. Ка
Оглавление

Anthropic собрал 60 субагентов Claude Code и за полтора дня сдвинул нижнюю границу нулей дзета-функции с 41,6% до 67,2%. Математики двигали её 37 лет — и сдвинули меньше чем на один пункт.

Модель, кстати, сомневалась в успехе. Пришлось подбадривать фразами keep going и believe in yourself — причём подбадривал не математик.

Задача на миллион — и стажёр без матана

Сотрудник Anthropic Джаред Самнер, не математик, как-то предложил Claude «серьёзно попытаться» решить гипотезу Римана. Проблема открыта с 1859 года, за её решение Clay Mathematics Institute обещает миллион долларов. Премия висит в воздухе уже четверть века, а нули этой функции, той самой, которую математики ищут как клад уже полтора века, упорно не хотят выстраиваться в строй.

Claude попробовал. Сгенерировал около 650 идей подхода — и все провалились.

На этом месте обычный чат-бот сказал бы «извините, задача слишком сложная». Но Самнер сказал keep going — и Claude собрал целую команду.

60 цифровых субагентов, 2400 команд, один результат

Вместо того чтобы биться в одиночку, Claude скоординировал около 60 субагентов. Каждый копал свою траншею: полтора дня, 2400 команд, сотни Python-скриптов, тысячи численных проверок.

30 субагентов попробовали и не вышло. 13 дали полезные идеи. Двое развили ключевые ходы. Ещё 13 работали валидаторами, проверяя чужие результаты.

Из 60 нашёлся тот самый путь. Представь сотню стажёров-джонов: каждый крутит свой кубик Рубика, большинство фейлится, но один случайно собирает грань за гранью. Только стажёры не уходят в обед и не жалуются на скучную задачу.

Ход, который пропустили математики — и нашёл Claude

Ключевой ход — Claude объединил работы четырёх математиков, развивавших способы искать закономерности в расположении нулей ещё в 70-х, с результатом Enrico Bombieri 2000 года. До Claude эту комбинацию никто не пробовал.

Звучит как состав сборной мира по математике, только без супергеройских плащей.

Модель проанализировала всё пространство функций целиком, не разделяя на положительные и отрицательные определённые части. Не изобрела новый метод, скомпоновала известное так, как люди не догадались.

Код выложили на языке для доказательства теорем. Математика воспроизводима. Два математика внутри компании проверили, внешние эксперты Brian Conrey и Dan Goldston просмотрели в экстренном порядке. А потом Claude сам инициировал перекрёстную проверку: субагенты скачали 54 статьи с arXiv, искали контрпримеры и независимо вывели тот же результат.

67,2% — много это или мало

Нижняя граница доли нулей на критической линии: с 41,6% до 67,2%. Это +25,6 процентных пунктов, крупнейший сдвиг в аналитической теории чисел за последние десятилетия.

Гипотеза Римана при этом не доказана. 67,2% — нижняя оценка, а не «67 процентов решения». Оставшиеся 32,8% нулей не классифицированы, теорема их просто не покрывает. Метод упирается в потолок ~68,2% при текущем уровне данных. Для движения к 70% нужны новые математические результаты, а не ещё миллион токенов.

Модель, которая это сделала, нерелизная исследовательская версия. Весов нет, чекпоинта нет, повторить AI-поиск невозможно. Математика и код публичны, воспроизводимо. А вот как именно Claude нашёл эту комбинацию — чёрный ящик. Как стажёр, который нашёл формулу, но объяснить не может: «ну я как-то так подумал».

Агентная архитектура: 67% за полтора дня

На competition math GPT-5.4 впереди. На чистой арифметике Gemini Flash Lite дешевле и точнее. Но для research-задач, где нужно координировать десятки субагентов, держать длинные reasoning chains и перебирать тысячи гипотез — агентная архитектура Claude сейчас вне конкуренции. Claude Fable 5 лидирует на agentic tool-use (78% задач без человеческого вмешательства против 71% у GPT-5.5).

Именно Claude Code с его мульти-агентной системой позволил 60 субагентам работать параллельно полтора дня. Ни GPT, ни Gemini сейчас так не умеют.

Разворачиваю мульти-агентные системы под задачи бизнеса — если нужен свой Claude Code для рабочих процессов, напиши в телеграме @dmitra_ai или ВКонтакте, обсудим.

Самое забавное: Claude сам не верил, что справится. Anthropic пишет, что модель была скептична: «возможно, потому что из обучения узнала о сложности открытых проблем и ограничениях AI». Помогли только уговоры не-математика. Модель, которая недооценивает собственные способности, по совету человека, который не разбирается в предмете, сдвигает результат в чистой математике сильнее, чем всё математическое сообщество за 37 лет. Если это не метафора про корпоративную среду — то что тогда.