Claude улучшил оценку доли нулей дзета-функции для гипотезы Римана
Один из сотрудников, больше ради эксперимента, попросил неопубликованную исследовательскую версию Claude «серьезно взяться» за гипотезу Римана. Гипотезу модель, конечно, не доказала, но внезапно получила достаточно сильный результат: увеличила нижнюю границу доли нулей дзета-функции Римана, лежащих на критической прямой, с 41.6% до 67.2%.
Для понимания масштаба: до этого за 46 лет, с 1974 по 2020 год, граница сдвинулась всего лишь с 33.3% до 41.6%, и это была работа десятков математиков. Claude за один раз преодолел скачок в три раза больше.
Работа заняла две сессии в Claude Code, ~31 млн выходных токенов. Сначала модель перепробовала 600+ идей, но ни одна не привела к результату.
Затем юзер написал что-то типа «давай еще раз, верь в себя», и это, представляете, сработало (✨): модель полтора дня координировала ~60 субагентов, которые гоняли тысячи скриптов и тестов. В итоге улучшенная оценка получилась благодаря объединению идей из недавних работ с результатами из статьи 2000 года.
Peer review еще нет, но есть Lean + доказательство проверили два математика Anthropic и два внешних эксперта.
https://www.anthropic.com/research/riemann-zeta
Один из сотрудников, больше ради эксперимента, попросил неопубликованную исследовательскую версию Claude «серьезно взяться» за гипотезу Римана. Гипотезу модель, конечно, не доказала, но внезапно получила достаточно сильный результат: увеличила нижнюю границу доли нулей дзета-функции Римана, лежащих на критической прямой, с 41.6% до 67.2%.
Для понимания масштаба: до этого за 46 лет, с 1974 по 2020 год, граница сдвинулась всего лишь с 33.3% до 41.6%, и это была работа десятков математиков. Claude за один раз преодолел скачок в три раза больше.
Работа заняла две сессии в Claude Code, ~31 млн выходных токенов. Сначала модель перепробовала 600+ идей, но ни одна не привела к результату.
Затем юзер написал что-то типа «давай еще раз, верь в себя», и это, представляете, сработало (✨): модель полтора дня координировала ~60 субагентов, которые гоняли тысячи скриптов и тестов. В итоге улучшенная оценка получилась благодаря объединению идей из недавних работ с результатами из статьи 2000 года.
Peer review еще нет, но есть Lean + доказательство проверили два математика Anthropic и два внешних эксперта.
https://www.anthropic.com/research/riemann-zeta