Создатель bun Джаред Самнер просто попросил исследовательскую версию Claude доказать гипотезу Римана. Нейросеть не смогла решить эту проблему целиком, но выдала мощный побочный результат. За 54 часа работы она математически доказала, что как минимум 67% нулей дзета-функции лежат на критической линии. Предыдущий подтвержденный рекорд составлял всего 41,6%.
Процесс автономной работы ИИ подробно разобран в официальном отчете, который модель сгенерировала самостоятельно без редактуры со стороны людей. Базовая нейросеть выступила в роли координатора. Она не искала ответы в интернете, а последовательно запустила около 60 субагентов, выдавая им узкие задачи и отправные точки. Если один из субагентов заявлял о найденном доказательстве, координатор генерировал враждебных рецензентов — отдельных агентов, единственной целью которых было найти ошибку в вычислениях.
Самая показательная деталь скрывается во входящих промптах от человека. На протяжении двух дней Самнер не давал модели никаких математических подсказок. Он поддерживал непрерывную работу системы короткими сообщениями в духе keep going и believe in yourself. В итоге мы получили прецедент, когда языковая модель сама организовала научную кампанию, отбраковала десятки тупиковых теорий и сдвинула фундаментальную математику вперед!
Поделиться:
Архитектура контекста: почему промпт-инжиниринга больше недостаточно для ИИ-агентов
Meta выпустила мультимодальную модель Muse Glimmer 30B с фокусом на локальный запуск