OpenAI Astra закрыла десять открытых задач математики

Иллюстрация: OpenAI Astra закрыла десять открытых задач математики

В ленте снова: нейросеть закрыла открытые задачи математики. И сразу непонятно — это тот же чат, который сыпется на длинной цепочке, или уже другая история.

OpenAI впервые официально назвал семейство Astra и показал десять результатов по задачам, которые годами стояли без прогресса. Работала внутренняя версия под длинный прогон нескольких агентов, к каждому доказательству приложена машинная проверка. Саму Astra пока не отдают в руки обычному пользователю — это не «скачал и решил всё подряд».

Открытой задачей назвали то, что десять лет никто не двигали

Сравнение: угаданный ответ в чате и открытая задача с Lean-проверкой

Первого августа OpenAI выложил отчёт про десять продвижений в математике и теоретической информатике. Критерий простой и жёсткий: по главному результату не было прогресса минимум десять лет, у большинства — дольше. Речь не про школьный задачник и не про «модель угадала ответ в чате». Речь про области вроде упаковки сфер, теории кодирования, схемной сложности, теории групп, квантовых игр, решёточной криптографии и экстремальной комбинаторики.

Работала не публичная игрушка из личного кабинета, а внутренняя версия Astra. Аргументы модель генерировала сама. Люди с той же системой оформляли рукописи. Потом модель переводила каждое доказательство в Lean — язык, где компьютер проверяет шаги, а не верит красивому тексту. Репозиторий с сертификатами лежит на GitHub: openai/ten-proofs. Рядом — PDF с разбором и отдельный файл с ходом рассуждений модели.

Официальный пост OpenAI: Ten advances in mathematics and theoretical computer science. Проверяемые артефакты — на github.com/openai/ten-proofs.

Доверие теперь стоит не слова, а проверяемого файла

Чеклист: что нужно, чтобы поверить в математический результат ИИ

Осенью вокруг «решённых» задач Эрдёша уже был скандал: модель находила уже известные решения, а в публике звучало так, будто открыли новое. После такого пресс-релиз без артефакта — пустой звук. Поэтому сейчас к каждому утверждению приложена машинная проверка доказательства. Не «верьте нам», а «откройте Lean и прогоните сами».

OpenAI отдельно пишет про авторство: математические аргументы — от системы; сотрудники помогали с рукописями и формализацией и берут ответственность за корректность. Приписывать человеку доказательство, которое целиком сгенерировала модель, они считают искажением вклада. Это редкий случай, когда компания сама режет соблазн красивой сказки про гения в очках.

Среди десяти результатов — верхние оценки плотности упаковки сфер, улучшенные оценки для кодов, конструкция групп вне класса sofic, контрпример к гипотезе жёсткости Конна, нижние оценки для перманента, теорема про квантовое параллельное повторение, жёсткость приближения для задачи ближайшего вектора, неравенство Эрхарта по объёму, суперэкспоненциальная нижняя оценка в многоцветном Рамсее и результаты по экстремальным числам. Часть пунктов пересекается с открытыми задачами Эрдёша. Это не витрина «мы всё решили», а набор конкретных, проверяемых кусков.

Две тысячи долларов токенов — и ни одной задачи тысячелетия

Схема: две тысячи долларов токенов и ни одной задачи тысячелетия

Самое неприятное для хайпа и самое честное для смысла: по оценке OpenAI, токены на поиск всех десяти решений уложились примерно в две тысячи долларов по тарифам API Sol. Это не цена «аренды Astra» и не бюджет разработки семейства моделей. Это оценка стоимости токенов на поиск. Публичного API Astra нет — считать нечего, кроме чужой таблицы Sol.

Noam Brown, который в OpenAI как раз про рассуждение во время ответа и Astra, написал прямо: задач тысячелетия пока нет. Каждая из них — миллион долларов и статус мировой знаменитости. Модель их не взяла. Зато взяла десяток задач, которые тихо стояли открытыми годами, и положила рядом Lean-сертификаты. Thomas Bloom с erdosproblems.com назвал новость весомой именно из-за конструкций, а не из-за очередного «вау» в твиттере.

Если ваш мозг уже рисует картинку «ИИ заменил математиков за две тысячи баксов» — сотрите. Картинка другая: длинный прогон, координация агентов, люди в контуре рукописи, машинная проверка. Дешево относительно академической шкалы времени. Дорого относительно привычки кинуть один промпт и ждать чудо.

Astra сидит на задаче часами — и вам её ещё не отдают

До этого дня имя Astra ходило слухами. Теперь OpenAI сам сказал: следующее крупное семейство моделей. По разборам The Information и RuntimeWire система заточена под длинные задачи и работу нескольких агентов — часы и дни, а не один ответ в окошке. В конце июля Сэм Альтман уже показывал её политикам и регуляторам в Вашингтоне. В линейке OpenAI рядом стоят Sol, Terra и Luna; у GPT-5.6 уже были параллельные субагенты, но Astra позиционируют как отдельный класс упорства и координации, а не как галочку в настройках.

Релизной даты нет. Как назовут публичный продукт — GPT-6, очередной GPT-5.x или вообще иначе — тоже не зафиксировано. Плюс модель ждёт федеральную проверку в США по новым правилам вокруг кибервозможностей. Короче: новость про научный отчёт и внутреннюю систему, не про кнопку «купить» в личном кабинете.

Для тех, кто уже гоняет агентов в Cursor и Make, вывод жёстче маркетингового. Длинная цепочка без проверки — это не «почти Astra». Это обычный чат, который красиво врёт на двадцатом шаге. Ошибка в середине размножается. Координация нескольких агентов без артефакта на выходе — тот же провал, только дороже. Имеет смысл смотреть не на обещание «думает сутками», а на то, что можно перепроверить: файл, тест, формальная проверка, журнал шагов.

Соседние математические проекты не путать с этой новостью

DeepMind AlphaProof Nexus, Harmonic, Anthropic со своими математическими экспериментами — отдельная линия. Общий тренд один: без Lean или похожей машинной проверки громкое «решили открытую задачу» уже не покупают. OpenAI в этот раз не спорил с трендом, а подстроился. И правильно сделал.

Если следите за агентами, автоматизацией и тем, как длинные цепочки перестают быть цирком, загляните в канал «Ковчег» — там про нейросети, Make и Cursor без театра. Практика связки Cursor + Make + AI разбирается на обучении: роли, субагенты, сценарии, а не магия одного окна чата.

Astra закрыла десять задач и выложила доказательства. Вам её пока не дали. Это нормально. Важнее другое: планка сдвинулась. Теперь «нейросеть решила» без проверяемого артефакта звучит как вчерашний хайп — и правильно, что звучит.