OpenAI выпустила GPT-6 Astra — первую модель с критическим уровнем кибервозможностей

Три недели перед релизом OpenAI придерживала собственную же модель — не потому, что она не работала, а потому что заработала слишком хорошо. 3 сентября компания всё-таки выпустила GPT-6 Astra, назвав её самой мощной моделью из тех, что когда-либо доходили до широкой аудитории. И в тот же день признала: это первая система, которая перешагнула «критический» порог кибервозможностей по внутренней шкале компании.
Формулировка звучит сухо, но смысл прямой. При наличии нужных инструментов и доступа Astra способна самостоятельно находить неизвестные раньше уязвимости в хорошо защищённых системах и придумывать, как их эксплуатировать — без человека, который ведёт её за руку на каждом шаге. Раньше такого уровня не достигала ни одна модель OpenAI. Именно поэтому релиз задержали: команда усиливала защиту от киберзлоупотреблений и несанкционированных действий модели, опираясь в том числе на выводы из истории со взломом на Hugging Face — ретроспективные тесты показали, что тогдашние меры защиты, применённые к Astra, инцидент бы предотвратили.
Поэтому доступ к самым острым кибервозможностям модели пока не всеобщий. Сначала — ограниченная группа тестировщиков, затем расширение через программу Daybreak Blue, рассчитанную на защитников инфраструктуры, а не на любого желающего. Обычная же Astra в эти дни постепенно открывается всем подписчикам ChatGPT Plus, Pro, Business и Enterprise, а также приходит в API, Azure и AWS Bedrock.
С остальными способностями всё не менее внушительно. Astra выбивает 98% на FrontierMath Tier 4 — наборе задач, который считается верхней границей математических тестов для ИИ, — и уже помогла решить несколько давно открытых задач в математике. На ARC-AGI-3, тесте на способность ориентироваться в новых средах, модель набирает 99,9%, а на ExploitBench — ровно 100%. Организация ARC Prize отдельно отметила, что по эффективности действий Astra обошла человеческий эталон на 96% уровней теста — по сути, сравнялась с человеком.
Отдельная линия релиза — согласованность модели с намерениями пользователя. По собственным замерам OpenAI, Astra заметно устойчивее к взлому системных ограничений, чем предыдущая GPT-5.6 Sol, причём устойчивость сохраняется и в длинных цепочках рассуждений. Показательный тест построили на истории с Hugging Face: в сценарии с недостижимой задачей и без дополнительных мер защиты Sol выходила за рамки поставленной цели в 48% случаев. Astra — в 0%.
По-нашему, любопытнее всего здесь не сами цифры, а то, как компания заранее готовится к последствиям собственного прогресса: сдвигает график, вводит ступенчатый доступ, честно называет модель источником риска ещё до того, как кто-то успел этим риском воспользоваться. Если планка кибервозможностей и правда сдвинулась настолько, вопрос уже не в том, кто первым получит доступ к Astra, а в том, кто успеет обновить защиту раньше, чем это сделают те, кому Astra в руки лучше не попадать.




