Запуск GPT-6 начался не с презентации, а с ошибки 500. В четверг после обеда почти одновременно легли ChatGPT, Claude, Grok и Gemini — четыре главных чат-бота планеты разом. Теории заговора родились примерно за десять минут, что, вообще-то, тоже своего рода бенчмарк человеческих способностей.
Через несколько часов OpenAI выкатила GPT-6 Astra, а президент компании Грег Брокман закончил презентацию словами: «Добро пожаловать в эру AGI».
Разберёмся, что там внутри и насколько уместен пафос.
Что это за модель
Astra — новое флагманское поколение, заточенное под автономную работу над длинными многошаговыми задачами. Акцент сделан на программировании, исследованиях и работе с инструментами: модель должна не отвечать на вопрос, а сама пройти цепочку из десятков действий и принести результат. Она спроектирована для прямого управления программным обеспечением без пошаговых команд человека.
Обучали её на крупнейшем в истории компании дата-центре, с использованием более ста тысяч графических процессоров. И это первая модель OpenAI, в обучении и контроле которой ключевую роль играли другие ИИ-системы. Формулировка проходная, но по сути это довольно серьёзный рубеж: машины теперь заметно участвуют в производстве следующих машин.
Цифры, которые действительно впечатляют
Главный результат, вокруг которого крутится всё обсуждение, — тест SRE-Bench на обратную разработку бинарных файлов. Astra решила 88% задач с первой попытки и 99,2% за четыре попытки. Предыдущий флагман, GPT-5.6 Sol, выпущенный всего в июле, показывал 55,9% и 68,7%.
Чтобы почувствовать масштаб: обратная разработка бинарника — это когда у вас есть скомпилированная программа без исходного кода, и надо понять, что она делает и как устроена. Работа, на которую квалифицированный специалист по безопасности тратит часы или дни. Скачок с 56% до 88% за два месяца — это не улучшение, это смена характера задачи.
Именно поэтому OpenAI впервые отнесла свою модель к критическому уровню киберспособностей по внутренней шкале рисков. И честно предупредила: защитные механизмы будут тормозить и вполне законные задачи тоже. В релизной версии Astra отказывается собирать эксплойты даже в демонстрационных целях.
Любопытно, что несколькими днями раньше Anthropic, выпуская Claude Fable 5.1, ввела примерно такие же ограничения на работу с уязвимостями. Два главных конкурента независимо пришли к одному выводу в один и тот же месяц, и это, пожалуй, более значимая новость, чем любая цифра в бенчмарке.
Теперь про AGI
Универсального критерия, по которому Astra можно было бы независимо признать общим искусственным интеллектом, компания не представила. Ни одного. Заявление «welcome to the AGI era» — это позиция маркетинга, а не результат замера.
Эксперты, комментировавшие релиз, сходятся примерно на такой формулировке: модель действительно выглядит очень мощной, тесты это подтверждают, но объявлять смену эпохи преждевременно.
Стоит помнить, что фразу «до общего искусственного интеллекта осталось совсем немного» человечество слышит с завидной регулярностью. В 1965 году Герберт Саймон, будущий нобелевский лауреат, писал, что в течение двадцати лет машины смогут выполнять любую работу, которую делает человек. Двадцать лет прошли, потом ещё сорок, и вот мы здесь. В индустрии есть даже устойчивая шутка про «год Linux на десктопе» — событие, которое наступит непременно, и непременно в следующем году.
Это не значит, что Astra не прорыв. Это значит, что слово AGI сейчас работает как маркер сравнения с конкурентами, а не как техническое утверждение.
Запуск, который пошёл не по плану
Развёртывание оказалось поэтапным: сначала доступ получили ограниченные группы организаций и специалисты по кибербезопасности. Платные подписчики — то есть люди, которые платят за то, чтобы получать новинки первыми, — остались без модели.
Реакция была предсказуемой. Сэм Альтман извинился и пообещал компенсацию. Для компании, чья бизнес-модель держится на подписке, это дорогая ошибка в коммуникации: пользователь прощает баги, но плохо прощает ощущение, что он оплатил чужую презентацию.
Что это значит для русскоязычного разработчика
Три практических вывода.
Первый: разрыв между «понимает код» и «делает работу» сокращается. Модель, которая проходит длинную цепочку действий без надзора, конкурирует не с автодополнением, а с младшим специалистом. Рынок джуниоров в СНГ и без того просел за последние два года, и этот релиз его не оздоровит.
Второй: безопасность становится узким горлышком, а не приятным дополнением. Если флагманская модель официально признана носителем критических киберспособностей, доступ к ней будет обставляться проверками, лимитами и юрисдикционными ограничениями. Для разработчика из региона, где доступ к западным API и так неровный, это ещё один слой трения.
Третий: гонка перешла в режим двухмесячных циклов. GPT-5.6 вышла в июле, GPT-6 — в сентябре. Строить продукт под конкретную модель стало занятием с гарантированным сроком годности. Архитектурный вывод скучный, но верный: абстрагируйте провайдера.
Итог
Astra — сильная модель с честно задокументированными рисками и неловко проведённым запуском. Она заметно продвинулась там, где раньше требовался человек с опытом. Эра AGI при этом наступит тогда, когда кто-нибудь сформулирует, как её измерить, и независимые исследователи с этим согласятся.
Пока что мы имеем эру очень хороших моделей и очень хороших пресс-релизов.
