GPT-6 Astra: когда выйдет и что уже подтвердила OpenAI

GPT-6 Astra: когда выйдет и что уже подтвердила OpenAI

Вечером 2 сентября 2026 года в Responses API OpenAI нашли странность: запрос к модели gpt-6-astra возвращает 404 Not Found, а не 400 Bad Request, как любое выдуманное имя. Разница между этими кодами — единственный технически проверяемый сигнал о GPT-6 на сегодня. Ниже: как воспроизвести пробу самому, что она доказывает и чего не доказывает, что OpenAI действительно подтвердила про Astra и как подготовить интеграцию, чтобы релиз стоил одной правки конфига.

404 против 400: что именно нашли

Проба воспроизводится за одну команду — нужен только свой ключ OpenAI:

bash
# существующая, но недоступная модель → 404
curl -s -o /dev/null -w '%{http_code}\n' https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-6-astra","input":"ping"}'

# заведомо несуществующий слаг → 400
curl -s -o /dev/null -w '%{http_code}\n' https://api.openai.com/v1/responses \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-7-qwerty","input":"ping"}'

Логика такая. 400 — ответ валидатора: строка не похожа ни на что из каталога, запрос отбракован до маршрутизации. 404 — ответ маршрутизатора: имя разобрано, модель в реестре найдена, но конкретно этому ключу она недоступна. Так себя ведут внутренние и закрытые модели — по сообщениям тех же наблюдателей, 404 отдаёт и 5.6 Cyber, о существовании которой известно.

Отдельно наблюдатели сообщают о втором засветившемся идентификаторе — gpt-6-astra-aeon, который читают как отдельный тир для долгих многошаговых задач. Официального подтверждения у него нет, в отличие от самой связки кодов ответа, которую может проверить любой владелец ключа.

Что проба доказывает: строка gpt-6-astra известна бекенду OpenAI. Что она не доказывает: ни дату релиза, ни финальное имя продукта, ни то, что модель вообще выйдет под этим слагом. 404 объясняется и правами доступа, и конфигурацией деплоя, и внутренним алиасом, который никогда не станет публичным. Это сигнал стадирования, а не анонс.

Что OpenAI подтвердила официально

Здесь фактура жёстче, потому что это публикации самой компании.

1 августа 2026. В посте Ten advances in mathematics and theoretical computer science OpenAI впервые называет Astra «our next major model». Внутренняя версия закрыла десять открытых задач, каждая нерешённая минимум десять лет: высокоразмерная геометрия, теория кодирования, сложность арифметических схем, теория групп, операторные алгебры, квантовая сложность, решёточная криптография, экстремальная комбинаторика. Заголовок результата — первая явная конструкция несофической группы, вопрос стоял открытым с 1999 года. Доказательства выпущены с машинно-проверяемыми сертификатами на Lean: 249 страниц, токенов примерно на $2000 по тарифам GPT-5.6 Sol.

7 августа 2026. OpenAI притормозила релиз и поставила часть работ на паузу — из-за кибербезопасности.

1 сентября 2026. Пост Path to Astra: critical capabilities and frontier safeguards: Astra — первая модель компании, перешагнувшая порог Critical по кибербезопасности в Preparedness Framework. Порог формулируется как способность самостоятельно находить и эксплуатировать zero-day в хорошо защищённых системах или провести полную атаку на укреплённую цель по одной общей инструкции. Что показали в тестах:

  • идеальный результат на ExploitBench — бенчмарке превращения известных уязвимостей в рабочие эксплойты;
  • на укреплённом браузере модель нашла ранее неизвестные уязвимости и собрала цепочку с выходом из песочницы и выполнением команд на хосте;
  • в укреплённой ОС — цепочка локального повышения привилегий от непривилегированного пользователя до root.

Отсюда и режим выпуска. Продвинутые кибервозможности не входят в дефолтную конфигурацию: доступ к ним идёт через программу Daybreak Blue для проверенных специалистов по защите, с дополнительным мониторингом цепочки рассуждений и урезанными ответами для аккаунтов с повышенным риском. Формулировка про сроки — «plan to make Astra available soon», без даты.

Контекст отрасли: Anthropic ровно так же ограничила Claude Mythos 5.1 узким кругом проверенных организаций, выпустив рядом общедоступную Fable 5.1. Разделение «общая модель в проде, опасный тир по заявке» становится нормой, а не разовым решением OpenAI.

Схема: конфиг задаёт имя модели, запрос идёт через общий шлюз к трём моделям, третья закрыта замком

Чего OpenAI не сказала

ПараметрСтатус
Название GPT-6не подтверждено; официально модель зовут Astra
Дата релизане объявлена, только «soon»
Ценане объявлена
Контекстное окноне объявлено
Таблица бенчмарковне публиковалась
Идентификатор в APIв публичном каталоге отсутствует

Всё остальное, что ходит по статьям, — вывод, а не заявление: и «10 триллионов параметров MoE», и «мультиагентная координация нативно с претрейна». Внутренние кодовые имена из утечек — mewfour и mozaik-alpha-fdm. По утечкам 29–30 августа модель прогоняли zero-shot на максимальном уровне усилий, и показательные примеры съедали около 56 тысяч токенов за ~38 минут рассуждений на запрос. Для планирования это важнее, чем размер модели: такой режим не встраивается в синхронный HTTP-запрос.

Как подготовить код сегодня

Готовиться нужно не к новому имени в конфиге — это тривиально, — а к режиму работы, в котором один ответ считается десятки минут. Через GPTunneL API OpenAI-совместимый, поэтому сам переезд на любую новую модель это одно поле:

bash
curl https://gptunnel.ru/v1/chat/completions \
  -H "Authorization: <ВАШ_API_КЛЮЧ>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "reasoning_effort": "high",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'

Глубину рассуждений шлюз принимает в reasoning_effort — и это то поле, которое стоит вынести в параметр функции вместе с именем модели. Разница между low и high на счёте видна сразу, а на сорокаминутных прогонах разрыв будет кратно больше, чем сегодня.

Второе, что стоит сделать заранее, — перевести долгие вызовы на стриминг. Синхронный запрос без стрима переживает балансировщик и прокси ровно до первого таймаута, а стриминг держит соединение и даёт остановиться по бюджету, а не по обрыву:

JavaScript
const BUDGET_MS = 15 * 60 * 1000;

export async function askStreaming(messages, onDelta) {
  const res = await fetch("https://gptunnel.ru/v1/chat/completions", {
    method: "POST",
    headers: {
      Authorization: process.env.GPTUNNEL_API_KEY,
      "Content-Type": "application/json",
    },
    body: JSON.stringify({
      model: process.env.MODEL_SMART ?? "gpt-5.6-sol",
      reasoning_effort: process.env.MODEL_EFFORT ?? "medium",
      stream: true,
      messages,
    }),
    signal: AbortSignal.timeout(BUDGET_MS),
  });

  const decoder = new TextDecoder();
  let buffer = "";

  for await (const chunk of res.body) {
    buffer += decoder.decode(chunk, { stream: true });
    const lines = buffer.split("\n");
    buffer = lines.pop();

    for (const line of lines) {
      const s = line.trim();
      if (!s || s.startsWith(":")) continue;    // keepalive шлюза, не данные
      if (s === "data: [DONE]") return;
      if (!s.startsWith("data: ")) continue;
      const delta = JSON.parse(s.slice(6)).choices[0].delta.content;
      if (delta) onDelta(delta);
    }
  }
}

Строки, начинающиеся с двоеточия, — служебные keepalive-комментарии шлюза (: HELLO, : PROCESSING) до первого чанка данных; наивный парсер на них падает, мы разбирали это отдельно. На модели, которая думает 38 минут, таких строк будет много.

Когда Astra станет доступной, переезд сведётся к MODEL_SMART=<новый id> в окружении и прогону своего набора из 20–50 реальных запросов — при условии, что транспорт к тому моменту уже умеет ждать.

Что сломается при переезде на Astra

Список собран по тому, что уже известно про режим работы модели, а не по слухам о её «уме».

  • Пользовательский сценарий. Стриминг спасает соединение, но не спасает интерфейс: ждать сорок минут у прогресс-бара никто не будет. Если продукт синхронный, к релизу нужны очередь, идентификатор задачи и уведомление о готовности — это работа не на вечер.
  • Счёт за рассуждения. 56 тысяч токенов на один ответ — нормальная цена максимального уровня усилий. Считай usage по каждому вызову уже сейчас, иначе первый же месяц на новой модели будет сюрпризом.
  • Урезанные ответы. Часть запросов из области безопасности модель откажется выполнять в дефолтной конфигурации, и это штатное поведение, а не сбой. Пайплайн должен корректно обрабатывать отказ, а не считать его ошибкой сети и уходить в ретрай.
  • Формат tool calls. Число и порядок вызовов инструментов в агентном цикле меняются между поколениями. Парсер, завязанный на «ровно один вызов за шаг», упадёт.
  • Цена и роутинг. Флагман поверх текущей линейки почти наверняка будет дороже Sol. Развилку «простое — в дешёвую модель, сложное — в тяжёлую» стоит выстроить до релиза, а не после первого счёта.

Полная спецификация запросов, стриминга и лимитов — в документации и на docs.gptunnel.ru.

Что использовать сейчас

Astra недоступна никому, кроме тестировщиков OpenAI, поэтому рабочая линейка на сегодня — семейство 5.6, и оно уже в GPTunneL с контекстом 1M:

  • GPT-5.6 Sol — текущий флагман под код, исследования и агентные циклы: 1 ₽ за 1K входных токенов и 6 ₽ за 1K выходных. Что она умеет — в отдельном разборе, про режим ускоренной выдачи — здесь.
  • GPT-5.6 Terra — средний тир: 0,4 ₽ и 2,4 ₽ за 1K.
  • GPT-5.6 Luna — дешёвая рабочая лошадка под массовую нагрузку: 0,04 ₽ и 0,24 ₽ за 1K.

Все три доступны без VPN, с оплатой российскими картами в рублях и без подписки — платишь только за токены. Актуальные цифры по всем моделям — на странице цен. Рядом в том же API Claude, Gemini и Grok, так что eval можно прогнать по всем кандидатам одним ключом.

Частые вопросы о GPT-6 Astra

Когда выйдет GPT-6? Дата не объявлена. OpenAI сказала «soon» 1 сентября 2026 года. Поведение API 2–3 сентября показывает, что модель прописана в реестре, но это не расписание релиза.

GPT-6 и Astra — это одно и то же? Официально нет. OpenAI называет модель Astra и ни разу не назвала её GPT-6. «GPT-6 Astra» — журналистское сокращение, подкреплённое разве что слагом gpt-6-astra в API.

Можно ли уже попробовать GPT-6 Astra? Нет. Идентификатор не вызывается, публичного доступа нет. Всё, что сегодня предлагает «доступ к GPT-6», — не GPT-6. Наш разбор ранних инсайдов о GPT-6 остаётся в силе по части слухов.

Что означает 404 на gpt-6-astra? Что имя разобрано и найдено в реестре моделей, но недоступно ключу. Несуществующие имена отбраковываются раньше и дают 400.

Почему релиз тормозили? Astra первой перешагнула порог Critical по кибербезопасности: находит и эксплуатирует ранее неизвестные уязвимости без пошаговых подсказок. До релиза потребовались дополнительные меры защиты.

Что сейчас самая сильная модель OpenAI? Из доступных — GPT-5.6 Sol.

Итог

Проверяемых фактов ровно три: Astra решила десять открытых математических задач с проверяемыми на Lean доказательствами, она первой получила уровень Critical по кибербезопасности, и её идентификатор уже прописан в API OpenAI. Даты нет, имени GPT-6 официально нет, цены нет.

Гадать про дату бессмысленно, а вот транспорт под многоминутные ответы понадобится в любом случае — и под Astra, и под всё, что выйдет после неё. Открой GPT-5.6 Sol в GPTunneL и прогони свой сценарий тем же ключом, которым потом вызовешь Astra.