Вечером 2 сентября 2026 года в Responses API OpenAI нашли странность: запрос к модели gpt-6-astra возвращает 404 Not Found, а не 400 Bad Request, как любое выдуманное имя. Разница между этими кодами — единственный технически проверяемый сигнал о GPT-6 на сегодня. Ниже: как воспроизвести пробу самому, что она доказывает и чего не доказывает, что OpenAI действительно подтвердила про Astra и как подготовить интеграцию, чтобы релиз стоил одной правки конфига.
404 против 400: что именно нашли
Проба воспроизводится за одну команду — нужен только свой ключ OpenAI:
# существующая, но недоступная модель → 404
curl -s -o /dev/null -w '%{http_code}\n' https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-6-astra","input":"ping"}'
# заведомо несуществующий слаг → 400
curl -s -o /dev/null -w '%{http_code}\n' https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-7-qwerty","input":"ping"}'Логика такая. 400 — ответ валидатора: строка не похожа ни на что из каталога, запрос отбракован до маршрутизации. 404 — ответ маршрутизатора: имя разобрано, модель в реестре найдена, но конкретно этому ключу она недоступна. Так себя ведут внутренние и закрытые модели — по сообщениям тех же наблюдателей, 404 отдаёт и 5.6 Cyber, о существовании которой известно.
Отдельно наблюдатели сообщают о втором засветившемся идентификаторе — gpt-6-astra-aeon, который читают как отдельный тир для долгих многошаговых задач. Официального подтверждения у него нет, в отличие от самой связки кодов ответа, которую может проверить любой владелец ключа.
Что проба доказывает: строка gpt-6-astra известна бекенду OpenAI. Что она не доказывает: ни дату релиза, ни финальное имя продукта, ни то, что модель вообще выйдет под этим слагом. 404 объясняется и правами доступа, и конфигурацией деплоя, и внутренним алиасом, который никогда не станет публичным. Это сигнал стадирования, а не анонс.
Что OpenAI подтвердила официально
Здесь фактура жёстче, потому что это публикации самой компании.
1 августа 2026. В посте Ten advances in mathematics and theoretical computer science OpenAI впервые называет Astra «our next major model». Внутренняя версия закрыла десять открытых задач, каждая нерешённая минимум десять лет: высокоразмерная геометрия, теория кодирования, сложность арифметических схем, теория групп, операторные алгебры, квантовая сложность, решёточная криптография, экстремальная комбинаторика. Заголовок результата — первая явная конструкция несофической группы, вопрос стоял открытым с 1999 года. Доказательства выпущены с машинно-проверяемыми сертификатами на Lean: 249 страниц, токенов примерно на $2000 по тарифам GPT-5.6 Sol.
7 августа 2026. OpenAI притормозила релиз и поставила часть работ на паузу — из-за кибербезопасности.
1 сентября 2026. Пост Path to Astra: critical capabilities and frontier safeguards: Astra — первая модель компании, перешагнувшая порог Critical по кибербезопасности в Preparedness Framework. Порог формулируется как способность самостоятельно находить и эксплуатировать zero-day в хорошо защищённых системах или провести полную атаку на укреплённую цель по одной общей инструкции. Что показали в тестах:
- идеальный результат на ExploitBench — бенчмарке превращения известных уязвимостей в рабочие эксплойты;
- на укреплённом браузере модель нашла ранее неизвестные уязвимости и собрала цепочку с выходом из песочницы и выполнением команд на хосте;
- в укреплённой ОС — цепочка локального повышения привилегий от непривилегированного пользователя до root.
Отсюда и режим выпуска. Продвинутые кибервозможности не входят в дефолтную конфигурацию: доступ к ним идёт через программу Daybreak Blue для проверенных специалистов по защите, с дополнительным мониторингом цепочки рассуждений и урезанными ответами для аккаунтов с повышенным риском. Формулировка про сроки — «plan to make Astra available soon», без даты.
Контекст отрасли: Anthropic ровно так же ограничила Claude Mythos 5.1 узким кругом проверенных организаций, выпустив рядом общедоступную Fable 5.1. Разделение «общая модель в проде, опасный тир по заявке» становится нормой, а не разовым решением OpenAI.

Чего OpenAI не сказала
| Параметр | Статус |
|---|---|
| Название GPT-6 | не подтверждено; официально модель зовут Astra |
| Дата релиза | не объявлена, только «soon» |
| Цена | не объявлена |
| Контекстное окно | не объявлено |
| Таблица бенчмарков | не публиковалась |
| Идентификатор в API | в публичном каталоге отсутствует |
Всё остальное, что ходит по статьям, — вывод, а не заявление: и «10 триллионов параметров MoE», и «мультиагентная координация нативно с претрейна». Внутренние кодовые имена из утечек — mewfour и mozaik-alpha-fdm. По утечкам 29–30 августа модель прогоняли zero-shot на максимальном уровне усилий, и показательные примеры съедали около 56 тысяч токенов за ~38 минут рассуждений на запрос. Для планирования это важнее, чем размер модели: такой режим не встраивается в синхронный HTTP-запрос.
Как подготовить код сегодня
Готовиться нужно не к новому имени в конфиге — это тривиально, — а к режиму работы, в котором один ответ считается десятки минут. Через GPTunneL API OpenAI-совместимый, поэтому сам переезд на любую новую модель это одно поле:
curl https://gptunnel.ru/v1/chat/completions \
-H "Authorization: <ВАШ_API_КЛЮЧ>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-sol",
"reasoning_effort": "high",
"messages": [{"role": "user", "content": "Привет!"}]
}'Глубину рассуждений шлюз принимает в reasoning_effort — и это то поле, которое стоит вынести в параметр функции вместе с именем модели. Разница между low и high на счёте видна сразу, а на сорокаминутных прогонах разрыв будет кратно больше, чем сегодня.
Второе, что стоит сделать заранее, — перевести долгие вызовы на стриминг. Синхронный запрос без стрима переживает балансировщик и прокси ровно до первого таймаута, а стриминг держит соединение и даёт остановиться по бюджету, а не по обрыву:
const BUDGET_MS = 15 * 60 * 1000;
export async function askStreaming(messages, onDelta) {
const res = await fetch("https://gptunnel.ru/v1/chat/completions", {
method: "POST",
headers: {
Authorization: process.env.GPTUNNEL_API_KEY,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: process.env.MODEL_SMART ?? "gpt-5.6-sol",
reasoning_effort: process.env.MODEL_EFFORT ?? "medium",
stream: true,
messages,
}),
signal: AbortSignal.timeout(BUDGET_MS),
});
const decoder = new TextDecoder();
let buffer = "";
for await (const chunk of res.body) {
buffer += decoder.decode(chunk, { stream: true });
const lines = buffer.split("\n");
buffer = lines.pop();
for (const line of lines) {
const s = line.trim();
if (!s || s.startsWith(":")) continue; // keepalive шлюза, не данные
if (s === "data: [DONE]") return;
if (!s.startsWith("data: ")) continue;
const delta = JSON.parse(s.slice(6)).choices[0].delta.content;
if (delta) onDelta(delta);
}
}
}Строки, начинающиеся с двоеточия, — служебные keepalive-комментарии шлюза (: HELLO, : PROCESSING) до первого чанка данных; наивный парсер на них падает, мы разбирали это отдельно. На модели, которая думает 38 минут, таких строк будет много.
Когда Astra станет доступной, переезд сведётся к MODEL_SMART=<новый id> в окружении и прогону своего набора из 20–50 реальных запросов — при условии, что транспорт к тому моменту уже умеет ждать.
Что сломается при переезде на Astra
Список собран по тому, что уже известно про режим работы модели, а не по слухам о её «уме».
- Пользовательский сценарий. Стриминг спасает соединение, но не спасает интерфейс: ждать сорок минут у прогресс-бара никто не будет. Если продукт синхронный, к релизу нужны очередь, идентификатор задачи и уведомление о готовности — это работа не на вечер.
- Счёт за рассуждения. 56 тысяч токенов на один ответ — нормальная цена максимального уровня усилий. Считай
usageпо каждому вызову уже сейчас, иначе первый же месяц на новой модели будет сюрпризом. - Урезанные ответы. Часть запросов из области безопасности модель откажется выполнять в дефолтной конфигурации, и это штатное поведение, а не сбой. Пайплайн должен корректно обрабатывать отказ, а не считать его ошибкой сети и уходить в ретрай.
- Формат tool calls. Число и порядок вызовов инструментов в агентном цикле меняются между поколениями. Парсер, завязанный на «ровно один вызов за шаг», упадёт.
- Цена и роутинг. Флагман поверх текущей линейки почти наверняка будет дороже Sol. Развилку «простое — в дешёвую модель, сложное — в тяжёлую» стоит выстроить до релиза, а не после первого счёта.
Полная спецификация запросов, стриминга и лимитов — в документации и на docs.gptunnel.ru.
Что использовать сейчас
Astra недоступна никому, кроме тестировщиков OpenAI, поэтому рабочая линейка на сегодня — семейство 5.6, и оно уже в GPTunneL с контекстом 1M:
- GPT-5.6 Sol — текущий флагман под код, исследования и агентные циклы: 1 ₽ за 1K входных токенов и 6 ₽ за 1K выходных. Что она умеет — в отдельном разборе, про режим ускоренной выдачи — здесь.
- GPT-5.6 Terra — средний тир: 0,4 ₽ и 2,4 ₽ за 1K.
- GPT-5.6 Luna — дешёвая рабочая лошадка под массовую нагрузку: 0,04 ₽ и 0,24 ₽ за 1K.
Все три доступны без VPN, с оплатой российскими картами в рублях и без подписки — платишь только за токены. Актуальные цифры по всем моделям — на странице цен. Рядом в том же API Claude, Gemini и Grok, так что eval можно прогнать по всем кандидатам одним ключом.
Частые вопросы о GPT-6 Astra
Когда выйдет GPT-6? Дата не объявлена. OpenAI сказала «soon» 1 сентября 2026 года. Поведение API 2–3 сентября показывает, что модель прописана в реестре, но это не расписание релиза.
GPT-6 и Astra — это одно и то же? Официально нет. OpenAI называет модель Astra и ни разу не назвала её GPT-6. «GPT-6 Astra» — журналистское сокращение, подкреплённое разве что слагом gpt-6-astra в API.
Можно ли уже попробовать GPT-6 Astra? Нет. Идентификатор не вызывается, публичного доступа нет. Всё, что сегодня предлагает «доступ к GPT-6», — не GPT-6. Наш разбор ранних инсайдов о GPT-6 остаётся в силе по части слухов.
Что означает 404 на gpt-6-astra? Что имя разобрано и найдено в реестре моделей, но недоступно ключу. Несуществующие имена отбраковываются раньше и дают 400.
Почему релиз тормозили? Astra первой перешагнула порог Critical по кибербезопасности: находит и эксплуатирует ранее неизвестные уязвимости без пошаговых подсказок. До релиза потребовались дополнительные меры защиты.
Что сейчас самая сильная модель OpenAI? Из доступных — GPT-5.6 Sol.
Итог
Проверяемых фактов ровно три: Astra решила десять открытых математических задач с проверяемыми на Lean доказательствами, она первой получила уровень Critical по кибербезопасности, и её идентификатор уже прописан в API OpenAI. Даты нет, имени GPT-6 официально нет, цены нет.
Гадать про дату бессмысленно, а вот транспорт под многоминутные ответы понадобится в любом случае — и под Astra, и под всё, что выйдет после неё. Открой GPT-5.6 Sol в GPTunneL и прогони свой сценарий тем же ключом, которым потом вызовешь Astra.



