/
DeepSeek V4 GA: важные изменения, о которых мы не знали

DeepSeek V4 GA: важные изменения, о которых мы не знали

Cofounder, Editor in Chief
Илья Трикоз
Jul 24, 2026
Время чтения: 3 минуты
DeepSeek V4 GA: факты, слухи и миграция API

DeepSeek V4 GA - хороший пример того, как вокруг реального технического события вырастает лишний шум. Многие ждут "новую модель 24 июля", но официальные документы говорят о другом: DeepSeek V4 уже была выпущена 24 апреля 2026 года, а 24 июля заканчивается жизнь старых API-имен deepseek-chat и deepseek-reasoner.

То есть DeepSeek V4 GA - скорее момент стабилизации и миграции, чем новый фейерверк. Но это не делает событие скучным: V4 остается одной из самых важных open-weight линеек года.

Что подтверждено

В официальном changelog DeepSeek за 24 апреля 2026 года указаны две модели:

  • deepseek-v4-pro;
  • deepseek-v4-flash.

Обе доступны через OpenAI ChatCompletions interface и Anthropic-compatible interface. Старые имена deepseek-chat и deepseek-reasoner во время переходного периода указывали на non-thinking и thinking режимы deepseek-v4-flash, но должны быть прекращены 24 июля 2026 года.

На странице прозрачности DeepSeek V4.0 отмечена как выпущенная 24 апреля 2026 года. В pricing docs указаны 1M context, до 384K max output, JSON output, tool calls, chat prefix completion и FIM completion для non-thinking mode.

V4-Pro и V4-Flash

Логика семейства понятная:

  • V4-Pro - более сильный вариант для сложного reasoning, coding и agentic задач;
  • V4-Flash - быстрый и дешевый вариант для массового production.

Официальная цена на момент проверки:

  • DeepSeek V4-Flash: $0.14 за 1M input cache miss, $0.0028 cache hit, $0.28 output;
  • DeepSeek V4-Pro: $0.435 за 1M input cache miss, $0.003625 cache hit, $0.87 output.

Даже если цены изменятся, порядок важен: DeepSeek продолжает давить рынок не только открытостью, но и агрессивной экономикой.

Что такое GA в этом контексте

Слово GA обычно означает general availability: стабильный релиз для production. Но у DeepSeek в публичных документах вокруг V4 чаще встречается preview/available, а не четкий маркетинговый "GA launch".

Поэтому "DeepSeek V4 GA" лучше читать как community-ярлык для этапа, когда:

  • новые V4 ID уже нужно использовать напрямую;
  • старые alias уходят;
  • цены и лимиты опубликованы;
  • веса и API достаточно зрелые для серьезной оценки;
  • вокруг API замечают возможные checkpoint updates или grayscale rollout.

Это не означает, что 24 июля выходит DeepSeek V5 или новый скрытый флагман.

Слух о grayscale-тесте

В середине июля пользователи начали обсуждать, что ответы deepseek-v4-pro стали заметно лучше при том же model ID. Отсюда родилась теория о "grayscale rollout" - постепенном переключении части трафика на обновленный checkpoint.

Был и более дикий слух: будто DeepSeek тайно маршрутизирует запросы к Anthropic Claude Fable 5. Технических доказательств этому нет. Похожий стиль ответов у сильных моделей не доказывает proxying. Более правдоподобно, что DeepSeek тестирует новый post-training checkpoint, instruction tuning или routing policy.

Пока это не подтверждено официально, корректная формулировка такая: пользователи сообщают об изменении качества, но конкретный механизм неизвестен.

Почему V4 технически важна

DeepSeek V4 интересна не только параметрами. По сторонним техническим разборам и Hugging Face материалам, ключевой сюжет - long-context efficiency: 1M контекст, MoE, гибридное внимание, более удобная работа для агентов.

Для coding agents это критично. Большая часть проблем в долгих задачах - не "модель не знает синтаксис", а контекст и стоимость: repo files, logs, tool output, test failures, intermediate plans. Если модель дешевле держит длинную рабочую память, она становится практичнее.

Еще один плюс - Anthropic-compatible endpoint. Это снижает friction для пользователей Claude Code-подобных инструментов: заменить provider проще, чем переписывать весь harness.

Что делать разработчикам

Если вы еще используете deepseek-chat или deepseek-reasoner, надо мигрировать на V4 ID. Для новых интеграций логика простая:

  • начинать с deepseek-v4-flash;
  • включать thinking там, где нужно;
  • переходить на deepseek-v4-pro, если Flash не держит сложность;
  • отдельно измерять cache hit rate;
  • не бенчмаркать production API во время возможного grayscale rollout без фиксации версии.

И главное: проверять не "красивость ответа", а стоимость успешного workflow.

Мнение

DeepSeek V4 GA - не столько релиз модели, сколько тест зрелости экосистемы DeepSeek. У компании уже есть сильный open-weight narrative, огромный ценовой прессинг и удобные API-форматы. Теперь вопрос в стабильности: версии, миграции, docs, SLA, поведение на длинных задачах.

Если DeepSeek удержит качество и не сломает доверие к версиям, V4 останется одним из главных вариантов для команд, которым нужны большие контексты и низкая цена. Если вокруг "GA" будет слишком много неявных переключений, серьезные пользователи уйдут в self-hosted weights или более предсказуемых провайдеров.

В GPTunneL DeepSeek V4 стоит сравнивать с GLM, Qwen, Gemini Flash и GPT-5.6 не по названию, а по метрике "сколько стоит довести задачу до конца".

Последние публикации
Попробовать в GPTunneL