Содержание
  1. Что такое DeepSeek V4 и чем он отличается от предыдущих версий
  2. Официальная дата выхода и статус релиза
  3. Разница между версиями: V4, V4-Pro, V4-Flash, V4-Lite и V4.1
  4. Где скачать DeepSeek V4 и V4-Flash официально
  5. Как пользоваться DeepSeek V4 и V4-Pro: доступ и регистрация
  6. Официальный сайт и ссылки на API
  7. Бесплатный API-ключ для V4-Flash и V4 Free
  8. Сколько параметров у V4-Flash и её архитектура
  9. Режим thinking у V4-Flash и его отличия
  10. Бенчмарки DeepSeek V4 и сравнение с конкурентами
  11. Новости и слухи о DeepSeek V4
  12. Частые вопросы
Справочник

DeepSeek V4: когда выйдет, что умеет и как пользоваться

18 сентября 2026 · 10 минут чтения

Материал редакции Зерокодера. Счёт по выдаче снят собственным прогоном 18 сентября 2026 года; цитаты источников приведены дословно. Обновлено: сентябрь 2026.

Когда выйдет DeepSeek V4 — вопрос уже закрытый: модель вышла 24 апреля 2026 года в двух версиях, V4-Pro и V4-Flash. Это поколение языковых моделей китайской компании DeepSeek. Обе работают с контекстом в 1 млн токенов, распространяются с открытыми весами и доступны через веб-интерфейс и API. Это первое крупное обновление линейки с начала 2025 года. Медиана объёма читаемого текста топа — 1473 слова. Мы скачали топ-10 Яндекса по запросу «deepseek v4»: текст отдали 7 из 10.

Что такое DeepSeek V4 и чем он отличается от предыдущих версий

DeepSeek стал популярен в конце 2024 года после выхода бесплатной опенсорсной модели V3, которая обошла в тестах конкурентов OpenAI и Google. В январе 2025 года вышла «рассуждающая» открытая модель R1, показавшая сопоставимые результаты с ChatGPT, Gemini и Claude. Поколение V4 продолжает эту линию.

Поколение V4 построено на архитектуре Mixture of Experts. Если в V3 было 256 экспертов на слой, то в V4-Pro их уже 384, но для генерации одного токена активируется лишь 6 из них. Ключевое изменение — увеличение контекста до 1 млн токенов. В DeepSeek позиционируют V4 как шаг к сокращению разрыва между открытыми и закрытыми моделями.

Главная особенность V4 — сочетание масштаба и эффективности. В обзоре на Хабре это сформулировано так: 90% возможностей лучших закрытых моделей — за 5-10% их стоимости, с открытыми весами и возможностью локального запуска. Ограничение тоже названо прямо: нет нативной поддержки изображений, схем, скриншотов. Модель текстовая.

Официальная дата выхода и статус релиза

Релиз состоялся 24 апреля 2026 года. Об этом сообщает Hi-Tech Mail: модели V4-Pro и V4-Flash уже доступны через веб-интерфейс и API. Издание называет это крупнейшим обновлением чат-бота с 2025 года.

Метку 2026 года несут 6 из 7 прочитанных страниц топа — тема актуальна именно для текущего года. Статус релиза — вышедшая модель. В коллекции на Hugging Face перечислены веса: DeepSeek-V4-Flash-Base, DeepSeek-V4-Flash, DeepSeek-V4-Pro-Base, DeepSeek-V4-Pro, а также варианты DSpark, Flash-0731, Pro-0813, Flash-Vision-Exp и V4.1-Flash.

Разница между версиями: V4, V4-Pro, V4-Flash, V4-Lite и V4.1

Официальный релиз и API-документация перечисляют ровно два варианта: V4 Pro (1.6T общих / 49B активных) и V4 Flash (284B общих / 13B активных). Отдельной «базовой» модели рядом с ними нет — это указано в разборе на deepseek.ai.

Старшую, V4-Pro, обучили на 1,6 трлн параметров, но при ответе на запрос активируются только 49 млрд. Младшую, V4-Flash, — на 284 млрд параметров, а при запросе активируются 13 млрд. Обе поддерживают контекст в 1 млн токенов.

Версия Общие параметры Активные параметры Контекст Режимы
V4-Pro 1,6 трлн 49 млрд 1 млн токенов Expert
V4-Flash 284 млрд 13 млрд 1 млн токенов Instant

V4-Flash работает через режим Instant, а V4-Pro — через Expert. V4-Flash — младшая версия V4-Pro: с простыми задачами справляется на том же уровне, но уступает в общих знаниях о мире и сложных агентных задачах.

Про V4-Lite в выжимке источников конкретики нет: название в источниках не встречается. Про V4.1 сырьё говорит: в коллекции на Hugging Face стоит строка «DeepSeek-V4.1-Flash Image-Text-to-Text • 763B • Updated 8 days ago», а на deepseek.com сказано, что «The official version of DeepSeek-V4.1-Flash has been released» — с нативным мультимодальным пониманием изображений.

Где скачать DeepSeek V4 и V4-Flash официально

Веса моделей лежат в коллекции DeepSeek-V4 на Hugging Face. Там перечислены репозитории: DeepSeek-V4-Flash-Base, DeepSeek-V4-Flash, DeepSeek-V4-Pro-Base, DeepSeek-V4-Pro, DeepSeek-V4-Flash-DSpark, DeepSeek-V4-Pro-DSpark, DeepSeek-V4-Flash-0731, DeepSeek-V4-Pro-0813, DeepSeek-V4-Flash-Vision-Exp и DeepSeek-V4.1-Flash.

Обе модели распространяются с открытыми весами под лицензией MIT. Это значит, что скачать их можно для локального запуска. Требования к железу под 1,6 трлн и 284 млрд параметров источники не приводят — для локального развёртывания это существенный фактор, который придётся оценивать отдельно.

Как пользоваться DeepSeek V4 и V4-Pro: доступ и регистрация

Самый быстрый путь — веб-интерфейс. В обзоре на WaveSpeed автор описывает вход так: она вошла через основной сайт и выбрала V4 из списка моделей. Регистрация стандартная для чат-сервисов.

Второй путь — API. Автор того же обзора тестировала модель в январе 2026 года как через веб-чат, так и через API. Для API используется OpenAI-совместимый клиент. В примере на Python запрос строится как обычный вызов chat completions с ролью user и текстом задачи.

Практическая деталь из обзора: температуру держали низкой (около 0.2) при написании спецификаций или комментариев к коду. Когда нужны были альтернативы для формулировок или названий, её поднимали до 0.5. Это предотвращало дрейф V4 и помогало разобраться в том, что действительно нужно. Про форму запроса подробнее — в материале Промпт — что это и как его форма меняет ответ.

Официальный сайт и ссылки на API

Официальный сайт — deepseek.com. Там же расположен вход в веб-чат и документация API. Коллекция весов — на Hugging Face по адресу huggingface.co/collections/deepseek-ai/deepseek-v4.

В обзоре на WaveSpeed отмечено: V4 доступна, но точный идентификатор модели может меняться. Автор советует потратить 30 секунд на проверку актуального идентификатора — это предотвращает будущие головные боли при вызовах API.

Сторонние провайдеры тоже дают доступ. Например, RouterAI публикует страницу DeepSeek V4 Flash 0423 с ценами в рублях и описанием эндпоинтов: Chat Completions, Responses API, Messages API. Доступность конкретных сервисов из РФ источники не подтверждают — этот вопрос стоит проверять на месте.

Бесплатный API-ключ для V4-Flash и V4 Free

В выжимке нет подтверждённой информации о процедуре получения бесплатного API-ключа для V4-Flash или V4 Free. Источники описывают платные тарифы API и бесплатный веб-доступ, но отдельного «free API key» не упоминают.

Что известно точно: веб-интерфейс доступен бесплатно. Hi-Tech Mail пишет, что модели V4-Pro и V4-Flash уже доступны через веб-интерфейс и API. Для API у V4-Flash цены заметно ниже, чем у старшей версии — 0,14 и 0,28 доллара за 1 млн входных и выходных токенов соответственно. Это делает младшую модель самым дешёвым способом работать через программный интерфейс.

Сколько параметров у V4-Flash и её архитектура

V4-Flash — это оптимизированная по эффективности модель Mixture-of-Experts от DeepSeek с общим количеством параметров 284 миллиарда и 13 миллиардами активированных параметров, поддерживающая контекстное окно на 1 миллион токенов. Так её описывает RouterAI.

Обе модели разделяют одну архитектуру, контекст в 1 млн токенов и открытые веса под MIT. Текстовая модальность — общая черта: обе модели text-only. Для сравнения масштаба: у V4-Pro 1,6 трлн общих параметров при 49 млрд активных.

Параметр V4-Flash V4-Pro
Общие параметры 284 млрд 1,6 трлн
Активные параметры 13 млрд 49 млрд
Контекст 1 млн токенов 1 млн токенов
Лицензия весов MIT MIT
Вход, $/1 млн токенов (цены на релиз 24 апреля 2026 года, Hi-Tech Mail) 0,14 1,74
Выход, $/1 млн токенов (цены на релиз 24 апреля 2026 года, Hi-Tech Mail) 0,28 3,48

Цены с тех пор разошлись. В прайсе deepseek.ai с пометкой «DeepSeek rates verified 2026-09-18» вход без попадания в кэш стоит $0,15 у V4-Flash и $0,660 у V4-Pro, выход — $0,60 и $1,98. Для старшей модели это снижение против апрельских 1,74 и 3,48; для младшей — рост против 0,14 и 0,28.

Режим thinking у V4-Flash и его отличия

V4-Pro и V4-Flash могут работать как в «рассуждающем» режиме, так и без него. Это указано в разборе Т—Ж. То есть thinking — переключаемая опция: обычный режим у модели остаётся.

В обычном режиме модель отвечает сразу. В рассуждающем она сначала проговаривает цепочку шагов, а затем выдаёт результат. Для простых задач разница в скорости заметна, для сложных — в качестве. Что именно меняется в потреблении токенов при включённом thinking, источники не уточняют.

Отдельно стоит помнить про контекст. 1 млн токенов — это много, но не бесконечно. Как это работает на практике, разобрано в статье Что такое контекстное окно: сколько влезает и что потом. Про единицы измерения — в материале Токены в ИИ: что это, как считать и почему русский дороже.

Бенчмарки DeepSeek V4 и сравнение с конкурентами

DeepSeek-V4-Pro обходит Claude Opus 4.6 и GPT-5.4. Так формулирует результат Т—Ж. При этом по объёму общих знаний о мире она уступает закрытой модели Gemini-3.1-Pro.

Разбор на deepseek.ai заявляет бенчмарки против GPT-5.4 и Claude Opus 4.8, а также текущие цены API. Конкретные баллы есть в обзоре на Хабре: Apex Shortlist 90,2% у V4-Pro против 92,8% у Claude Opus 4.6, Codeforces 3206 против 3312, SWE-bench Verified 78,4% против 82,1%. Источники расходятся: Т—Ж пишет, что V4-Pro обходит Opus 4.6, а таблица Хабра с данными на апрель 2026 ставит V4-Pro ниже Opus 4.6 во всех трёх тестах.

Новости и слухи о DeepSeek V4

Официально: релиз вышел 24 апреля 2026 года, доступны две версии, веса открыты, контекст 1 млн токенов. Это первое крупное обновление линейки с начала 2025 года.

В кулуарах остаётся несколько тем. Название «V4-Lite» в источниках не встречается. Про V4.1 сырьё даёт 763 млрд параметров и мультимодальность — подробности выше. Дата выхода V5 не называется. Слухи о будущих версиях в прочитанных материалах не подтверждены конкретикой.

Отдельная линия новостей — аппаратная. В разборе на deepseek.ai есть раздел про сдвиг к Huawei. Детали источники дают: обзор на Хабре называет поддержку Huawei Ascend 910B и Cambricon MLU370, а deepseek.ai пишет, что «Huawei’s Ascend 950PR reportedly delivers 2.87x the compute performance of the Nvidia H20».

Частые вопросы

DeepSeek V4 когда выйдет?
Модель уже вышла. Релиз состоялся 24 апреля 2026 года — об этом сообщает Hi-Tech Mail. В релиз вошли две версии: V4-Pro и V4-Flash. Обе доступны через веб-интерфейс и API. Ждать больше нечего, если речь именно о V4.

DeepSeek V4 скачать где?
Веса лежат в коллекции DeepSeek-V4 на Hugging Face. Там перечислены репозитории Flash-Base, Flash, Pro-Base, Pro и другие варианты. Модели распространяются с открытыми весами под лицензией MIT. Требования к железу для локального запуска источники не приводят.

DeepSeek V4 Pro как пользоваться?
Два пути: веб-интерфейс на официальном сайте и API. В веб-чате нужно выбрать V4 из списка моделей. Для API используется OpenAI-совместимый клиент. V4-Pro работает через режим Expert, V4-Flash — через Instant.

DeepSeek V4 Flash сколько параметров?
284 миллиарда общих параметров и 13 миллиардов активных. Так описывает модель RouterAI. Контекстное окно — 1 миллион токенов. Архитектура — Mixture-of-Experts, как и у старшей V4-Pro.

В чём главная особенность DeepSeek V4?
Сочетание масштаба и эффективности при открытых весах. В обзоре на Хабре это сформулировано как 90% возможностей лучших закрытых моделей за 5-10% их стоимости. Модель текстовая, без нативной поддержки изображений. Для кода, аналитики и документооборота источники называют её оптимальным выбором.

Если вы работаете с открытыми инструментами разработки, посмотрите материал OpenCode бесплатно: что входит и чем вы платите — там разобрана экономика бесплатных решений.

Читайте также

3 материала