DeepSeek V4, V4 Flash и V4.1 Flash: чем отличаются, цены и как пользоваться на русском

11 сентября 2026 г. 8 мин чтения
DeepSeek V4, V4 Flash и V4.1 Flash: чем отличаются, цены и как пользоваться на русском

DeepSeek V4 вышла в апреле 2026 и за пять месяцев превратилась в целое семейство: V4 Pro, V4 Flash, летние снапшоты 0731 и 0813, экспериментальная версия со зрением и, с 10 сентября, V4.1 Flash. Названия путают даже тех, кто пользуется моделью каждый день, а с 14 сентября DeepSeek ещё и тихо подменяет V4 Pro на новую Flash. Разбираем, что есть что, чем версии отличаются, сколько стоят, где модель сильна, где подводит и как пользоваться ею на русском.

Семейство V4: кто есть кто

МодельДатаЧто это
DeepSeek V4 Pro24 апреля 2026Флагман: 1,6 триллиона параметров, из них 49 миллиардов активных на каждом токене
DeepSeek V4 Flash24 апреля 2026Быстрая и дешёвая версия: 284 миллиарда параметров, 13 миллиардов активных
V4 Flash 073131 июля 2026Обновление Flash под агентские задачи: та же архитектура, новое дообучение
V4 Pro 081313 августа 2026Стабильная версия Pro с уровнями усилия рассуждений low, high, max
V4 Flash Vision Exp21 августа 2026Экспериментальная версия со зрением
DeepSeek V4.1 Flash10 сентября 2026Новая архитектура, нативное понимание картинок, первая стабильная модель DeepSeek со зрением

Все модели семейства открыты под лицензией MIT: веса лежат на Hugging Face, их можно запускать у себя. Контекст у всех 1 миллион токенов. API совместим одновременно с форматом OpenAI и Anthropic, поэтому DeepSeek легко подставить в любое приложение, написанное под GPT или Claude.

Что нового в V4.1 Flash

Это не просто очередное дообучение. Изменилась сама конструкция:

  • 552 миллиарда параметров, но активных всего 8 миллиардов на входе и 16 на выходе. Модель стала больше V4 Flash, а работает дешевле.
  • Энкодер-декодер вместо чистого декодера: 40 слоёв и собственный визуальный энкодер DeepSeek-ViT. Картинки модель понимает «из коробки», а не через приставку, как в экспериментальной Vision-версии.
  • Ответ до 384 тысяч токенов: рекорд среди массовых моделей, полезно для длинных отчётов и больших файлов кода.
  • Кэш в 4 раза компактнее в памяти GPU и в 8 раз на диске, отсюда низкая цена и скорость около 200 токенов в секунду.

По собственным тестам DeepSeek новая Flash обгоняет флагманскую V4 Pro:

ТестV4.1 FlashV4 ProClaude Opus 5GPT-5.6 Sol
GPQA Diamond (наука)90,992,493,494,1
DeepSWE v1.1 (программирование)74,262,774,073,0
Terminal-Bench 2.1 (командная строка)90,687,989,188,8
Humanity's Last Exam36,8 / 39,142,7 / 60,0 с инструментаминет данныхнет данных

В коде и работе с терминалом V4.1 Flash идёт вровень с Claude Opus 5 и GPT-5.6 Sol, которые стоят в 20-40 раз дороже. В науке и эрудиции отставание заметно. В независимом индексе Artificial Analysis у неё 40 баллов против 53 у GPT-6 Astra и Claude Fable 5.1: крепкий средний класс, а не флагман. Отдельное наблюдение аналитиков: модель очень многословна, на одном и том же наборе задач она выдала 250 миллионов токенов при медиане 140 у других моделей. Для пользователя это длинные ответы, для API это лишние расходы.

Важно: с 14 сентября V4 Pro отвечает как V4.1 Flash

DeepSeek официально объявила, что с 14 сентября 2026 все запросы к deepseek-v4-pro перенаправляются на V4.1 Flash по цене Flash, пока не выйдет V4.1 Pro. Имя модели в API остаётся, но отвечает уже другая сеть. Тем, кто платил за Pro ради максимальной эрудиции, стоит учесть: на научных вопросах и экзаменационных тестах ответы станут слабее, а в коде, наоборот, лучше.

Цены

Официальные цены DeepSeek за миллион токенов, со скидкой 50% в непиковые часы (пик: 01:00-04:00 и 06:00-10:00 UTC по будням, то есть утро и день по Москве):

МодельВход, пик / не пикВыход, пик / не пикПопадание в кэш
V4.1 Flash0,30 / 0,15 доллара1,20 / 0,60 доллара0,006 / 0,003
V4 Pro (до 14.09)1,32 / 0,66 доллара3,96 / 1,98 доллара0,044 / 0,022

Для сравнения: GPT-6 Astra стоит 10 и 50 долларов, Claude Opus 5 5 и 25. DeepSeek остаётся самой дешёвой моделью своего уровня, и именно это, а не рекорды в тестах, объясняет её популярность у разработчиков.

Где DeepSeek подводит

Цензура на китайские темы. Исследование CTGT показало, что в версии Flash 0731 доля отказов на «чувствительных для Китая» вопросах выросла с 57 до 64 процентов, а на нейтральных контрольных вопросах, наоборот, упала. Для бытовых задач это незаметно, для журналистики и политологии критично.

Переключение на китайский. Пользователи жалуются, что на длинном русском диалоге модель иногда отвечает китайскими фразами или теряет контекст. Официально DeepSeek проблему не признавала. Помогает явная инструкция в начале: «Отвечай только по-русски».

Уход в английский в технических темах. В коде и математике комментарии и пояснения часто идут на английском. Лечится той же инструкцией.

Мало независимых проверок безопасности. Красных команд, которые тестировали бы V4 так же тщательно, как модели OpenAI и Anthropic, почти нет.

Как DeepSeek пишет по-русски

На русскоязычном бенчмарке MERA семейство V4 не тестировали, так что строгих цифр нет. В индексе качества перевода Alconost DeepSeek на пятом месте с 71,5 балла, позади Gemini (77,7), Claude (75,6) и GPT (73,1), но впереди DeepL. На практике русский модель понимает хорошо, а стиль ответов суше, чем у Claude: меньше воды, больше списков. Для конспектов, кода и черновиков это плюс, для писем и текстов «с душой» лучше взять GPT или Claude.

Как пользоваться в России

Сайт и приложение DeepSeek из России открываются, регистрация по почте. Но есть три бытовые проблемы: очереди и ошибки «сервер занят» в часы пик, ограничения по числу запросов и то, что переписка уходит на серверы в Китае. Через API нужна оплата картой, российские карты проходят не всегда.

Альтернатива: агрегатор, где DeepSeek подключён через официальный API и оплачивается в рублях. В Promtix доступны три версии семейства и рядом с ними GPT-6 Astra, Claude, Gemini и Qwen, поэтому один и тот же вопрос можно задать двум моделям и выбрать ответ лучше.

Какую версию выбрать

  • Код, скрипты, работа с терминалом, агенты: V4.1 Flash. Уровень Claude Opus 5 за копейки.
  • Длинные документы и большие файлы: V4.1 Flash, контекст миллион токенов и ответ до 384 тысяч.
  • Разбор картинок, скриншотов, схем: V4.1 Flash, единственная стабильная DeepSeek со зрением.
  • Научные вопросы, экзамены, олимпиадная математика: до 14 сентября V4 Pro, после смотрите в сторону GPT-6 Astra или Claude Fable 5.1, у них результаты на этих тестах заметно выше.
  • Тексты на русском для людей: DeepSeek справится, но Claude и GPT пишут естественнее.

Частые вопросы

DeepSeek V4 бесплатная? Веса открыты бесплатно под лицензией MIT, но для запуска V4.1 Flash нужны сотни гигабайт видеопамяти. Веб-чат DeepSeek бесплатный с лимитами. В Promtix при регистрации дают стартовые токены.

Чем V4 Flash отличается от V4 Pro? Размером и ценой: Flash в пять раз меньше и в четыре раза дешевле. С 14 сентября различие исчезло: оба имени ведут на V4.1 Flash.

Что такое deepseek v4 0731? Июльский снапшот V4 Flash, дообученный под агентские сценарии: Terminal Bench 82,7, SWE-bench Verified 54,4. Сейчас его заменила V4.1 Flash.

Есть ли у DeepSeek генерация картинок? Нет, семейство V4 картинки только понимает. Для генерации в Promtix есть отдельный раздел с GPT Image 2, Nano Banana и Seedream.

Попробуйте в Promtix

Все инструменты работают в России без VPN, оплата в рублях.