DeepSeek V4, V4 Flash и V4.1 Flash: чем отличаются, цены и как пользоваться на русском

DeepSeek V4 вышла в апреле 2026 и за пять месяцев превратилась в целое семейство: V4 Pro, V4 Flash, летние снапшоты 0731 и 0813, экспериментальная версия со зрением и, с 10 сентября, V4.1 Flash. Названия путают даже тех, кто пользуется моделью каждый день, а с 14 сентября DeepSeek ещё и тихо подменяет V4 Pro на новую Flash. Разбираем, что есть что, чем версии отличаются, сколько стоят, где модель сильна, где подводит и как пользоваться ею на русском.
Семейство V4: кто есть кто
| Модель | Дата | Что это |
|---|---|---|
| DeepSeek V4 Pro | 24 апреля 2026 | Флагман: 1,6 триллиона параметров, из них 49 миллиардов активных на каждом токене |
| DeepSeek V4 Flash | 24 апреля 2026 | Быстрая и дешёвая версия: 284 миллиарда параметров, 13 миллиардов активных |
| V4 Flash 0731 | 31 июля 2026 | Обновление Flash под агентские задачи: та же архитектура, новое дообучение |
| V4 Pro 0813 | 13 августа 2026 | Стабильная версия Pro с уровнями усилия рассуждений low, high, max |
| V4 Flash Vision Exp | 21 августа 2026 | Экспериментальная версия со зрением |
| DeepSeek V4.1 Flash | 10 сентября 2026 | Новая архитектура, нативное понимание картинок, первая стабильная модель DeepSeek со зрением |
Все модели семейства открыты под лицензией MIT: веса лежат на Hugging Face, их можно запускать у себя. Контекст у всех 1 миллион токенов. API совместим одновременно с форматом OpenAI и Anthropic, поэтому DeepSeek легко подставить в любое приложение, написанное под GPT или Claude.
Что нового в V4.1 Flash
Это не просто очередное дообучение. Изменилась сама конструкция:
- 552 миллиарда параметров, но активных всего 8 миллиардов на входе и 16 на выходе. Модель стала больше V4 Flash, а работает дешевле.
- Энкодер-декодер вместо чистого декодера: 40 слоёв и собственный визуальный энкодер DeepSeek-ViT. Картинки модель понимает «из коробки», а не через приставку, как в экспериментальной Vision-версии.
- Ответ до 384 тысяч токенов: рекорд среди массовых моделей, полезно для длинных отчётов и больших файлов кода.
- Кэш в 4 раза компактнее в памяти GPU и в 8 раз на диске, отсюда низкая цена и скорость около 200 токенов в секунду.
По собственным тестам DeepSeek новая Flash обгоняет флагманскую V4 Pro:
| Тест | V4.1 Flash | V4 Pro | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| GPQA Diamond (наука) | 90,9 | 92,4 | 93,4 | 94,1 |
| DeepSWE v1.1 (программирование) | 74,2 | 62,7 | 74,0 | 73,0 |
| Terminal-Bench 2.1 (командная строка) | 90,6 | 87,9 | 89,1 | 88,8 |
| Humanity's Last Exam | 36,8 / 39,1 | 42,7 / 60,0 с инструментами | нет данных | нет данных |
В коде и работе с терминалом V4.1 Flash идёт вровень с Claude Opus 5 и GPT-5.6 Sol, которые стоят в 20-40 раз дороже. В науке и эрудиции отставание заметно. В независимом индексе Artificial Analysis у неё 40 баллов против 53 у GPT-6 Astra и Claude Fable 5.1: крепкий средний класс, а не флагман. Отдельное наблюдение аналитиков: модель очень многословна, на одном и том же наборе задач она выдала 250 миллионов токенов при медиане 140 у других моделей. Для пользователя это длинные ответы, для API это лишние расходы.
Важно: с 14 сентября V4 Pro отвечает как V4.1 Flash
DeepSeek официально объявила, что с 14 сентября 2026 все запросы к deepseek-v4-pro перенаправляются на V4.1 Flash по цене Flash, пока не выйдет V4.1 Pro. Имя модели в API остаётся, но отвечает уже другая сеть. Тем, кто платил за Pro ради максимальной эрудиции, стоит учесть: на научных вопросах и экзаменационных тестах ответы станут слабее, а в коде, наоборот, лучше.
Цены
Официальные цены DeepSeek за миллион токенов, со скидкой 50% в непиковые часы (пик: 01:00-04:00 и 06:00-10:00 UTC по будням, то есть утро и день по Москве):
| Модель | Вход, пик / не пик | Выход, пик / не пик | Попадание в кэш |
|---|---|---|---|
| V4.1 Flash | 0,30 / 0,15 доллара | 1,20 / 0,60 доллара | 0,006 / 0,003 |
| V4 Pro (до 14.09) | 1,32 / 0,66 доллара | 3,96 / 1,98 доллара | 0,044 / 0,022 |
Для сравнения: GPT-6 Astra стоит 10 и 50 долларов, Claude Opus 5 5 и 25. DeepSeek остаётся самой дешёвой моделью своего уровня, и именно это, а не рекорды в тестах, объясняет её популярность у разработчиков.
Где DeepSeek подводит
Цензура на китайские темы. Исследование CTGT показало, что в версии Flash 0731 доля отказов на «чувствительных для Китая» вопросах выросла с 57 до 64 процентов, а на нейтральных контрольных вопросах, наоборот, упала. Для бытовых задач это незаметно, для журналистики и политологии критично.
Переключение на китайский. Пользователи жалуются, что на длинном русском диалоге модель иногда отвечает китайскими фразами или теряет контекст. Официально DeepSeek проблему не признавала. Помогает явная инструкция в начале: «Отвечай только по-русски».
Уход в английский в технических темах. В коде и математике комментарии и пояснения часто идут на английском. Лечится той же инструкцией.
Мало независимых проверок безопасности. Красных команд, которые тестировали бы V4 так же тщательно, как модели OpenAI и Anthropic, почти нет.
Как DeepSeek пишет по-русски
На русскоязычном бенчмарке MERA семейство V4 не тестировали, так что строгих цифр нет. В индексе качества перевода Alconost DeepSeek на пятом месте с 71,5 балла, позади Gemini (77,7), Claude (75,6) и GPT (73,1), но впереди DeepL. На практике русский модель понимает хорошо, а стиль ответов суше, чем у Claude: меньше воды, больше списков. Для конспектов, кода и черновиков это плюс, для писем и текстов «с душой» лучше взять GPT или Claude.
Как пользоваться в России
Сайт и приложение DeepSeek из России открываются, регистрация по почте. Но есть три бытовые проблемы: очереди и ошибки «сервер занят» в часы пик, ограничения по числу запросов и то, что переписка уходит на серверы в Китае. Через API нужна оплата картой, российские карты проходят не всегда.
Альтернатива: агрегатор, где DeepSeek подключён через официальный API и оплачивается в рублях. В Promtix доступны три версии семейства и рядом с ними GPT-6 Astra, Claude, Gemini и Qwen, поэтому один и тот же вопрос можно задать двум моделям и выбрать ответ лучше.
Какую версию выбрать
- Код, скрипты, работа с терминалом, агенты: V4.1 Flash. Уровень Claude Opus 5 за копейки.
- Длинные документы и большие файлы: V4.1 Flash, контекст миллион токенов и ответ до 384 тысяч.
- Разбор картинок, скриншотов, схем: V4.1 Flash, единственная стабильная DeepSeek со зрением.
- Научные вопросы, экзамены, олимпиадная математика: до 14 сентября V4 Pro, после смотрите в сторону GPT-6 Astra или Claude Fable 5.1, у них результаты на этих тестах заметно выше.
- Тексты на русском для людей: DeepSeek справится, но Claude и GPT пишут естественнее.
Частые вопросы
DeepSeek V4 бесплатная? Веса открыты бесплатно под лицензией MIT, но для запуска V4.1 Flash нужны сотни гигабайт видеопамяти. Веб-чат DeepSeek бесплатный с лимитами. В Promtix при регистрации дают стартовые токены.
Чем V4 Flash отличается от V4 Pro? Размером и ценой: Flash в пять раз меньше и в четыре раза дешевле. С 14 сентября различие исчезло: оба имени ведут на V4.1 Flash.
Что такое deepseek v4 0731? Июльский снапшот V4 Flash, дообученный под агентские сценарии: Terminal Bench 82,7, SWE-bench Verified 54,4. Сейчас его заменила V4.1 Flash.
Есть ли у DeepSeek генерация картинок? Нет, семейство V4 картинки только понимает. Для генерации в Promtix есть отдельный раздел с GPT Image 2, Nano Banana и Seedream.
Попробуйте в Promtix
Все инструменты работают в России без VPN, оплата в рублях.