DeepSeek в 2026: обзор V4-Pro и V4-Flash после роста цен

AI-модели в этой статье
DeepSeek (часто пишут «Deep Seek») – китайский AI-стартап, который за два года стал одним из лидеров индустрии. В апреле 2026 года DeepSeek выпустил V4, 13 августа V4-Pro вышла из беты, а 16 августа компания поменяла тарифную политику.
Прошлая версия этой статьи называла DeepSeek бюджетным флагманом и обещала цены в 10–50 раз ниже конкурентов. Первое по-прежнему верно. Второе пора пересчитать: DeepSeek поднял тарифы, ввёл пиковые окна, а цена попадания в кэш выросла вплоть до 1 100% относительно первых цен превью. Сама компания объясняет это переходом к роли устойчивого поставщика вычислений. Бюджет, посчитанный по весенним ценам, больше не сходится.
Для менеджера DeepSeek – по-прежнему прежде всего цена. По смешанной стоимости $0,33 за миллион токенов рядом с ним в таблице Artificial Analysis не стоит ни один флагман. Цена перестала быть агрессивной, и это меняет характер решения: выбирать DeepSeek «потому что дешевле всех» теперь надо осознанно, с пониманием, что именно вы покупаете.
Все модели доступны под лицензией MIT: можно скачать и развернуть на собственном сервере. Публичный эндпоинт при этом работает на FP4-квантовании, то есть ответы API и ответы локально развёрнутой модели из полных весов совпадать не обязаны.

В чём особенность DeepSeek?
V4-Pro – МоE-модель на 1,6 триллиона параметров, из которых на каждом токене активны 49 миллиардов. Платите вы за активную часть, поэтому при размере флагмана стоимость запроса остаётся низкой. Гибридное внимание и сжатие KV-кэша уменьшают расход на длинном контексте.
- Контекстное окно 1 048 576 токенов – примерно 750 000 слов, около 2 500 страниц текста.
- Потолок ответа 393 216 токенов, самый большой среди всех моделей этого сравнения.
- Три уровня усилия размышления. В API DeepSeek они называются low, high и max; на OpenRouter та же модель отдаёт high и xhigh. Если пишете интеграцию, сверяйте названия режимов у конкретного провайдера – они не совпадают.
Основные модели DeepSeek (сентябрь 2026)
DeepSeek V4-Pro
Флагман, 13 августа 2026 года вышел в общий доступ в приложении, вебе и API. Универсальный ассистент: тексты, анализ, код, работа с данными. Модель по-прежнему текстовая – на карточке Pro нет ни входа изображений, ни аудио, ни видео.
Цифры производителя из отчёта о том же релизе: Terminal Bench 2.1 – 87,9 и HLE с инструментами – 60,0. DSBench-FullStack – 71,1. Для варианта V4-Pro-Max заявлены LiveCodeBench 93,5 и SWE-bench Verified 80,6; там же Codeforces 3 206 и MRCR на миллионе токенов – 83,5. Это оценки самого DeepSeek, и ниже будет независимая картина, которая выглядит скромнее.
- Контекст 1 000 000 токенов на вход, до 393 216 токенов на выход
- Инструменты, tool_choice, структурированный вывод в JSON
- Веса под MIT, публичный эндпоинт – FP4
Потолок ответа стоит обсудить отдельно. 393 216 токенов – это около 295 000 слов, годовой отчёт крупной компании за один проход. У остальных участников сравнения потолок ниже в разы, и для любого, кто генерирует длинные документы, это единственная характеристика, которую не заменяет никакая оценка интеллекта.
DeepSeek V4-Flash
Быстрая и дешёвая модель, 284 миллиарда параметров. Официальный релиз в статусе публичной беты состоялся 31 июля 2026; главным в нём производитель назвал агентные способности и поддержку Responses API для Codex. Terminal Bench 2.1 – 82,7 по данным производителя.
Контекст тот же, миллион токенов. Режимы мышления те же. Модель рассчитана на потоковые задачи: чат-боты, обработка документов, массовые запросы.
Держать в голове стоит одно: Qwen3.8-Flash-Next обходит V4-Flash на большинстве протестированных задач при заметно меньшем числе активных параметров. V4-Flash за лето перестал быть сильнейшей моделью в своём сегменте.
Зрение: deepseek-v4-flash-vision-exp
21 августа 2026 DeepSeek выпустил первую модель с входом изображений. Она вызывается как model='deepseek-v4-flash-vision-exp' и тарифицируется по ставкам V4-Flash.
Заявленное назначение – автоматизация интерфейсов и разбор графиков. Модель принимает статические изображения и последовательности скриншотов; настоящий видеопоток она не обрабатывает. Chartography – 64,3, производитель также утверждает, что мультимодальные агентные способности приближаются к Opus 4.8. Обе цифры – его собственные.
В наш бенчмарк модель ещё не входит, независимых оценок у неё пока тоже нет – только данные производителя.
Суффикс -exp здесь рабочий. Это превью: строить на нём продакшн-процесс нельзя, и в любой момент может поменяться поведение или цена. Зрение появилось на дешёвом тире – флагман остался текстовым.
Генерация изображений по-прежнему живёт в отдельной линии Janus-Pro-7B: GenEval 80% против 67% у DALL-E 3 при ограничении разрешения в 384×384 px.

Промпты для DeepSeek выглядят простыми: загрузил документ, попросил вывод. Сложность начинается там, где ответ нужен точный – с числами, которые сходятся, и с рисками, не потерявшимися на второй странице. Разница между «модель ответила» и «моделью можно работать» – это навык постановки задачи.
Дешёвая модель требует такой же точной постановки задачи. 9 практических задач менеджера в бесплатном модуле – без регистрации.
Доступ сразу после регистрации
Сравнение с конкурентами
Что говорят независимые площадки
Сентябрьский срез Artificial Analysis по десяти ведущим моделям. Индекс интеллекта, смешанная цена за миллион токенов и скорость вывода – всё по одной методике, что и делает таблицу полезной.
| Модель | Вендор | Intelligence Index | Смешанная цена, $/1M | Вывод, ток/с |
|---|---|---|---|---|
| Claude Fable 5.1 (max) | Anthropic | 57 | $6,12 | 70 |
| GPT-6 Astra (max) | OpenAI | 55 | $2,57 | 71 |
| Claude Opus 5 (max) | Anthropic | 54 | $4,21 | 58 |
| Grok 4.6 (high) | xAI | 51 | $1,25 | 63 |
| Kimi K3 (max) | Moonshot | 50 | $1,58 | 42 |
| GLM-5.3 (max) | Z.ai | 49 | $1,26 | 87 |
| Gemini 3.8 Flash (high) | 47 | $0,74 | 334 | |
| Qwen3.8-Max | Alibaba | 47 | $1,19 | 40 |
| GLM-5.3-Flash | Z.ai | 46 | $0,18 | 48 |
| DeepSeek V4-Pro 0813 (max) | DeepSeek | 42 | $0,33 | 71 |
DeepSeek V4-Pro занимает в этой таблице последнее место по интеллекту; дешевле него только GLM-5.3-Flash, и тот из другого класса. Разброс между первой и последней строкой – 15 пунктов индекса, а между самой дорогой и самой дешёвой ценой среза – 34 раза. Это и есть честное позиционирование DeepSeek на сентябрь 2026: его берут за цену.
Оговорка про саму шкалу. Artificial Analysis публикует индекс версиями и перемасштабирует его между ними, поэтому «60» из релизного поста вендора и «42» из текущего среза – числа из разных систем координат. Сравнивать имеет смысл только внутри одного среза. Как устроено измерение в принципе – в разборе «Как работают бенчмарки LLM в 2026».
LMArena даёт вторую картину: в десятке лучших ни по тексту, ни по зрению DeepSeek там нет. У девяти верхних строк текстового рейтинга доверительные интервалы перекрываются – позиции с первой по девятую статистически неразличимы. Любое «модель X – лучшая» отсюда – это чтение рейтинга сверх того, что он измеряет, ровно тот аргумент, который серия уже разбирала в статье «Бенчмарки ИИ теряют смысл».
Китайские соседи
Kimi K3 – главный китайский конкурент DeepSeek по агентным задачам. В срезе Artificial Analysis он набирает 50 пунктов индекса при смешанной цене $1,58, то есть стоит примерно в пять раз дороже V4-Pro и на восемь пунктов выше него. В наш бенчмарк K3 как модель ещё не входит, и здесь приведены данные независимой площадки.
Отдельная неприятная для DeepSeek строка в той же таблице – GLM-5.3-Flash. 46 пунктов индекса и $0,18 смешанной цены: на четыре пункта выше V4-Pro и почти вдвое дешевле. Аргумент «возьмём DeepSeek, потому что дешевле китайских аналогов» больше не работает автоматически.
Где V4-Pro сильнее
- Потолок ответа 393 216 токенов – максимальный в сравнении. Для генерации длинных документов конкурентов с такой цифрой в этой таблице нет.
- Длинный контекст за вменяемые деньги: миллион токенов входа при цене порядка $0,435 за миллион на прямом доступе вне пика.
- Код по данным производителя: LiveCodeBench 93,5 и SWE-bench Verified 80,6 у V4-Pro-Max.
- Лицензия MIT на веса: модель можно забрать внутрь контура, чего нельзя сделать с закрытыми флагманами из верхней части таблицы.
Где V4-Pro уступает
- Независимая оценка качества. 42 пункта Artificial Analysis – последняя строка среди десяти моделей этого среза.
- Разрыв между цифрами производителя и независимой проверкой. Производитель заявляет 87,9 по Terminal Bench 2.1 и 60,0 по HLE с инструментами, независимый индекс при этом ставит модель в конец списка. Оба числа получены честно, они просто отвечают на разные вопросы.
- Мультимодальность. У флагмана её нет вообще, у Flash она в статусе превью. У Claude, GPT и Gemini анализ изображений встроен в основную модель.
- Коммуникация. По нашим данным, один из худших результатов среди топ-моделей в задачах на формулировку обратной связи.
Впрочем, разрыв в агентных задачах сокращается не только сменой модели. В августе 2026 исследование StateM подняло DeepSeek-V4 Flash с 82,7% до 88,1% на Terminal-Bench 2.1 без смены весов – только за счёт обвязки вокруг модели: ранбуков, постоянного состояния и проверки шагов. Что именно там сделано и почему это важно для доступных из России моделей – в разборе свежих бенчмарков промпт-инжиниринга.
Знать, какая модель дешевле, полезно. Полезнее уметь объяснить, почему на вашей задаче дешёвая модель даёт приемлемый результат, а на соседней – нет.
Точная постановка задачи решает больше, чем выбор модели
Бесплатный модуль – это 9 практических задач менеджера: статус-отчёт за пять минут, письмо клиенту, скрининг резюме. Каждая сначала даёт убедительный результат, а потом показывает, какую ошибку вы в нём не заметили.
Продолжите обучение
Откройте учебник и продолжите с того места, где остановились
Практическое применение для менеджера
- «Перевод» с технического на человеческий – обобщение сложного технического отчёта в краткую записку для руководства.
- Проверка логики решений (режим max) – загрузите бизнес-план и попросите найти слабые места. Максимальный уровень рассуждения указывает на неочевидные риски.
- Анализ данных – опишите словами, что хотите узнать из таблицы Excel, и DeepSeek напишет формулы или скрипт.
- Работа с большими документами – загрузите регламент или годовой отчёт (до ~2 500 страниц) и задавайте вопросы. Контекст в миллион токенов вмещает целые кодовые базы или корпоративные базы знаний.
- Длинные документы на выход – потолок в 393 216 токенов позволяет просить связный текст на сотни страниц за один запрос, без склейки кусков.
- Ускорение работы IT-команды – написание кода, проверка, тесты и документация.
Попробуйте сами: анализ рискованного решения
Ниже – управленческий кейс с неочевидными проблемами. Нажмите «Выполнить» и сравните, как V4-Pro, V4-Flash и Kimi K3 справляются с поиском рисков. Обратите внимание на глубину рассуждений и конкретность рекомендаций.
На что обратить внимание в ответах:
- V4-Pro на максимальном уровне рассуждения выстраивает цепочку анализа и чаще находит неочевидные связи (аренда + сокращение = репутационный риск; пилот на 2 точках не показателен для 40)
- V4-Flash отвечает быстрее и дешевле, но чаще пропускает взаимосвязи между рисками
- Kimi K3 обычно структурирует ответ подробнее, но может быть избыточным
Кейс выше – заготовка: настоящая проверка начинается на ваших числах. 9 практических задач менеджера в бесплатном модуле помогут понять, какая модель нужна под вашу задачу. Без регистрации.
Доступ сразу после регистрации
Обновление: наш бенчмарк, новые цены и Яндекс Облако (сентябрь 2026)
В нашем бенчмарке управленческих задач (42 модели, 80 сценариев) DeepSeek V4 проверялся на весенних ценах. Результаты по качеству остаются в силе, цифры по стоимости – уже нет.
DeepSeek V4-Pro
С ценами сейчас разнобой, и лучше показывать всю картину, чем выбирать одну удобную цифру. DeepSeek напрямую вне пика просит около $0,435 за миллион токенов на вход и $0,87 на выход, попадание в кэш – порядка $0,0036. Смешанная цена OpenRouter по 16–17 провайдерам – около $0,69 и $1,37, чтение кэша $0,057. Расхождение даёт и сама пиковая тарификация, и то, что каждый провайдер закладывает свою маржу. Для бюджета берите тот канал, через который реально пойдёт трафик.
Кому модель подходит по нашим сценариям: планы внедрения процессов, скрипты сложных командных разговоров, массовая рутинная переписка. Где она систематически подводит: ROI и финансовые модели с ошибками в расчётах, юридические обоснования, анализ тарифов SaaS.
DeepSeek V4-Flash
$0,09/$0,18 за миллион токенов вне пика – это последняя опубликованная цена модели, и в пиковые окна она удваивается. В нашем бенчмарке Flash занял место выше Gemini 3.1 Pro при цене в два порядка ниже. Рабочая модель для текстов и планов, если расписание запросов удаётся развести по тарифным окнам.
Подходит: еженедельные отчёты, классификация обратной связи, квартальные планы и матрицы рисков. Не подходит: бюджеты и финансовые модели, международное право и GDPR, код автоматизации.
DeepSeek на Яндекс Облаке – стоит ли?
Яндекс предлагает DeepSeek V4 Flash через свой API. DeepSeek V4 Flash (Yandex Cloud) – та же самая модель, но с фиксированной ценой, и после августовских изменений картина наценки стала зависеть от времени суток.
| Параметр | DeepSeek напрямую, вне пика | DeepSeek напрямую, в пик | Яндекс Облако |
|---|---|---|---|
| Input за 1M | $0,09 | $0,18 | $3,00 |
| Output за 1M | $0,18 | $0,36 | $5,00 |
| Наценка Яндекса | ×33 на вход, ×28 на выход | ×17 на вход, ×14 на выход | – |
В весенней версии статьи здесь стояла наценка 28–33 раза. Она никуда не делась, просто перестала быть единственной: пиковые окна сокращают разрыв вдвое.
За что платите: прямой доступ из России без VPN, SLA от Яндекса, хранение данных в РФ, контекстное окно в миллион токенов. Вердикт тот же, но с поправкой на расписание. Командам, которые уже работают в Яндекс Облаке и автоматизируют задачи без отдельного AI-бюджета, такая переплата может быть оправдана. Если VPN не проблема и трафик удаётся увести из пиковых окон, прямой доступ дешевле в десятки раз, а по нашему бенчмарку ещё и немного точнее.
Предыдущие поколения
DeepSeek V3.2 (протестирован ранее) – крепкий верхний средний уровень. Особенно силён в планировании и решении проблем. Серьёзный пробел – коммуникация: один из худших результатов среди всех протестированных моделей.
DeepSeek R1 – сопоставимый уровень. Сильные стороны – поиск информации и аналитика, где пошаговое мышление даёт заметное преимущество.
Полные интерактивные результаты ->
Подробный разбор по категориям – в статье о лучших AI для менеджера в России.
Ограничения и риски
- Мультимодальность в статусе превью – флагман V4-Pro текстовый, вход изображений появился 21 августа только на Flash-тире и с суффиксом
-exp. Реальное видео модель не обрабатывает. Генерация изображений – отдельная линия Janus-Pro с разрешением 384×384. У Claude, GPT и Gemini мультимодальность встроена в основную модель. - Безопасность контента – защитные фильтры слабее, чем у ChatGPT и Claude. Модель легче «уговорить» сгенерировать нежелательный контент.
- Конфиденциальность данных – компания базируется в Китае. Решение: скачать модель (MIT-лицензия) и развернуть локально – дистилляты DeepSeek на 7B и 14B запускаются на обычном ноутбуке. Помнить при этом про FP4 на публичном эндпоинте: поведение API и локальной сборки из полных весов различается.
- Меньше готовых интеграций – нет официальных плагинов для CRM, ERP. Но поддерживает формат API OpenAI и Anthropic – большинство инструментов работают через адаптер.
- Стабильность API – в пиковые часы бывают задержки и отказы. С 16 августа пик зафиксирован в тарифах, что намекает на то, где именно нагрузка максимальна. Для продакшн-систем стоит использовать прокси-провайдеров (DeepInfra, Together.ai, OpenRouter).
- Ломка старых интеграций – идентификаторы
deepseek-chatиdeepseek-reasonerотключены 24 июля 2026 года. Если интеграцию не обновили, она уже не работает. - Китайский язык как приоритет – на русском качество хорошее. По нашим данным, DeepSeek V3.2 превосходит все российские модели (включая Alice AI и GigaChat) даже в задачах с российской спецификой.
Тарифы и доступность
С 16 августа 2026 DeepSeek считает токены по двум ставкам. Пиковые окна – 01:00–04:00 и 06:00–10:00 UTC, внутри них цена вдвое выше. По московскому времени это 04:00–07:00 и 09:00–13:00.
Второе окно накрывает российское рабочее утро целиком. Всё, что гоняется интерактивно с девяти до часу, платит двойную ставку; всё, что можно увести в ночной батч, платит половину. Разница между этими двумя режимами работы – ровно два раза, и ни на одной странице с ценами вы её не увидите: она зависит от вашего расписания.
| Канал | Input за 1M | Output за 1M | Кэш |
|---|---|---|---|
| DeepSeek напрямую, вне пика | $0,435 | $0,87 | ~$0,0036 |
| DeepSeek напрямую, в пик | ~$0,87 | ~$1,74 | вдвое дороже внепикового |
| OpenRouter, смешанная по 16–17 провайдерам | ~$0,69 | ~$1,37 | $0,057 на чтение |
| DeepSeek V4-Flash напрямую, вне пика | $0,09 | $0,18 | ~$0,014 |
- Бесплатный доступ – на chat.deepseek.com можно пользоваться бесплатно, включая глубокий режим рассуждения.
- Open source (MIT) – все модели доступны для скачивания, коммерческого использования и доработки без ограничений.
- Кэш подорожал сильнее всего – ставка на попадание в кэш для V4-Pro выросла вплоть до 1 100% относительно первых цен превью. Сценарии, где экономия строилась на повторных запросах с длинным общим префиксом, стоит пересчитать заново.
- Скидка 75%, объявленная весной временной, летом стала постоянной, а в августе к ней добавилась пиковая надбавка. Итог: стандартная цена V4-Pro на выходе – $0,87 вне пика и около $1,74 в пик.
- Провайдеры расходятся в цене – прямой доступ DeepSeek дешевле смешанной ставки OpenRouter примерно в полтора раза, зато OpenRouter закрывает вопрос доступности и отказоустойчивости.
Пересчёт для бюджета выглядит так. Команда, обрабатывающая 100 миллионов токенов в месяц на V4-Flash, при прежних ценах платила за выход около $18. Тот же объём в пиковом окне стоит вдвое дороже, а на V4-Pro в пик счёт уходит в сотни долларов. Единственный бесплатный способ вернуть деньги – перенести batch-нагрузку из окна 09:00–13:00 по Москве.
Что изменилось с V3 на V4
| Параметр | DeepSeek V3.2 | DeepSeek V4-Pro |
|---|---|---|
| Контекст | 128K токенов | 1 000 000 токенов |
| Параметры | 671B (37B активных) | 1.6T (49B активных) |
| Режимы мышления | отдельная модель R1 | встроено (3 уровня усилия) |
| Лицензия | Custom open | MIT |
| Макс. выход | ~8K | 393 216 токенов |
| Вход изображений | нет | нет у Pro, превью у Flash |
| Совместимость API | OpenAI-формат | OpenAI + Anthropic |
| Тарификация | плоская | пиковая и внепиковая с 16.08.2026 |
| Чипы | Nvidia H800 | Nvidia + Huawei Ascend |
Миграция со старых версий
Идентификаторы deepseek-chat и deepseek-reasoner отключены 24 июля 2026 года. До этого они перенаправлялись на V4-Flash, теперь запросы к ним просто не проходят. Актуальные идентификаторы – deepseek/deepseek-v4-flash, deepseek/deepseek-v4-pro и deepseek-v4-flash-vision-exp для входа изображений.
Заодно проверьте названия режимов рассуждения: на прямом API это low, high и max, на OpenRouter – high и xhigh. Интеграция, которая честно передавала reasoning_effort: "max" в один канал, в другом может молча уйти в дефолт.
Полезные ссылки
- Официальный сайт DeepSeek
- DeepSeek Chat – бесплатный веб-интерфейс
- Официальный ченджлог API
- Документация по API и ценам
- Модели на Hugging Face
- Анонс V4 (технический отчёт)
За четыре месяца DeepSeek поднял цены, ввёл пиковые окна, подорожал в кэше на порядок – и остался самым дешёвым флагманом в независимой таблице. Покупатель, который брал его весной «потому что дёшево», в сентябре берёт его по той же причине и платит больше.
Таблица при этом не отвечает на главный вопрос: сколько пунктов индекса теряет ваша конкретная задача. Проверить это можно только на своих сценариях, и лучше до того, как модель вшита в процесс и её замена станет отдельным проектом.
Инструмент есть. Теперь – навык
Специализация по проектному управлению: 10 уроков, каждый из которых строит переиспользуемый шаблон для вашей ежедневной работы.
Эта статья – часть серии «Обзор GenAI инструментов 2026». Все инструменты рассматриваются с практическими упражнениями в курсе mysummit.school.

Stanislav Belyaev
Engineering Leader в Microsoft18 лет в управлении инженерными командами. Основатель mysummit.school. 700+ выпускников в Яндекс Практикуме и Стратоплане.

















