DeepSeek в 2026: обзор V4-Pro и V4-Flash после роста цен

18 мин чтения
Stanislav Belyaev
Stanislav Belyaev Engineering Leader в Microsoft
DeepSeek в 2026: обзор V4-Pro и V4-Flash после роста цен

DeepSeek (часто пишут «Deep Seek») – китайский AI-стартап, который за два года стал одним из лидеров индустрии. В апреле 2026 года DeepSeek выпустил V4, 13 августа V4-Pro вышла из беты, а 16 августа компания поменяла тарифную политику.

Прошлая версия этой статьи называла DeepSeek бюджетным флагманом и обещала цены в 10–50 раз ниже конкурентов. Первое по-прежнему верно. Второе пора пересчитать: DeepSeek поднял тарифы, ввёл пиковые окна, а цена попадания в кэш выросла вплоть до 1 100% относительно первых цен превью. Сама компания объясняет это переходом к роли устойчивого поставщика вычислений. Бюджет, посчитанный по весенним ценам, больше не сходится.

Для менеджера DeepSeek – по-прежнему прежде всего цена. По смешанной стоимости $0,33 за миллион токенов рядом с ним в таблице Artificial Analysis не стоит ни один флагман. Цена перестала быть агрессивной, и это меняет характер решения: выбирать DeepSeek «потому что дешевле всех» теперь надо осознанно, с пониманием, что именно вы покупаете.

Все модели доступны под лицензией MIT: можно скачать и развернуть на собственном сервере. Публичный эндпоинт при этом работает на FP4-квантовании, то есть ответы API и ответы локально развёрнутой модели из полных весов совпадать не обязаны.

Интерфейс DeepSeek
Интерфейс DeepSeek

В чём особенность DeepSeek?

V4-Pro – МоE-модель на 1,6 триллиона параметров, из которых на каждом токене активны 49 миллиардов. Платите вы за активную часть, поэтому при размере флагмана стоимость запроса остаётся низкой. Гибридное внимание и сжатие KV-кэша уменьшают расход на длинном контексте.

  • Контекстное окно 1 048 576 токенов – примерно 750 000 слов, около 2 500 страниц текста.
  • Потолок ответа 393 216 токенов, самый большой среди всех моделей этого сравнения.
  • Три уровня усилия размышления. В API DeepSeek они называются low, high и max; на OpenRouter та же модель отдаёт high и xhigh. Если пишете интеграцию, сверяйте названия режимов у конкретного провайдера – они не совпадают.

Основные модели DeepSeek (сентябрь 2026)

DeepSeek V4-Pro

DeepSeek DeepSeek V4 Pro Разбирается в деталях балл 7.8 #21 из 47 $0.005 за задачу доступен из РФ
протестировано: май 2026 · бенчмарк mysummit.school О модели → Сравнить →

Флагман, 13 августа 2026 года вышел в общий доступ в приложении, вебе и API. Универсальный ассистент: тексты, анализ, код, работа с данными. Модель по-прежнему текстовая – на карточке Pro нет ни входа изображений, ни аудио, ни видео.

Цифры производителя из отчёта о том же релизе: Terminal Bench 2.1 – 87,9 и HLE с инструментами – 60,0. DSBench-FullStack – 71,1. Для варианта V4-Pro-Max заявлены LiveCodeBench 93,5 и SWE-bench Verified 80,6; там же Codeforces 3 206 и MRCR на миллионе токенов – 83,5. Это оценки самого DeepSeek, и ниже будет независимая картина, которая выглядит скромнее.

  • Контекст 1 000 000 токенов на вход, до 393 216 токенов на выход
  • Инструменты, tool_choice, структурированный вывод в JSON
  • Веса под MIT, публичный эндпоинт – FP4

Потолок ответа стоит обсудить отдельно. 393 216 токенов – это около 295 000 слов, годовой отчёт крупной компании за один проход. У остальных участников сравнения потолок ниже в разы, и для любого, кто генерирует длинные документы, это единственная характеристика, которую не заменяет никакая оценка интеллекта.

DeepSeek V4-Flash

DeepSeek DeepSeek V4 Flash Понимает простые задачи балл 7.5 #28 из 47 $0.001 за задачу доступен из РФ
протестировано: май 2026 · бенчмарк mysummit.school О модели → Сравнить →

Быстрая и дешёвая модель, 284 миллиарда параметров. Официальный релиз в статусе публичной беты состоялся 31 июля 2026; главным в нём производитель назвал агентные способности и поддержку Responses API для Codex. Terminal Bench 2.1 – 82,7 по данным производителя.

Контекст тот же, миллион токенов. Режимы мышления те же. Модель рассчитана на потоковые задачи: чат-боты, обработка документов, массовые запросы.

Держать в голове стоит одно: Qwen3.8-Flash-Next обходит V4-Flash на большинстве протестированных задач при заметно меньшем числе активных параметров. V4-Flash за лето перестал быть сильнейшей моделью в своём сегменте.

Зрение: deepseek-v4-flash-vision-exp

21 августа 2026 DeepSeek выпустил первую модель с входом изображений. Она вызывается как model='deepseek-v4-flash-vision-exp' и тарифицируется по ставкам V4-Flash.

Заявленное назначение – автоматизация интерфейсов и разбор графиков. Модель принимает статические изображения и последовательности скриншотов; настоящий видеопоток она не обрабатывает. Chartography – 64,3, производитель также утверждает, что мультимодальные агентные способности приближаются к Opus 4.8. Обе цифры – его собственные.

В наш бенчмарк модель ещё не входит, независимых оценок у неё пока тоже нет – только данные производителя.

Суффикс -exp здесь рабочий. Это превью: строить на нём продакшн-процесс нельзя, и в любой момент может поменяться поведение или цена. Зрение появилось на дешёвом тире – флагман остался текстовым.

Генерация изображений по-прежнему живёт в отдельной линии Janus-Pro-7B: GenEval 80% против 67% у DALL-E 3 при ограничении разрешения в 384×384 px.

Мультимодальность DeepSeek
Пример мультимодальности DeepSeek – распознавание контента с изображений

Промпты для DeepSeek выглядят простыми: загрузил документ, попросил вывод. Сложность начинается там, где ответ нужен точный – с числами, которые сходятся, и с рисками, не потерявшимися на второй странице. Разница между «модель ответила» и «моделью можно работать» – это навык постановки задачи.

Дешёвая модель требует такой же точной постановки задачи. 9 практических задач менеджера в бесплатном модуле – без регистрации.

Доступ сразу после регистрации

Начать обучение

Сравнение с конкурентами

Что говорят независимые площадки

Сентябрьский срез Artificial Analysis по десяти ведущим моделям. Индекс интеллекта, смешанная цена за миллион токенов и скорость вывода – всё по одной методике, что и делает таблицу полезной.

МодельВендорIntelligence IndexСмешанная цена, $/1MВывод, ток/с
Claude Fable 5.1 (max)Anthropic57$6,1270
GPT-6 Astra (max)OpenAI55$2,5771
Claude Opus 5 (max)Anthropic54$4,2158
Grok 4.6 (high)xAI51$1,2563
Kimi K3 (max)Moonshot50$1,5842
GLM-5.3 (max)Z.ai49$1,2687
Gemini 3.8 Flash (high)Google47$0,74334
Qwen3.8-MaxAlibaba47$1,1940
GLM-5.3-FlashZ.ai46$0,1848
DeepSeek V4-Pro 0813 (max)DeepSeek42$0,3371

DeepSeek V4-Pro занимает в этой таблице последнее место по интеллекту; дешевле него только GLM-5.3-Flash, и тот из другого класса. Разброс между первой и последней строкой – 15 пунктов индекса, а между самой дорогой и самой дешёвой ценой среза – 34 раза. Это и есть честное позиционирование DeepSeek на сентябрь 2026: его берут за цену.

Оговорка про саму шкалу. Artificial Analysis публикует индекс версиями и перемасштабирует его между ними, поэтому «60» из релизного поста вендора и «42» из текущего среза – числа из разных систем координат. Сравнивать имеет смысл только внутри одного среза. Как устроено измерение в принципе – в разборе «Как работают бенчмарки LLM в 2026».

LMArena даёт вторую картину: в десятке лучших ни по тексту, ни по зрению DeepSeek там нет. У девяти верхних строк текстового рейтинга доверительные интервалы перекрываются – позиции с первой по девятую статистически неразличимы. Любое «модель X – лучшая» отсюда – это чтение рейтинга сверх того, что он измеряет, ровно тот аргумент, который серия уже разбирала в статье «Бенчмарки ИИ теряют смысл».

Китайские соседи

Kimi K3 – главный китайский конкурент DeepSeek по агентным задачам. В срезе Artificial Analysis он набирает 50 пунктов индекса при смешанной цене $1,58, то есть стоит примерно в пять раз дороже V4-Pro и на восемь пунктов выше него. В наш бенчмарк K3 как модель ещё не входит, и здесь приведены данные независимой площадки.

Отдельная неприятная для DeepSeek строка в той же таблице – GLM-5.3-Flash. 46 пунктов индекса и $0,18 смешанной цены: на четыре пункта выше V4-Pro и почти вдвое дешевле. Аргумент «возьмём DeepSeek, потому что дешевле китайских аналогов» больше не работает автоматически.

Где V4-Pro сильнее

  • Потолок ответа 393 216 токенов – максимальный в сравнении. Для генерации длинных документов конкурентов с такой цифрой в этой таблице нет.
  • Длинный контекст за вменяемые деньги: миллион токенов входа при цене порядка $0,435 за миллион на прямом доступе вне пика.
  • Код по данным производителя: LiveCodeBench 93,5 и SWE-bench Verified 80,6 у V4-Pro-Max.
  • Лицензия MIT на веса: модель можно забрать внутрь контура, чего нельзя сделать с закрытыми флагманами из верхней части таблицы.

Где V4-Pro уступает

  • Независимая оценка качества. 42 пункта Artificial Analysis – последняя строка среди десяти моделей этого среза.
  • Разрыв между цифрами производителя и независимой проверкой. Производитель заявляет 87,9 по Terminal Bench 2.1 и 60,0 по HLE с инструментами, независимый индекс при этом ставит модель в конец списка. Оба числа получены честно, они просто отвечают на разные вопросы.
  • Мультимодальность. У флагмана её нет вообще, у Flash она в статусе превью. У Claude, GPT и Gemini анализ изображений встроен в основную модель.
  • Коммуникация. По нашим данным, один из худших результатов среди топ-моделей в задачах на формулировку обратной связи.

Впрочем, разрыв в агентных задачах сокращается не только сменой модели. В августе 2026 исследование StateM подняло DeepSeek-V4 Flash с 82,7% до 88,1% на Terminal-Bench 2.1 без смены весов – только за счёт обвязки вокруг модели: ранбуков, постоянного состояния и проверки шагов. Что именно там сделано и почему это важно для доступных из России моделей – в разборе свежих бенчмарков промпт-инжиниринга.

Знать, какая модель дешевле, полезно. Полезнее уметь объяснить, почему на вашей задаче дешёвая модель даёт приемлемый результат, а на соседней – нет.

Бесплатный модуль

Точная постановка задачи решает больше, чем выбор модели

Бесплатный модуль – это 9 практических задач менеджера: статус-отчёт за пять минут, письмо клиенту, скрининг резюме. Каждая сначала даёт убедительный результат, а потом показывает, какую ошибку вы в нём не заметили.

Детальный разбор инструментов с примерами
Готовые промпты для типовых задач
Навыки безопасного использования AI
Понимание, как измерять ROI

Продолжите обучение

Откройте учебник и продолжите с того места, где остановились

Открыть учебник

Практическое применение для менеджера

  • «Перевод» с технического на человеческий – обобщение сложного технического отчёта в краткую записку для руководства.
  • Проверка логики решений (режим max) – загрузите бизнес-план и попросите найти слабые места. Максимальный уровень рассуждения указывает на неочевидные риски.
  • Анализ данных – опишите словами, что хотите узнать из таблицы Excel, и DeepSeek напишет формулы или скрипт.
  • Работа с большими документами – загрузите регламент или годовой отчёт (до ~2 500 страниц) и задавайте вопросы. Контекст в миллион токенов вмещает целые кодовые базы или корпоративные базы знаний.
  • Длинные документы на выход – потолок в 393 216 токенов позволяет просить связный текст на сотни страниц за один запрос, без склейки кусков.
  • Ускорение работы IT-команды – написание кода, проверка, тесты и документация.

Попробуйте сами: анализ рискованного решения

Ниже – управленческий кейс с неочевидными проблемами. Нажмите «Выполнить» и сравните, как V4-Pro, V4-Flash и Kimi K3 справляются с поиском рисков. Обратите внимание на глубину рассуждений и конкретность рекомендаций.

Попробуйте сами
Поиск рисков в бизнес-решении – V4-Pro vs V4-Flash vs Kimi
Вы
Ты – опытный бизнес-аналитик. Найди скрытые риски в следующем решении. ## Решение Сеть из 40 кофеен в Москве планирует за 3 месяца перевести все точки на полностью автоматизированное приготовление кофе (роботы-бариста). Бюджет: 120 млн руб. Ожидаемая экономия на ФОТ: 8 млн руб/мес. Окупаемость: 15 месяцев. Пилот на 2 точках показал рост скорости обслуживания на 40%. ## Контекст - 340 сотрудников-бариста подлежат сокращению - Договор аренды на 60% точек истекает через 18 месяцев - Средний чек: 380 руб, 70% выручки – утренний час пик (7:00–9:30) - NPS текущих клиентов: 72 ## Задание 1. Найди 3–5 рисков, которые авторы решения могли упустить 2. Для каждого: вероятность (высокая/средняя/низкая) и ущерб 3. Конкретные действия по снижению каждого риска 4. Какие предположения не подкреплены данными? 5. Итоговая рекомендация: принять, доработать или отклонить
Сравниваем:
deepseek-v4-pro · deepseek-v4-flash · kimi-k3

На что обратить внимание в ответах:

  • V4-Pro на максимальном уровне рассуждения выстраивает цепочку анализа и чаще находит неочевидные связи (аренда + сокращение = репутационный риск; пилот на 2 точках не показателен для 40)
  • V4-Flash отвечает быстрее и дешевле, но чаще пропускает взаимосвязи между рисками
  • Kimi K3 обычно структурирует ответ подробнее, но может быть избыточным

Кейс выше – заготовка: настоящая проверка начинается на ваших числах. 9 практических задач менеджера в бесплатном модуле помогут понять, какая модель нужна под вашу задачу. Без регистрации.

Доступ сразу после регистрации

Начать обучение

Обновление: наш бенчмарк, новые цены и Яндекс Облако (сентябрь 2026)

В нашем бенчмарке управленческих задач (42 модели, 80 сценариев) DeepSeek V4 проверялся на весенних ценах. Результаты по качеству остаются в силе, цифры по стоимости – уже нет.

DeepSeek V4-Pro

DeepSeek V4 Pro в 8 категориях задач

Шкала 0–10. Чем выше — тем лучше модель справилась с задачами

chart

С ценами сейчас разнобой, и лучше показывать всю картину, чем выбирать одну удобную цифру. DeepSeek напрямую вне пика просит около $0,435 за миллион токенов на вход и $0,87 на выход, попадание в кэш – порядка $0,0036. Смешанная цена OpenRouter по 16–17 провайдерам – около $0,69 и $1,37, чтение кэша $0,057. Расхождение даёт и сама пиковая тарификация, и то, что каждый провайдер закладывает свою маржу. Для бюджета берите тот канал, через который реально пойдёт трафик.

Кому модель подходит по нашим сценариям: планы внедрения процессов, скрипты сложных командных разговоров, массовая рутинная переписка. Где она систематически подводит: ROI и финансовые модели с ошибками в расчётах, юридические обоснования, анализ тарифов SaaS.

DeepSeek V4-Flash

$0,09/$0,18 за миллион токенов вне пика – это последняя опубликованная цена модели, и в пиковые окна она удваивается. В нашем бенчмарке Flash занял место выше Gemini 3.1 Pro при цене в два порядка ниже. Рабочая модель для текстов и планов, если расписание запросов удаётся развести по тарифным окнам.

Подходит: еженедельные отчёты, классификация обратной связи, квартальные планы и матрицы рисков. Не подходит: бюджеты и финансовые модели, международное право и GDPR, код автоматизации.

DeepSeek на Яндекс Облаке – стоит ли?

Яндекс предлагает DeepSeek V4 Flash через свой API. DeepSeek V4 Flash (Yandex Cloud) – та же самая модель, но с фиксированной ценой, и после августовских изменений картина наценки стала зависеть от времени суток.

ПараметрDeepSeek напрямую, вне пикаDeepSeek напрямую, в пикЯндекс Облако
Input за 1M$0,09$0,18$3,00
Output за 1M$0,18$0,36$5,00
Наценка Яндекса×33 на вход, ×28 на выход×17 на вход, ×14 на выход

В весенней версии статьи здесь стояла наценка 28–33 раза. Она никуда не делась, просто перестала быть единственной: пиковые окна сокращают разрыв вдвое.

За что платите: прямой доступ из России без VPN, SLA от Яндекса, хранение данных в РФ, контекстное окно в миллион токенов. Вердикт тот же, но с поправкой на расписание. Командам, которые уже работают в Яндекс Облаке и автоматизируют задачи без отдельного AI-бюджета, такая переплата может быть оправдана. Если VPN не проблема и трафик удаётся увести из пиковых окон, прямой доступ дешевле в десятки раз, а по нашему бенчмарку ещё и немного точнее.

Предыдущие поколения

DeepSeek V3.2 (протестирован ранее) – крепкий верхний средний уровень. Особенно силён в планировании и решении проблем. Серьёзный пробел – коммуникация: один из худших результатов среди всех протестированных моделей.

DeepSeek R1 – сопоставимый уровень. Сильные стороны – поиск информации и аналитика, где пошаговое мышление даёт заметное преимущество.

Цена vs Качество: где модель на карте рынка

Каждая точка – модель из BenchLM. Выше – сильнее, левее – дешевле. Выделены модели из этого обзора.

Полные интерактивные результаты ->

Подробный разбор по категориям – в статье о лучших AI для менеджера в России.

Ограничения и риски

  • Мультимодальность в статусе превью – флагман V4-Pro текстовый, вход изображений появился 21 августа только на Flash-тире и с суффиксом -exp. Реальное видео модель не обрабатывает. Генерация изображений – отдельная линия Janus-Pro с разрешением 384×384. У Claude, GPT и Gemini мультимодальность встроена в основную модель.
  • Безопасность контента – защитные фильтры слабее, чем у ChatGPT и Claude. Модель легче «уговорить» сгенерировать нежелательный контент.
  • Конфиденциальность данных – компания базируется в Китае. Решение: скачать модель (MIT-лицензия) и развернуть локально – дистилляты DeepSeek на 7B и 14B запускаются на обычном ноутбуке. Помнить при этом про FP4 на публичном эндпоинте: поведение API и локальной сборки из полных весов различается.
  • Меньше готовых интеграций – нет официальных плагинов для CRM, ERP. Но поддерживает формат API OpenAI и Anthropic – большинство инструментов работают через адаптер.
  • Стабильность API – в пиковые часы бывают задержки и отказы. С 16 августа пик зафиксирован в тарифах, что намекает на то, где именно нагрузка максимальна. Для продакшн-систем стоит использовать прокси-провайдеров (DeepInfra, Together.ai, OpenRouter).
  • Ломка старых интеграций – идентификаторы deepseek-chat и deepseek-reasoner отключены 24 июля 2026 года. Если интеграцию не обновили, она уже не работает.
  • Китайский язык как приоритет – на русском качество хорошее. По нашим данным, DeepSeek V3.2 превосходит все российские модели (включая Alice AI и GigaChat) даже в задачах с российской спецификой.

Тарифы и доступность

С 16 августа 2026 DeepSeek считает токены по двум ставкам. Пиковые окна – 01:00–04:00 и 06:00–10:00 UTC, внутри них цена вдвое выше. По московскому времени это 04:00–07:00 и 09:00–13:00.

Второе окно накрывает российское рабочее утро целиком. Всё, что гоняется интерактивно с девяти до часу, платит двойную ставку; всё, что можно увести в ночной батч, платит половину. Разница между этими двумя режимами работы – ровно два раза, и ни на одной странице с ценами вы её не увидите: она зависит от вашего расписания.

КаналInput за 1MOutput за 1MКэш
DeepSeek напрямую, вне пика$0,435$0,87~$0,0036
DeepSeek напрямую, в пик~$0,87~$1,74вдвое дороже внепикового
OpenRouter, смешанная по 16–17 провайдерам~$0,69~$1,37$0,057 на чтение
DeepSeek V4-Flash напрямую, вне пика$0,09$0,18~$0,014
  • Бесплатный доступ – на chat.deepseek.com можно пользоваться бесплатно, включая глубокий режим рассуждения.
  • Open source (MIT) – все модели доступны для скачивания, коммерческого использования и доработки без ограничений.
  • Кэш подорожал сильнее всего – ставка на попадание в кэш для V4-Pro выросла вплоть до 1 100% относительно первых цен превью. Сценарии, где экономия строилась на повторных запросах с длинным общим префиксом, стоит пересчитать заново.
  • Скидка 75%, объявленная весной временной, летом стала постоянной, а в августе к ней добавилась пиковая надбавка. Итог: стандартная цена V4-Pro на выходе – $0,87 вне пика и около $1,74 в пик.
  • Провайдеры расходятся в цене – прямой доступ DeepSeek дешевле смешанной ставки OpenRouter примерно в полтора раза, зато OpenRouter закрывает вопрос доступности и отказоустойчивости.

Пересчёт для бюджета выглядит так. Команда, обрабатывающая 100 миллионов токенов в месяц на V4-Flash, при прежних ценах платила за выход около $18. Тот же объём в пиковом окне стоит вдвое дороже, а на V4-Pro в пик счёт уходит в сотни долларов. Единственный бесплатный способ вернуть деньги – перенести batch-нагрузку из окна 09:00–13:00 по Москве.

Что изменилось с V3 на V4

ПараметрDeepSeek V3.2DeepSeek V4-Pro
Контекст128K токенов1 000 000 токенов
Параметры671B (37B активных)1.6T (49B активных)
Режимы мышленияотдельная модель R1встроено (3 уровня усилия)
ЛицензияCustom openMIT
Макс. выход~8K393 216 токенов
Вход изображенийнетнет у Pro, превью у Flash
Совместимость APIOpenAI-форматOpenAI + Anthropic
Тарификацияплоскаяпиковая и внепиковая с 16.08.2026
ЧипыNvidia H800Nvidia + Huawei Ascend

Миграция со старых версий

Идентификаторы deepseek-chat и deepseek-reasoner отключены 24 июля 2026 года. До этого они перенаправлялись на V4-Flash, теперь запросы к ним просто не проходят. Актуальные идентификаторы – deepseek/deepseek-v4-flash, deepseek/deepseek-v4-pro и deepseek-v4-flash-vision-exp для входа изображений.

Заодно проверьте названия режимов рассуждения: на прямом API это low, high и max, на OpenRouter – high и xhigh. Интеграция, которая честно передавала reasoning_effort: "max" в один канал, в другом может молча уйти в дефолт.

Полезные ссылки


За четыре месяца DeepSeek поднял цены, ввёл пиковые окна, подорожал в кэше на порядок – и остался самым дешёвым флагманом в независимой таблице. Покупатель, который брал его весной «потому что дёшево», в сентябре берёт его по той же причине и платит больше.

Таблица при этом не отвечает на главный вопрос: сколько пунктов индекса теряет ваша конкретная задача. Проверить это можно только на своих сценариях, и лучше до того, как модель вшита в процесс и её замена станет отдельным проектом.

Специализация

Инструмент есть. Теперь – навык

Специализация по проектному управлению: 10 уроков, каждый из которых строит переиспользуемый шаблон для вашей ежедневной работы.

От pre-mortem до антикризисного плана
Переиспользуемые промпт-шаблоны
Сквозной кейс на реальном проекте
~300 часов экономии в год

Эта статья – часть серии «Обзор GenAI инструментов 2026». Все инструменты рассматриваются с практическими упражнениями в курсе mysummit.school.

Stanislav Belyaev

Stanislav Belyaev

Engineering Leader в Microsoft

18 лет в управлении инженерными командами. Основатель mysummit.school. 700+ выпускников в Яндекс Практикуме и Стратоплане.