Lab Leadersлаборатория роста бизнеса

DeepSeek V4.1 Flash: цена, замена V4-Pro с 14 сентября и какие задачи ему можно доверить

Опубликовано 14 сентября 2026 г.9 мин чтения

DeepSeek 10 сентября 2026 года выпустил модель V4.1 Flash с открытыми весами (файлы модели можно скачать и запустить у себя) под лицензией MIT, контекстом в 1 млн токенов и ценой $0,15 за миллион новых входных токенов вне пиковых часов. С 14 сентября все запросы к старшей модели deepseek-v4-pro компания переводит на Flash по цене Flash. Для рекламной механики на обезличенных данных модель выгодна, клиентские данные в неё отправлять не стоит: по политике DeepSeek они хранятся в Китае.

Данные на 14 сентября 2026 года. Цены и сроки взяты из документации DeepSeek API, характеристики модели из её карточки на Hugging Face, независимые замеры из рейтинга Artificial Analysis.

Токен — единица, которой модели меряют текст: слово обычно занимает один или несколько токенов, страница текста занимает сотни, и именно за токены платят, когда обращаются к модели через API (программный доступ, когда модель вызывает ваш скрипт или сервис, а не человек в чате).

Что выпустил DeepSeek и что изменилось 14 сентября

10 сентября DeepSeek выложил V4.1 Flash в API и открыл веса модели на Hugging Face. В объявлении компании три факта, важные для тех, кто уже пользуется её API:

  1. Старые модели V4-Flash и V4-Flash-Vision-Exp выведены из работы. Запросы к ним временно перенаправляются на V4.1 Flash.
  2. Новые цены действуют с 04:00 по UTC 10 сентября. UTC — всемирное время, от которого отсчитывают часовые пояса.
  3. С 04:00 по UTC 14 сентября все запросы к deepseek-v4-pro, старшей и более дорогой модели, уходят на V4.1 Flash и оплачиваются по цене Flash.

Третий пункт вступил в силу сегодня. Если у вас или у подрядчика в сервисе прописана модель deepseek-v4-pro, с сегодняшнего дня ответы даёт другая модель, а код остался прежним. В объявлении компания пишет, что по тестам нескольких сторон Flash опережает V4-Pro по качеству, цене, скорости и общему времени работы. Но смена модели под тем же именем меняет поведение: длину ответов, формат, реакцию на ваши инструкции. Проверить стоит всё, что работает на этой модели автоматически.

Что сделать сегодня, если DeepSeek у вас работает через подрядчика

Многие владельцы бизнеса не знают, какие модели крутятся внутри их чат-бота на сайте, сервиса разбора заявок или скрипта, который пишет тексты объявлений. Их выбирал разработчик или агентство. Замена модели 14 сентября — хороший повод это выяснить, потому что отвечать за результат всё равно вам.

Задайте подрядчику четыре вопроса письменно:

  1. Какие модели и каких поставщиков использует ваш сервис, и есть ли среди них DeepSeek.
  2. Какие данные уходят в модель: только обезличенный текст или также имена, телефоны, суммы.
  3. Кто и когда проверил работу сервиса после смены модели 14 сентября.
  4. Сколько сервис тратил на модели в прошлом месяце и как изменится счёт.

Если ответ на второй вопрос включает персональные данные клиентов, а в первом значится DeepSeek, этот вопрос важнее цены. Хранение данных в Китае может противоречить законам о персональных данных в стране, где работает ваш бизнес, и обещаниям, которые вы даёте клиентам в политике конфиденциальности сайта. Решение здесь юридическое, его стоит обсудить с юристом, а не с разработчиком.

Сколько стоит DeepSeek V4.1 Flash на самом деле

Цены из документации DeepSeek API за 1 млн токенов:

Что оплачиваетсяВне пиковых часовВ пиковые часы
Вход, повторный фрагмент из кэша$0,003$0,006
Вход, новый текст$0,15$0,30
Выход (ответ модели)$0,60$1,20

Пиковые часы по документации: с 01:00 до 04:00 и с 06:00 до 10:00 по UTC, с понедельника по пятницу. Вне пика цена ровно вдвое ниже. Для сравнения со временем вашего офиса переведите UTC в свой пояс: для пояса UTC+3 это 04:00–07:00 и 09:00–13:00, для UTC+2 это 03:00–06:00 и 08:00–12:00. Для Европы утро рабочего дня почти целиком попадает в дорогие часы, в других поясах картину стоит пересчитать.

Кэш — механизм, при котором одинаковое начало запроса, например длинная инструкция, которую вы отправляете с каждой задачей, второй раз оплачивается по сниженной цене. У DeepSeek вход из кэша стоит в 50 раз дешевле обычного. Для рекламных задач это заметно: инструкция по разбору поисковых запросов одинакова для тысячи строк, меняется только сама строка.

$0,003
за 1 млн токенов из кэша вне пиковых часов
Source: Документация DeepSeek API, 14.09.2026

Почему прайс не равен счёту: модель много пишет

Цена за токен ещё не цена за задачу. Независимый рейтинг Artificial Analysis прогнал модель в режиме максимального рассуждения по своему набору тестов. Модель набрала 40 баллов индекса, при медиане 18 среди открытых моделей похожего размера (медиана: половина моделей набрала меньше, половина больше). Но за время теста она выдала 250 млн токенов при медиане 130 млн: Artificial Analysis прямо называет её очень многословной.

Для вашего бюджета это значит, что задача, которую другая модель решает за 1 000 токенов ответа, у Flash в режиме максимального рассуждения может занять почти вдвое больше (наша оценка по соотношению 250 и 130 млн токенов). Выходные токены самые дорогие, так что экономия на прайсе частично съедается длиной ответа.

У модели есть регулятор: в карточке на Hugging Face описан уровень рассуждения от 1 до 100, который меняет цену на точность. Для механических задач вроде «отнеси запрос к одной из пяти групп» высокий уровень не нужен. Ставьте низкий и проверяйте качество на выборке, а не наоборот.

Как считают обычно
Цена за миллион токенов умножается на объём текста. Выходят центы, модель кажется бесплатной.
Как считать честно
Прогнать 50 реальных задач, посмотреть фактический счёт в кабинете API и длину ответов, умножить на месячный объём. Отдельно учесть пиковые часы.

Что говорят замеры, а что только сам DeepSeek

В карточке модели DeepSeek приводит свои результаты тестов по программированию и рассуждению. Это тесты разработчика, а разработчик выбирает, какие тесты показать. Независимые замеры на сегодня дал Artificial Analysis: индекс 40 и скорость ответа 214,4 токена в секунду. Скорость важна для задач, где ответ ждёт человек.

По объявлению DeepSeek: 552 млрд параметров всего, из них при чтении запроса работают 8 млрд, при написании ответа 16 млрд. Параметры — числа внутри модели, в которых хранятся её знания; чем их больше, тем больше памяти нужно, чтобы модель запустить. Контекст до 1 млн токенов, то есть за один раз модель читает объём толстой книги. Модель понимает картинки.

Открытые веса: можно ли поставить DeepSeek у себя

Открытые веса означают, что файлы модели можно скачать и запустить на своих серверах, не отправляя данные в DeepSeek. Лицензия MIT разрешает коммерческое использование. На бумаге это решает вопрос конфиденциальности.

На практике модель с 552 млрд параметров не запускается на офисном компьютере или обычном арендном сервере. Её держат на специальных серверах с несколькими мощными видеокартами, и нужен человек, который это обслуживает. Для малого и среднего бизнеса открытые веса — скорее гарантия, что сторонние провайдеры смогут предлагать эту модель на своих серверах, чем путь к собственной установке. Если такой провайдер работает в вашей юрисдикции и хранит данные там же, вопрос о Китае снимается, но цены у него будут свои.

Какие рекламные задачи можно отдать DeepSeek, а какие нельзя

Политика конфиденциальности DeepSeek (редакция от 10 февраля 2026 года) говорит прямо: компания собирает, обрабатывает и хранит персональные данные в Китайской Народной Республике. Там же указано право отказаться от использования ваших данных для обучения моделей, для этого нужно написать на адрес privacy@deepseek.com.

Отсюда простое разделение. В лаборатории мы держим его и для своих AI-агентов: механику на обезличенных данных можно отдавать дешёвым моделям, всё, что касается клиентов и денег, нельзя.

Можно отдаватьНе стоит отдавать
сортировку поисковых запросов по группам и поиск нецелевыхвыгрузки рекламного кабинета с расходами и названиями клиентов
черновики заголовков объявлений по описанию товаразаявки с именами, телефонами и почтой
разбор открытых текстов конкурентов и отзывовпереписку с клиентами и договоры
перевод и адаптацию текстов для сайтапароли, ключи доступа, выгрузки базы клиентов
классификацию товаров для фидафинансовую отчётность и маржу

Возьмём пример с цифрами, это наша оценка, а не данные DeepSeek. Сортировка 10 000 поисковых запросов по пяти группам: около 500 тыс. токенов на входе (запрос плюс инструкция из кэша) и около 200 тыс. на выходе при низком уровне рассуждения. Вне пика это примерно $0,08 за вход и $0,12 за выход, всего около двадцати центов. В пиковые часы около сорока. Вручную тот же объём разбирают часами. Выгода есть, пока в запросах нет персональных данных, а поисковые запросы из отчёта обычно их не содержат.

Стоит ли переходить на DeepSeek с других моделей

Если ваши задачи механические, обезличенные и объёмные, V4.1 Flash стоит проверить: цена низкая, скорость 214 токенов в секунду по замеру Artificial Analysis, независимый индекс заметно выше медианы. Если задачи требуют работы с клиентскими данными, с документами компании или с текстом, который уйдёт в публикацию без правки, решающим будет не прайс, а то, где хранятся данные и насколько вы доверяете результату.

Мы бы начали так: выбрать одну задачу, где сейчас тратится время человека, прогнать на ней 50 примеров на Flash и на той модели, которой вы пользуетесь сейчас, и сравнить три цифры: долю правильных ответов, фактический счёт и время. Как считать окупаемость таких внедрений в целом, мы разбирали в статье окупается ли внедрение ИИ в бизнесе. Как агентства уже начали учитывать токены в себестоимости работы, читайте в разборе про счёт ИИ-агентов по токенам. Для сравнения с закрытыми моделями есть наш обзор Claude Opus 5 для бизнеса.

Хотите понять, какую рекламную рутину можно отдать ИИ без риска?

Записаться на консультацию

Частые вопросы

Полезна ли статья?
Автор
Фёдор Шеришев
Google Ads × AI · основатель Lab Leaders

Основатель Lab Leaders. Google Partners с 2017 года, владелец мебельного производства Ideal Comfort. Строю бизнесы с помощью Google Ads и AI-агентов.

Читать дальше

Агентства начали считать ИИ-агентов по токенам: у автоматизации нашлась себестоимость

Агент уже не советует, а сам закупает рекламу, и у этой работы обнаружилась своя себестоимость. Считать её пока никто толком не умеет, а нижняя граница бюджета у такой автоматизации есть.

7 мин

OpenAI отключает Cursor от своих моделей 12 ноября: чему это учит бизнес

OpenAI закрывает Cursor прямой доступ к своим моделям с 12 ноября 2026 года. Причина не техническая: компания заявляет, что не уверена в соблюдении условий новым владельцем. Разбираем, что это значит для тех, кто уже встроил нейросети в рабочие процессы.

9 мин

Claude Opus 5 для бизнеса: вдвое дешевле флагмана и регулятор усилий

Anthropic выпустила Opus 5 по цене вдвое ниже флагмана и добавила регулятор глубины проработки. Что это меняет в автоматизации рекламных процессов малого бизнеса.

8 мин

Claude Fable 5 с 20 июля: кому модель оставили в подписке, кому обещали $100 и почему подписка больше не гарантия

С 20 июля Claude Fable 5 остаётся только в планах Max и Team Premium - в пределах 50% недельных лимитов. Pro и Team Standard получают разовый кредит $100, дальше оплата за токены. Мы сверили анонс с официальными страницами Anthropic и посчитали, во что это выльется бизнесу.

9 мин