DeepSeek 10 сентября 2026 года выпустил модель V4.1 Flash с открытыми весами (файлы модели можно скачать и запустить у себя) под лицензией MIT, контекстом в 1 млн токенов и ценой $0,15 за миллион новых входных токенов вне пиковых часов. С 14 сентября все запросы к старшей модели deepseek-v4-pro компания переводит на Flash по цене Flash. Для рекламной механики на обезличенных данных модель выгодна, клиентские данные в неё отправлять не стоит: по политике DeepSeek они хранятся в Китае.
Данные на 14 сентября 2026 года. Цены и сроки взяты из документации DeepSeek API, характеристики модели из её карточки на Hugging Face, независимые замеры из рейтинга Artificial Analysis.
Токен — единица, которой модели меряют текст: слово обычно занимает один или несколько токенов, страница текста занимает сотни, и именно за токены платят, когда обращаются к модели через API (программный доступ, когда модель вызывает ваш скрипт или сервис, а не человек в чате).
Что выпустил DeepSeek и что изменилось 14 сентября
10 сентября DeepSeek выложил V4.1 Flash в API и открыл веса модели на Hugging Face. В объявлении компании три факта, важные для тех, кто уже пользуется её API:
- Старые модели V4-Flash и V4-Flash-Vision-Exp выведены из работы. Запросы к ним временно перенаправляются на V4.1 Flash.
- Новые цены действуют с 04:00 по UTC 10 сентября. UTC — всемирное время, от которого отсчитывают часовые пояса.
- С 04:00 по UTC 14 сентября все запросы к deepseek-v4-pro, старшей и более дорогой модели, уходят на V4.1 Flash и оплачиваются по цене Flash.
Третий пункт вступил в силу сегодня. Если у вас или у подрядчика в сервисе прописана модель deepseek-v4-pro, с сегодняшнего дня ответы даёт другая модель, а код остался прежним. В объявлении компания пишет, что по тестам нескольких сторон Flash опережает V4-Pro по качеству, цене, скорости и общему времени работы. Но смена модели под тем же именем меняет поведение: длину ответов, формат, реакцию на ваши инструкции. Проверить стоит всё, что работает на этой модели автоматически.
Если сервис разбирает заявки, пишет тексты объявлений или сортирует поисковые запросы через deepseek-v4-pro, прогоните на нём десяток старых задач и сравните ответы с прежними. Модель под именем поменялась без вашего участия.
Что сделать сегодня, если DeepSeek у вас работает через подрядчика
Многие владельцы бизнеса не знают, какие модели крутятся внутри их чат-бота на сайте, сервиса разбора заявок или скрипта, который пишет тексты объявлений. Их выбирал разработчик или агентство. Замена модели 14 сентября — хороший повод это выяснить, потому что отвечать за результат всё равно вам.
Задайте подрядчику четыре вопроса письменно:
- Какие модели и каких поставщиков использует ваш сервис, и есть ли среди них DeepSeek.
- Какие данные уходят в модель: только обезличенный текст или также имена, телефоны, суммы.
- Кто и когда проверил работу сервиса после смены модели 14 сентября.
- Сколько сервис тратил на модели в прошлом месяце и как изменится счёт.
Если ответ на второй вопрос включает персональные данные клиентов, а в первом значится DeepSeek, этот вопрос важнее цены. Хранение данных в Китае может противоречить законам о персональных данных в стране, где работает ваш бизнес, и обещаниям, которые вы даёте клиентам в политике конфиденциальности сайта. Решение здесь юридическое, его стоит обсудить с юристом, а не с разработчиком.
Сколько стоит DeepSeek V4.1 Flash на самом деле
Цены из документации DeepSeek API за 1 млн токенов:
| Что оплачивается | Вне пиковых часов | В пиковые часы |
|---|---|---|
| Вход, повторный фрагмент из кэша | $0,003 | $0,006 |
| Вход, новый текст | $0,15 | $0,30 |
| Выход (ответ модели) | $0,60 | $1,20 |
Пиковые часы по документации: с 01:00 до 04:00 и с 06:00 до 10:00 по UTC, с понедельника по пятницу. Вне пика цена ровно вдвое ниже. Для сравнения со временем вашего офиса переведите UTC в свой пояс: для пояса UTC+3 это 04:00–07:00 и 09:00–13:00, для UTC+2 это 03:00–06:00 и 08:00–12:00. Для Европы утро рабочего дня почти целиком попадает в дорогие часы, в других поясах картину стоит пересчитать.
Кэш — механизм, при котором одинаковое начало запроса, например длинная инструкция, которую вы отправляете с каждой задачей, второй раз оплачивается по сниженной цене. У DeepSeek вход из кэша стоит в 50 раз дешевле обычного. Для рекламных задач это заметно: инструкция по разбору поисковых запросов одинакова для тысячи строк, меняется только сама строка.
Почему прайс не равен счёту: модель много пишет
Цена за токен ещё не цена за задачу. Независимый рейтинг Artificial Analysis прогнал модель в режиме максимального рассуждения по своему набору тестов. Модель набрала 40 баллов индекса, при медиане 18 среди открытых моделей похожего размера (медиана: половина моделей набрала меньше, половина больше). Но за время теста она выдала 250 млн токенов при медиане 130 млн: Artificial Analysis прямо называет её очень многословной.
Для вашего бюджета это значит, что задача, которую другая модель решает за 1 000 токенов ответа, у Flash в режиме максимального рассуждения может занять почти вдвое больше (наша оценка по соотношению 250 и 130 млн токенов). Выходные токены самые дорогие, так что экономия на прайсе частично съедается длиной ответа.
У модели есть регулятор: в карточке на Hugging Face описан уровень рассуждения от 1 до 100, который меняет цену на точность. Для механических задач вроде «отнеси запрос к одной из пяти групп» высокий уровень не нужен. Ставьте низкий и проверяйте качество на выборке, а не наоборот.
Что говорят замеры, а что только сам DeepSeek
В карточке модели DeepSeek приводит свои результаты тестов по программированию и рассуждению. Это тесты разработчика, а разработчик выбирает, какие тесты показать. Независимые замеры на сегодня дал Artificial Analysis: индекс 40 и скорость ответа 214,4 токена в секунду. Скорость важна для задач, где ответ ждёт человек.
По объявлению DeepSeek: 552 млрд параметров всего, из них при чтении запроса работают 8 млрд, при написании ответа 16 млрд. Параметры — числа внутри модели, в которых хранятся её знания; чем их больше, тем больше памяти нужно, чтобы модель запустить. Контекст до 1 млн токенов, то есть за один раз модель читает объём толстой книги. Модель понимает картинки.
Открытые веса: можно ли поставить DeepSeek у себя
Открытые веса означают, что файлы модели можно скачать и запустить на своих серверах, не отправляя данные в DeepSeek. Лицензия MIT разрешает коммерческое использование. На бумаге это решает вопрос конфиденциальности.
На практике модель с 552 млрд параметров не запускается на офисном компьютере или обычном арендном сервере. Её держат на специальных серверах с несколькими мощными видеокартами, и нужен человек, который это обслуживает. Для малого и среднего бизнеса открытые веса — скорее гарантия, что сторонние провайдеры смогут предлагать эту модель на своих серверах, чем путь к собственной установке. Если такой провайдер работает в вашей юрисдикции и хранит данные там же, вопрос о Китае снимается, но цены у него будут свои.
Какие рекламные задачи можно отдать DeepSeek, а какие нельзя
Политика конфиденциальности DeepSeek (редакция от 10 февраля 2026 года) говорит прямо: компания собирает, обрабатывает и хранит персональные данные в Китайской Народной Республике. Там же указано право отказаться от использования ваших данных для обучения моделей, для этого нужно написать на адрес privacy@deepseek.com.
Отсюда простое разделение. В лаборатории мы держим его и для своих AI-агентов: механику на обезличенных данных можно отдавать дешёвым моделям, всё, что касается клиентов и денег, нельзя.
| Можно отдавать | Не стоит отдавать |
|---|---|
| сортировку поисковых запросов по группам и поиск нецелевых | выгрузки рекламного кабинета с расходами и названиями клиентов |
| черновики заголовков объявлений по описанию товара | заявки с именами, телефонами и почтой |
| разбор открытых текстов конкурентов и отзывов | переписку с клиентами и договоры |
| перевод и адаптацию текстов для сайта | пароли, ключи доступа, выгрузки базы клиентов |
| классификацию товаров для фида | финансовую отчётность и маржу |
Возьмём пример с цифрами, это наша оценка, а не данные DeepSeek. Сортировка 10 000 поисковых запросов по пяти группам: около 500 тыс. токенов на входе (запрос плюс инструкция из кэша) и около 200 тыс. на выходе при низком уровне рассуждения. Вне пика это примерно $0,08 за вход и $0,12 за выход, всего около двадцати центов. В пиковые часы около сорока. Вручную тот же объём разбирают часами. Выгода есть, пока в запросах нет персональных данных, а поисковые запросы из отчёта обычно их не содержат.
Стоит ли переходить на DeepSeek с других моделей
Если ваши задачи механические, обезличенные и объёмные, V4.1 Flash стоит проверить: цена низкая, скорость 214 токенов в секунду по замеру Artificial Analysis, независимый индекс заметно выше медианы. Если задачи требуют работы с клиентскими данными, с документами компании или с текстом, который уйдёт в публикацию без правки, решающим будет не прайс, а то, где хранятся данные и насколько вы доверяете результату.
Мы бы начали так: выбрать одну задачу, где сейчас тратится время человека, прогнать на ней 50 примеров на Flash и на той модели, которой вы пользуетесь сейчас, и сравнить три цифры: долю правильных ответов, фактический счёт и время. Как считать окупаемость таких внедрений в целом, мы разбирали в статье окупается ли внедрение ИИ в бизнесе. Как агентства уже начали учитывать токены в себестоимости работы, читайте в разборе про счёт ИИ-агентов по токенам. Для сравнения с закрытыми моделями есть наш обзор Claude Opus 5 для бизнеса.
Хотите понять, какую рекламную рутину можно отдать ИИ без риска?
Записаться на консультацию