22 мая 2026 года DeepSeek отменил окончание собственной акции. Промо-скидка 75% на флагманскую модель V4-Pro должна была сгореть 31 мая в 15:59 UTC, а вместо этого за девять дней до дедлайна превратилась в постоянный прайс: миллион входящих токенов стоит $0,435 вместо $1,74, миллион исходящих - $0,87 вместо $3,48, и даты окончания у этого прайса нет. По официальной странице цен, сверенной 19 июля 2026, условия действуют до сих пор.
Ищут эту нейросеть по-русски как попало: димсик, дипсид, дипсих, диптик, дигпик, липсик. Все шесть слов - про один и тот же DeepSeek, и запрос «димсик нейросеть» сейчас ведёт на ценовое событие, ради которого написан этот текст. Вторая строка из тех же подсказок - про кэш: попадание в контекстный кэш стоит $0,003625 за миллион токенов, то есть ровно в 120 раз дешевле обычного ввода. Дальше - хронология, математика выгоды и оплата из России.
Загвоздка для читателя из РФ одна, и она неприятная: оплатить эти копейки напрямую российской картой не выйдет - процессинг DeepSeek отклоняет её по BIN-коду. Поэтому часть команд заходит через агрегаторы вроде provod.ai (российский OpenRouter), где те же модели доступны в рублях по официальным тарифам.
Что именно случилось с ценами DeepSeek V4 22 мая 2026?
Коротко: временная скидка 75% на V4-Pro стала постоянной ценой. Ввод подешевел с $1,74 до $0,435 за миллион токенов, вывод - с $3,48 до $0,87, кэш-хит - с $0,0145 до $0,003625. Дата окончания из прайса исчезла и на 19 июля 2026 не вернулась.
Хронология по анонсам и сводам:
- 24 апреля 2026 - лонч DeepSeek V4 Preview: две open-weight модели, V4-Pro и V4-Flash, контекст 1M токенов, лицензия MIT, веса на Hugging Face.
- Весна 2026 - на V4-Pro действует промо-скидка 75% с дедлайном 31 мая, 15:59 UTC.
- 22 мая 2026 - промо превращается в постоянный прайс, дата окончания убирается из условий.
- 24 июля 2026, 15:59 UTC - полностью отключат старые алиасы deepseek-chat и deepseek-reasoner (об этом отдельная секция ниже).
Меня здесь радует перманентность: обычно такие акции сгорают ровно тогда, когда ты построил на них юнит-экономику, а тут цену в четверть от стартовой признали нормой. Оговорка всё же нужна: компания оставляет за собой право менять цены и советует следить за страницей прайса - «навсегда» означает «без анонсированной даты окончания», а не юридическое обязательство.
$0,435 за миллион - это много или мало?
Коротко: в этой таблице V4-Flash дешевле V4-Pro по входу: $0,14 против $0,435 за 1M токенов. Смешанная нагрузка (миллион токенов на входе плюс миллион на выходе) обходится на V4-Pro примерно в $1,31 против $30 у Claude Opus 4.7 и $35 у GPT-5.5: разрыв в 23 и 27 раз посчитан по своду Codersera от 28 мая 2026.
| Модель | Ввод, $/1M | Вывод, $/1M | Кэш-хит ввода, $/1M |
|---|---|---|---|
| DeepSeek V4-Pro | 0,435 | 0,87 | 0,003625 |
| DeepSeek V4-Flash | 0,14 | 0,28 | 0,0028 |
| Qwen3.7 Max | 2,50 | 7,50 | нет данных |
| Claude Opus 4.7 | 5 | 25 | нет данных |
| GPT-5.5 | 5 | 30 | нет данных |
| GPT-5.5 Pro | 30 | 180 | нет данных |
Цены DeepSeek - официальный прайс, сверен 19.07.2026; конкуренты - по своду Codersera на 28.05.2026.
Китайские соседи держатся ближе всех к новому ценовому полу: Qwen3.7 Max дороже V4-Pro в несколько раз, но не в десятки, и у Tencent в том же ряду ищут хунян (Hunyuan). Американские флагманы живут в другой ценовой вселенной: те, кто сидит на джипичат (GPT) или на слауд (Claude) - в поиске её пишут и как слод, - платят за тот же объём в десятки раз больше.
Разрыв в 23-27 раз на смешанной нагрузке - другой класс расходов: строка бюджета, которая раньше была заметной, превращается в округление. Нагляднее всего это на графике, где полоса DeepSeek почти теряется на общей шкале.
Как кэш делает ввод в 120 раз дешевле?
Коротко: у DeepSeek есть автоматический контекстный кэш. Если начало твоего запроса совпадает с тем, что модель уже видела - системный промпт, история диалога, общий префикс, - эти токены тарифицируются как кэш-хит: $0,003625 за миллион вместо $0,435. Делим одно на другое - получаем ровно 120. У V4-Flash та же механика даёт 50×: $0,14 против $0,0028.
Практический смысл: длинный статичный кусок промпта должен стоять в начале запроса и не меняться от вызова к вызову. Тогда повторные обращения с тем же префиксом попадают в кэш, и счёт за ввод падает на порядки. Это строка в официальном прайсе, а не фигура речи: кэш-хит - отдельная тарифная категория, цены сверены 19 июля 2026.
Честная оговорка: кэш работает автоматически, и полного попадания тебе никто не обещает. Закладывай в смету обычную цену ввода, а кэш считай скидкой на реальном трафике. Статс попаданий виден по ответам API: там раздельный учёт токенов, и видно, что ушло по обычному тарифу, а что - по кэшу.
Почему DeepSeek может столько стоить?
Коротко: из-за архитектуры. В V4 применили Hybrid Attention - связку Compressed Sparse Attention и Heavily Compressed Attention: вычисления на токен упали до 27%, а размер KV-кэша - до 10% от уровня V3.2 при контексте в миллион токенов. Меньше железа на запрос - ниже себестоимость токена. Пре-трейн прошёл на 32 триллионах с лишним токенов, техотчёт выложен в репозитории на Hugging Face.
Сами модели: V4-Pro - 1,6 триллиона параметров суммарно и 49 миллиардов активных (схема MoE), V4-Flash - 284 миллиарда суммарно и 13 миллиардов активных. Обе открыты под MIT, и спрос подтверждается: у V4-Pro больше 123 тысяч скачиваний на Hugging Face за первые дни после релиза, а DeepSeek заявляет интеграции с Claude Code, OpenClaw и OpenCode.
Качество при этом флагманское. Топовая конфигурация V4-Pro-Max набрала 80,6% на SWE-bench Verified - по данным на конец мая 2026 это верхняя строчка среди open-weight моделей и уровень жемини (Gemini) 3.1 Pro; у Claude Opus 4.7 - 80,8%. Дальше: Codeforces-рейтинг 3206, LiveCodeBench 93,5, GPQA Diamond 90,1. Флагманское качество при копеечной цене ломает привычную пропорцию «дорого значит умно».
Что будет с deepseek-chat и deepseek-reasoner после 24 июля?
Коротко: их отключат. 24 июля 2026 в 15:59 UTC старые алиасы перестанут работать полностью. До этого момента deepseek-chat маршрутизирует в deepseek-v4-flash в обычном режиме, а deepseek-reasoner - во Flash в thinking-режиме. Если в твоём коде остались старые имена, время ещё есть: на дату публикации до дедлайна пять дней.
Что сделать прямо сейчас:
- Найди в коде и конфигах строки deepseek-chat и deepseek-reasoner - поиском по репозиторию, включая переменные окружения.
- Реши, что нужно каждому вызову: массовая рутина - это deepseek-v4-flash, сложные задачи - deepseek-v4-pro. Для привычного «режима рассуждений» у Flash сохраняется thinking-режим.
- Проверь base_url: API DeepSeek говорит на двух форматах - OpenAI ChatCompletions (https://api.deepseek.com) и Anthropic (https://api.deepseek.com/anthropic). Миграция сводится к смене адреса, ключа и имени модели.
- Прогони свои промпты на новой модели в нотебуке или тестовом контуре и сравни ответы со старой - перед продом, а не после.
Минимальное переключение на OpenAI-совместимом клиенте выглядит так:
from openai import OpenAI
client = OpenAI(
base_url="https://api.deepseek.com",
api_key="ВАШ_КЛЮЧ",
)
resp = client.chat.completions.create(
model="deepseek-v4-flash", # было: deepseek-chat
messages=[{"role": "user", "content": "Привет"}],
)
print(resp.choices[0].message.content)
Куда девать дешёвые токены?
Коротко: при таких ценах потоковая обработка текста перестаёт быть строкой бюджета. Миллион токенов на входе стоит 43,5 цента, а попавший в кэш повтор - около трети цента. Рабочая схема для продакшна - консилиум LLM: дешёвый Flash гоняет поток, а Pro подключается на сложные случаи.
Сценарии, которые теперь можно крутить потоком:
- Тексты для работы: рерайтинг базы материалов (по сути, свой рерайтер на API), поднять читабельность инструкций, собрать служебку или оферту по шаблону, придумать название для кофейни или целую концепцию брендинга.
- Учёба и документы: черновик курсовика, план кандидатской диссертации, заявка на один из грантов, реферат про реакции фенола, аккуратная автобиография для конкурса.
- Поток для площадок: посты для тредс (Threads), описания объектов для застройщика, чистка базы текстов - лишние пробелы, опечатки, дубли.
- Творчество: сценка к празднику, рифмовки для открыток, черновик пьесы. Такие запросы вбивают прямо с ошибками - написат песню, сочини сказку. Вторым слоем идёт проход гуманайзером: сгладить машинный налёт у сгенерированного.
Как платить за DeepSeek API из России?
Коротко: сайт и API из России доступны, барьер - платёж. Российские карты (Visa, Mastercard, «Мир») процессинг отклоняет по BIN-коду, пишет РБК 15 июня 2026. Официальные способы пополнения - PayPal, иностранная банковская карта, Alipay и WeChat Pay; обходные - иностранная виртуальная карта с маржой 3-10% или посредники с комиссией.
Если нужен только чат, платить вообще не надо: веб-версия и приложение DeepSeek бесплатны. Деньги требуются за API, и там строгий pay-as-you-go: предоплатный баланс в долларах, списание - токены, умноженные на цену прайса, сначала расходуется подарочный баланс, потом пополненный (DTF, 26.06.2026).
provod.ai - это агрегатор нейросетей для пользователей из России: DeepSeek V4 и другие флагманы в одном чате и через единый API, оплата в рублях, без VPN и зарубежных карт, с договором и закрывающими для юрлиц.
Кстати, обе новые модели уже доступны из России без VPN: в агрегаторе provod.ai они живут в одном чате с Claude и Gemini и подключаются к коду сменой двух строк - ключа и base_url. По заявлению provod.ai, оплатить можно картой РФ или по счёту: виртуальные карты на том же маршруте берут маржу 3-10%, а посредники - свою комиссию.
Чего скидка 75% не решает?
Коротко: цена не отменяет четырёх вещей. Прайс может измениться в будущем - «навсегда» значит лишь «без анонсированной даты». У V4-Pro лимит конкуренции - 500 одновременных запросов, у Flash - 2500, в пять раз больше. Попадание в кэш - штука вероятностная: в смету закладывай обычный ввод. И выбор между Pro и Flash под твою задачу никто за тебя не сделает.
Добавлю два пункта от себя. Вопрос, где и в какой юрисдикции обрабатываются твои данные, дешёвый токен не снимает - для чувствительных потоков это разговор с юристами. И дешёвый инференс не чинит кривую задачу: сэкономленное на токенах теряется на переделках.
Когда provod.ai не подходит
Коротко: если хватает бесплатного веб-чата, есть иностранная карта или свой GPU-кластер под открытые веса - агрегатор не нужен.
Разложу по сценариям. Если тебе достаточно бесплатного веб-чата DeepSeek - платить за любой доступ бессмысленно, он и так бесплатен. Если у компании есть иностранное юрлицо и карта - прямая оплата DeepSeek через PayPal или Alipay прозрачнее, без прослоек. И есть сценарий, специфичный именно для этой темы: V4 распространяется под MIT, веса открыты. Если у тебя GPU-мощности и команда, которая умеет поднимать инференс, - хости модель сам, токен-посредник тут ни к чему. Агрегатор закрывает ровно одну боль: рублёвую оплату и единый доступ из России. Модельный выбор, приватность твоего воркфлоу и качество промптов остаются на тебе.
Словарик запросов кластера
Коротко: у запроса «димсик нейросеть» необычная родня - поисковик собрал рядом всё, что люди спрашивают у нейросетей и про нейросети. Раскладываем по полкам, что есть что.
Опечатки и соседние сервисы
- «демини» - ещё одна русская опечатка Gemini.
- «джиминайт» - похоже, та же Gemini, записанная на слух.
- «маджерни» - так «на слух» пишут Midjourney; это про картинки, не про текст.
- «ловабл» - сервис вайбкодинга Lovable; другой продукт и другая тема.
Музыка, игры и «Сектор газа»
- «людмила» - песня «Сектора газа»; люди просят нейросеть её переписать или «спеть».
- «червонец» - из той же серии: трек «Сектора» и генерация похожего.
- «птенцы» - запрос «забытый птенец» плюс нейросеть; видимо, ищут текст песни или кавер.
- «сосен» - «чёрный сосна»: сказку просят у голосового помощника.
- «хеменес» - «группа хеменести - нейросеть или нет»: проверяют, настоящая ли это группа.
- «мукка» - неразборчивый запрос к Алисе.
- «пирокинезис» - просят текст про пирокинез; отношение к LLM косвенное.
- «мюзикл» - «Аленький цветочек» от нейросети: творческая генерация, не наша тема.
- «капибара» - «Алиса, включи музыку капибара»: голосовой запрос про мемную музыку.
- «сталкрафт» - игра Stalcraft; ищут нейросети про неё или для неё.
- «табс» - похоже на игру TABS; к LLM отношение косвенное.
- «сэмплер» - вопрос про музыкальное железо, не про текст.
Роботы-железяки
- «атлас» - робот Atlas; это железо, а не чат-бот.
- «официант» - робот официант из ресторанных новостей; та же история.
- «промоутер» - робот промоутер; снова железо.
Картинки, 3D и дизайн
- «орнамент» - генерация орнаментов: задача для моделей изображений, а V4 - текстовая.
- «схематик» - ищут нейросеть для схем и чертежей; другой класс инструментов.
- «текстурирования» - текстурирование 3D-моделей; тоже не текст.
- «лейбл» - «сгенерировать лейбл»: графика для товара, не языковая модель.
- «нейрографикой» - «благодарность за занятие нейрографикой»: арт-практика, не нейросеть.
Бытовые вопросы к ИИ
- «матрас» - «какой матрас хороший»: ИИ как советчик в покупках.
- «напитки» - «посоветуй простой жиросжигающий напиток»: из той же серии бытовых советов.
- «скакалка» - «нейро скакалка»: то ли спортинвентарь, то ли опечатка; не расшифровали.
- «банька» - «банька нейро»: загадочный запрос; возможно, что-то про баню.
- «пухососы» - «пухососа нейронка»: честно признаём - не расшифровали вообще.
Медицина и эзотерика
- «онкологу» - благодарность врачу через нейросеть; не про цены API.
- «психоматрица» - «психоматрица онлайн»: нумерология, ИИ в роли калькулятора судьбы.
- «эзотерика» - «нейросеть для эзотерики»: тексты для эзотерических услуг.
- «склифосовский» - похоже на поиск медицинского бота; сюда попал случайно.
- «инфомед» - «инфомёд нейро»: вероятно, медицинский сервис; точно не DeepSeek.
Имена из индустрии
- «лекун» - Ян Лекун; его высказывания об ИИ ищут отдельно, к прайсу DeepSeek отношения нет.
- «суцкевер» - Илья Суцкевер; та же история.
- «мустафа» и «сулейман» - Мустафа Сулейман; ищут имя с фамилией, к ценовому событию он не причастен.
- «сринивас» - Аравинд Сринивас; сосед по новостной ленте, не по теме.
Сервисы и странные слова
- «актион», «анагран», «визком», «сабка», «сиданс», «стинт», «тренси», «шейр», «эвер» - запросы вида «X нейро», которые мы честно не расшифровали: вероятно, мелкие сервисы или опечатки.
- «аутомата» - «нейро аутомат»: возможно, игра NieR: Automata, а возможно, просто автоматизация.
- «блатняк» - «нейро блатняк»: жаргонный запрос непонятного назначения.
- «брейнмакс» - вероятно, бренд; к DeepSeek отношения нет.
- «всезнайка» - «всезнайка нейросеть турботекст»: похоже на функцию сервиса.
- «макстекст» и «ультратекст» - судя по форме запроса, текстовые сервисы с такими именами.
- «модульбот» - конструктор чат-ботов; другая категория.
- «ружпт» - «нейросеть для генерации текста ружпт»: не расшифровали, возможна опечатка.
- «сапиенс» - «нейро сапиенс»: то ли бренд, то ли «умный человек».
- «спростт» - бытовой вопрос про кондиционер с невнятным словом впереди.
- «суппорт» - «нейро суппорт»: ИИ для поддержки; рабочий сценарий, но другая статья.
- «наисания» - опечатка «написания»: дальше всё про то же, про что эта статья.
- «зачитывания» - озвучка текста; V4 - текстовая модель, голос - другой класс сервисов.
- «нейроинвестор» - ищут ИИ для инвестиций; финансовых советов тут не даём.
- «нейроинтерфейс» - «нейроинтерфейс мозг»: это про электроды и BCI, не про чат-ботов.
- «онлифанс» - «нейросеть онлифанс»: контент для OnlyFans; к теме статьи отношения нет.
- «фортране» - ИИ для кода на Фортране; у V4 в источниках заявлены бенчмарки по коду, шансы есть.
provod.ai — оптимизируйте RAG по качеству, скорости и цене
Поиск, переранжирование, анализ контекста и финальный ответ не обязаны выполнять одна и та же модель: подберите лучший инструмент для каждого этапа и сохраните общую интеграцию.
В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.
Считайте экономику пайплайна без ценового шума: каждая модель тарифицируется 1:1 с официальным провайдером, без собственной наценки provod.ai.
Настройте модельный состав RAG: форма регистрации · цены на модели · защита данных по 152-ФЗ · главная provod.ai
Частые вопросы
Коротко: ниже - про опечатки, «навсегда», рублёвый счёт, выбор между Flash и Pro, замену старых имён в коде и российские альтернативы.
Дипсик, димсик, дипсих - это одна и та же нейросеть?
Да. Все эти слова - русские фонетические варианты DeepSeek. Официальные адреса у проекта латиницей: api.deepseek.com для OpenAI-совместимого формата и api.deepseek.com/anthropic для формата Anthropic.
Скидка 75% на V4 Pro правда навсегда?
У прайса нет даты окончания - это подтверждает и официальная страница цен на 19 июля 2026. Но DeepSeek прямо пишет, что может менять цены, и советует пополнять баланс под реальное потребление. Честная формулировка: бессрочно, но не навечно.
Как прикинуть свой счёт в рублях?
Формула одна: токены, умноженные на цену прайса. Сначала списывается подарочный баланс, потом пополненный. Возьми месячный объём запросов в токенах, умножь на $0,435 за вход и $0,87 за вывод - и переведи в рубли по своему курсу. Отдельно следи за статс кэш-хитов: при длинных повторных префиксах реальный счёт за ввод заметно ниже номинала.
Что брать: V4 Flash или V4 Pro?
Flash для потока: $0,14 и $0,28 за миллион, лимит - 2500 одновременных запросов. Pro - для сложных задач: $0,435 и $0,87, лимит 500, и именно старшая линейка показывает 80,6% на SWE-bench Verified. Практичная схема - связка: Flash фильтрует и черновит, Pro дожимает трудное.
Чем заменить deepseek-chat в коде после 24 июля 2026?
Именем deepseek-v4-flash - до дедлайна алиас и так маршрутизирует туда. Если пользовался deepseek-reasoner, переходи на тот же Flash в thinking-режиме. Меняются три вещи: имя модели, при желании base_url и ключ; логику кода не трогаешь.
А что с российскими моделями вроде сберчат?
Сберчат (так в поиске зовут GigaChat от Сбера) - отдельная история со своими тарифами; свежей сверки его цен с DeepSeek у нас в источниках нет, сравнивать вслепую не будем. Логика выбора везде одна: цена за токен, качество на твоих текстах, способ оплаты.
Источники
- Официальный прайс DeepSeek, сверено 19.07.2026: https://api-docs.deepseek.com/quick_start/pricing
- Анонс DeepSeek-V4 Preview, 24.04.2026: https://api-docs.deepseek.com/news/news260424
- Codersera: скидка 75% стала постоянным прайсом, 28.05.2026: https://codersera.com/blog/deepseek-v4-pro-permanent-price-cut-may-2026/
- US Tech Automations: хронология промо, 14.06.2026: https://ustechautomations.com/resources/blog/inference-price-war-explained-what-it-changes
- Onehuman: свод цен, 29.06.2026: https://onehuman.io/news/deepseek-v4-upgrade-price-cut-june-2026
- РБК: оплата DeepSeek API из России, 15.06.2026: https://companies.rbc.ru/news/0Su2q3GJoP/kak-oplatit-deepseek-api-iz-rossii-v-2026-godu-popolnenie-balansa/
- DTF: пополнение баланса из РФ, 26.06.2026: https://dtf.ru/howto/5150420-kak-popolnit-balans-deepseek-iz-rossii
- DiyAI: прайсинг-гайд со сверкой 13.07.2026: https://diyai.io/ai-tools/text-generation/deepseek-api-pricing/
- ThePlanetTools: лонч-разбор V4, 24.05.2026: https://theplanettools.ai/blog/deepseek-v4-launch-flash-pro-hybrid-attention-1m-context-april-2026
- Morph: архитектура и бенчмарки V4, 09.06.2026: https://www.morphllm.com/deepseek-v4
- Framia: конспект анонса, 29.04.2026: https://framia.converge.ai/page/en-US/news/deepseek-v4-announcement-april-2026
Соберём всё в одно действие. До 24 июля 2026, 15:59 UTC, замени старые имена моделей в коде, перестрой промпты под стабильный префикс ради кэша и реши, какой доле задач хватит Flash. Дальше самое интересное: при цене входа в доли цента экспериментировать почти бесплатно, и вопрос «прогнать через модель всю базу» перестаёт быть вопросом денег.
И trade-off, который каждый решает сам: остаться на привычных западных флагманах и платить в десятки раз больше за предсказуемость бренда - или перевести часть трафика на открытую модель с копеечным прайсом и взять работу по тестированию на себя. Правильного ответа тут нет, есть твоя смета и твой аппетит к проверкам.
Проверь DeepSeek V4 Pro и Flash на своих промптах за пять минут: на provod.ai обе модели доступны из России без VPN, с оплатой в рублях с карты РФ или по счёту, для юрлиц - договор и закрывающие документы. Платишь ровно официальный тариф, только в рублях: тестируешь в чате, катишь в прод через тот же ключ.


Top comments (0)