DEV Community

Cover image for «димсик нейросеть» DeepSeek V4: скидка 75% навсегда - $0,435 за миллион и кэш в 120 раз
Promptra Team for Promptra

Posted on

«димсик нейросеть» DeepSeek V4: скидка 75% навсегда - $0,435 за миллион и кэш в 120 раз

22 мая 2026 года DeepSeek отменил окончание собственной акции. Промо-скидка 75% на флагманскую модель V4-Pro должна была сгореть 31 мая в 15:59 UTC, а вместо этого за девять дней до дедлайна превратилась в постоянный прайс: миллион входящих токенов стоит $0,435 вместо $1,74, миллион исходящих - $0,87 вместо $3,48, и даты окончания у этого прайса нет. По официальной странице цен, сверенной 19 июля 2026, условия действуют до сих пор.

Ищут эту нейросеть по-русски как попало: димсик, дипсид, дипсих, диптик, дигпик, липсик. Все шесть слов - про один и тот же DeepSeek, и запрос «димсик нейросеть» сейчас ведёт на ценовое событие, ради которого написан этот текст. Вторая строка из тех же подсказок - про кэш: попадание в контекстный кэш стоит $0,003625 за миллион токенов, то есть ровно в 120 раз дешевле обычного ввода. Дальше - хронология, математика выгоды и оплата из России.

Загвоздка для читателя из РФ одна, и она неприятная: оплатить эти копейки напрямую российской картой не выйдет - процессинг DeepSeek отклоняет её по BIN-коду. Поэтому часть команд заходит через агрегаторы вроде provod.ai (российский OpenRouter), где те же модели доступны в рублях по официальным тарифам.

Что именно случилось с ценами DeepSeek V4 22 мая 2026?

Коротко: временная скидка 75% на V4-Pro стала постоянной ценой. Ввод подешевел с $1,74 до $0,435 за миллион токенов, вывод - с $3,48 до $0,87, кэш-хит - с $0,0145 до $0,003625. Дата окончания из прайса исчезла и на 19 июля 2026 не вернулась.

Хронология по анонсам и сводам:

  • 24 апреля 2026 - лонч DeepSeek V4 Preview: две open-weight модели, V4-Pro и V4-Flash, контекст 1M токенов, лицензия MIT, веса на Hugging Face.
  • Весна 2026 - на V4-Pro действует промо-скидка 75% с дедлайном 31 мая, 15:59 UTC.
  • 22 мая 2026 - промо превращается в постоянный прайс, дата окончания убирается из условий.
  • 24 июля 2026, 15:59 UTC - полностью отключат старые алиасы deepseek-chat и deepseek-reasoner (об этом отдельная секция ниже).

Меня здесь радует перманентность: обычно такие акции сгорают ровно тогда, когда ты построил на них юнит-экономику, а тут цену в четверть от стартовой признали нормой. Оговорка всё же нужна: компания оставляет за собой право менять цены и советует следить за страницей прайса - «навсегда» означает «без анонсированной даты окончания», а не юридическое обязательство.

$0,435 за миллион - это много или мало?

Коротко: в этой таблице V4-Flash дешевле V4-Pro по входу: $0,14 против $0,435 за 1M токенов. Смешанная нагрузка (миллион токенов на входе плюс миллион на выходе) обходится на V4-Pro примерно в $1,31 против $30 у Claude Opus 4.7 и $35 у GPT-5.5: разрыв в 23 и 27 раз посчитан по своду Codersera от 28 мая 2026.

Модель Ввод, $/1M Вывод, $/1M Кэш-хит ввода, $/1M
DeepSeek V4-Pro 0,435 0,87 0,003625
DeepSeek V4-Flash 0,14 0,28 0,0028
Qwen3.7 Max 2,50 7,50 нет данных
Claude Opus 4.7 5 25 нет данных
GPT-5.5 5 30 нет данных
GPT-5.5 Pro 30 180 нет данных

Цены DeepSeek - официальный прайс, сверен 19.07.2026; конкуренты - по своду Codersera на 28.05.2026.

Китайские соседи держатся ближе всех к новому ценовому полу: Qwen3.7 Max дороже V4-Pro в несколько раз, но не в десятки, и у Tencent в том же ряду ищут хунян (Hunyuan). Американские флагманы живут в другой ценовой вселенной: те, кто сидит на джипичат (GPT) или на слауд (Claude) - в поиске её пишут и как слод, - платят за тот же объём в десятки раз больше.

Разрыв в 23-27 раз на смешанной нагрузке - другой класс расходов: строка бюджета, которая раньше была заметной, превращается в округление. Нагляднее всего это на графике, где полоса DeepSeek почти теряется на общей шкале.

Полоса DeepSeek почти не видна на фоне флагманов: цены за 1M входящих токенов на июль 2026

Как кэш делает ввод в 120 раз дешевле?

Коротко: у DeepSeek есть автоматический контекстный кэш. Если начало твоего запроса совпадает с тем, что модель уже видела - системный промпт, история диалога, общий префикс, - эти токены тарифицируются как кэш-хит: $0,003625 за миллион вместо $0,435. Делим одно на другое - получаем ровно 120. У V4-Flash та же механика даёт 50×: $0,14 против $0,0028.

Практический смысл: длинный статичный кусок промпта должен стоять в начале запроса и не меняться от вызова к вызову. Тогда повторные обращения с тем же префиксом попадают в кэш, и счёт за ввод падает на порядки. Это строка в официальном прайсе, а не фигура речи: кэш-хит - отдельная тарифная категория, цены сверены 19 июля 2026.

Честная оговорка: кэш работает автоматически, и полного попадания тебе никто не обещает. Закладывай в смету обычную цену ввода, а кэш считай скидкой на реальном трафике. Статс попаданий виден по ответам API: там раздельный учёт токенов, и видно, что ушло по обычному тарифу, а что - по кэшу.

Почему DeepSeek может столько стоить?

Коротко: из-за архитектуры. В V4 применили Hybrid Attention - связку Compressed Sparse Attention и Heavily Compressed Attention: вычисления на токен упали до 27%, а размер KV-кэша - до 10% от уровня V3.2 при контексте в миллион токенов. Меньше железа на запрос - ниже себестоимость токена. Пре-трейн прошёл на 32 триллионах с лишним токенов, техотчёт выложен в репозитории на Hugging Face.

Сами модели: V4-Pro - 1,6 триллиона параметров суммарно и 49 миллиардов активных (схема MoE), V4-Flash - 284 миллиарда суммарно и 13 миллиардов активных. Обе открыты под MIT, и спрос подтверждается: у V4-Pro больше 123 тысяч скачиваний на Hugging Face за первые дни после релиза, а DeepSeek заявляет интеграции с Claude Code, OpenClaw и OpenCode.

Качество при этом флагманское. Топовая конфигурация V4-Pro-Max набрала 80,6% на SWE-bench Verified - по данным на конец мая 2026 это верхняя строчка среди open-weight моделей и уровень жемини (Gemini) 3.1 Pro; у Claude Opus 4.7 - 80,8%. Дальше: Codeforces-рейтинг 3206, LiveCodeBench 93,5, GPQA Diamond 90,1. Флагманское качество при копеечной цене ломает привычную пропорцию «дорого значит умно».

Что будет с deepseek-chat и deepseek-reasoner после 24 июля?

Коротко: их отключат. 24 июля 2026 в 15:59 UTC старые алиасы перестанут работать полностью. До этого момента deepseek-chat маршрутизирует в deepseek-v4-flash в обычном режиме, а deepseek-reasoner - во Flash в thinking-режиме. Если в твоём коде остались старые имена, время ещё есть: на дату публикации до дедлайна пять дней.

Что сделать прямо сейчас:

  1. Найди в коде и конфигах строки deepseek-chat и deepseek-reasoner - поиском по репозиторию, включая переменные окружения.
  2. Реши, что нужно каждому вызову: массовая рутина - это deepseek-v4-flash, сложные задачи - deepseek-v4-pro. Для привычного «режима рассуждений» у Flash сохраняется thinking-режим.
  3. Проверь base_url: API DeepSeek говорит на двух форматах - OpenAI ChatCompletions (https://api.deepseek.com) и Anthropic (https://api.deepseek.com/anthropic). Миграция сводится к смене адреса, ключа и имени модели.
  4. Прогони свои промпты на новой модели в нотебуке или тестовом контуре и сравни ответы со старой - перед продом, а не после.

Минимальное переключение на OpenAI-совместимом клиенте выглядит так:

from openai import OpenAI

client = OpenAI(
    base_url="https://api.deepseek.com",
    api_key="ВАШ_КЛЮЧ",
)

resp = client.chat.completions.create(
    model="deepseek-v4-flash",  # было: deepseek-chat
    messages=[{"role": "user", "content": "Привет"}],
)
print(resp.choices[0].message.content)
Enter fullscreen mode Exit fullscreen mode

Куда девать дешёвые токены?

Коротко: при таких ценах потоковая обработка текста перестаёт быть строкой бюджета. Миллион токенов на входе стоит 43,5 цента, а попавший в кэш повтор - около трети цента. Рабочая схема для продакшна - консилиум LLM: дешёвый Flash гоняет поток, а Pro подключается на сложные случаи.

Сценарии, которые теперь можно крутить потоком:

  • Тексты для работы: рерайтинг базы материалов (по сути, свой рерайтер на API), поднять читабельность инструкций, собрать служебку или оферту по шаблону, придумать название для кофейни или целую концепцию брендинга.
  • Учёба и документы: черновик курсовика, план кандидатской диссертации, заявка на один из грантов, реферат про реакции фенола, аккуратная автобиография для конкурса.
  • Поток для площадок: посты для тредс (Threads), описания объектов для застройщика, чистка базы текстов - лишние пробелы, опечатки, дубли.
  • Творчество: сценка к празднику, рифмовки для открыток, черновик пьесы. Такие запросы вбивают прямо с ошибками - написат песню, сочини сказку. Вторым слоем идёт проход гуманайзером: сгладить машинный налёт у сгенерированного.

Как платить за DeepSeek API из России?

Коротко: сайт и API из России доступны, барьер - платёж. Российские карты (Visa, Mastercard, «Мир») процессинг отклоняет по BIN-коду, пишет РБК 15 июня 2026. Официальные способы пополнения - PayPal, иностранная банковская карта, Alipay и WeChat Pay; обходные - иностранная виртуальная карта с маржой 3-10% или посредники с комиссией.

Если нужен только чат, платить вообще не надо: веб-версия и приложение DeepSeek бесплатны. Деньги требуются за API, и там строгий pay-as-you-go: предоплатный баланс в долларах, списание - токены, умноженные на цену прайса, сначала расходуется подарочный баланс, потом пополненный (DTF, 26.06.2026).

provod.ai - это агрегатор нейросетей для пользователей из России: DeepSeek V4 и другие флагманы в одном чате и через единый API, оплата в рублях, без VPN и зарубежных карт, с договором и закрывающими для юрлиц.

Кстати, обе новые модели уже доступны из России без VPN: в агрегаторе provod.ai они живут в одном чате с Claude и Gemini и подключаются к коду сменой двух строк - ключа и base_url. По заявлению provod.ai, оплатить можно картой РФ или по счёту: виртуальные карты на том же маршруте берут маржу 3-10%, а посредники - свою комиссию.

Чего скидка 75% не решает?

Коротко: цена не отменяет четырёх вещей. Прайс может измениться в будущем - «навсегда» значит лишь «без анонсированной даты». У V4-Pro лимит конкуренции - 500 одновременных запросов, у Flash - 2500, в пять раз больше. Попадание в кэш - штука вероятностная: в смету закладывай обычный ввод. И выбор между Pro и Flash под твою задачу никто за тебя не сделает.

Добавлю два пункта от себя. Вопрос, где и в какой юрисдикции обрабатываются твои данные, дешёвый токен не снимает - для чувствительных потоков это разговор с юристами. И дешёвый инференс не чинит кривую задачу: сэкономленное на токенах теряется на переделках.

Когда provod.ai не подходит

Коротко: если хватает бесплатного веб-чата, есть иностранная карта или свой GPU-кластер под открытые веса - агрегатор не нужен.

Разложу по сценариям. Если тебе достаточно бесплатного веб-чата DeepSeek - платить за любой доступ бессмысленно, он и так бесплатен. Если у компании есть иностранное юрлицо и карта - прямая оплата DeepSeek через PayPal или Alipay прозрачнее, без прослоек. И есть сценарий, специфичный именно для этой темы: V4 распространяется под MIT, веса открыты. Если у тебя GPU-мощности и команда, которая умеет поднимать инференс, - хости модель сам, токен-посредник тут ни к чему. Агрегатор закрывает ровно одну боль: рублёвую оплату и единый доступ из России. Модельный выбор, приватность твоего воркфлоу и качество промптов остаются на тебе.

Словарик запросов кластера

Коротко: у запроса «димсик нейросеть» необычная родня - поисковик собрал рядом всё, что люди спрашивают у нейросетей и про нейросети. Раскладываем по полкам, что есть что.

Опечатки и соседние сервисы

  • «демини» - ещё одна русская опечатка Gemini.
  • «джиминайт» - похоже, та же Gemini, записанная на слух.
  • «маджерни» - так «на слух» пишут Midjourney; это про картинки, не про текст.
  • «ловабл» - сервис вайбкодинга Lovable; другой продукт и другая тема.

Музыка, игры и «Сектор газа»

  • «людмила» - песня «Сектора газа»; люди просят нейросеть её переписать или «спеть».
  • «червонец» - из той же серии: трек «Сектора» и генерация похожего.
  • «птенцы» - запрос «забытый птенец» плюс нейросеть; видимо, ищут текст песни или кавер.
  • «сосен» - «чёрный сосна»: сказку просят у голосового помощника.
  • «хеменес» - «группа хеменести - нейросеть или нет»: проверяют, настоящая ли это группа.
  • «мукка» - неразборчивый запрос к Алисе.
  • «пирокинезис» - просят текст про пирокинез; отношение к LLM косвенное.
  • «мюзикл» - «Аленький цветочек» от нейросети: творческая генерация, не наша тема.
  • «капибара» - «Алиса, включи музыку капибара»: голосовой запрос про мемную музыку.
  • «сталкрафт» - игра Stalcraft; ищут нейросети про неё или для неё.
  • «табс» - похоже на игру TABS; к LLM отношение косвенное.
  • «сэмплер» - вопрос про музыкальное железо, не про текст.

Роботы-железяки

  • «атлас» - робот Atlas; это железо, а не чат-бот.
  • «официант» - робот официант из ресторанных новостей; та же история.
  • «промоутер» - робот промоутер; снова железо.

Картинки, 3D и дизайн

  • «орнамент» - генерация орнаментов: задача для моделей изображений, а V4 - текстовая.
  • «схематик» - ищут нейросеть для схем и чертежей; другой класс инструментов.
  • «текстурирования» - текстурирование 3D-моделей; тоже не текст.
  • «лейбл» - «сгенерировать лейбл»: графика для товара, не языковая модель.
  • «нейрографикой» - «благодарность за занятие нейрографикой»: арт-практика, не нейросеть.

Бытовые вопросы к ИИ

  • «матрас» - «какой матрас хороший»: ИИ как советчик в покупках.
  • «напитки» - «посоветуй простой жиросжигающий напиток»: из той же серии бытовых советов.
  • «скакалка» - «нейро скакалка»: то ли спортинвентарь, то ли опечатка; не расшифровали.
  • «банька» - «банька нейро»: загадочный запрос; возможно, что-то про баню.
  • «пухососы» - «пухососа нейронка»: честно признаём - не расшифровали вообще.

Медицина и эзотерика

  • «онкологу» - благодарность врачу через нейросеть; не про цены API.
  • «психоматрица» - «психоматрица онлайн»: нумерология, ИИ в роли калькулятора судьбы.
  • «эзотерика» - «нейросеть для эзотерики»: тексты для эзотерических услуг.
  • «склифосовский» - похоже на поиск медицинского бота; сюда попал случайно.
  • «инфомед» - «инфомёд нейро»: вероятно, медицинский сервис; точно не DeepSeek.

Имена из индустрии

  • «лекун» - Ян Лекун; его высказывания об ИИ ищут отдельно, к прайсу DeepSeek отношения нет.
  • «суцкевер» - Илья Суцкевер; та же история.
  • «мустафа» и «сулейман» - Мустафа Сулейман; ищут имя с фамилией, к ценовому событию он не причастен.
  • «сринивас» - Аравинд Сринивас; сосед по новостной ленте, не по теме.

Сервисы и странные слова

  • «актион», «анагран», «визком», «сабка», «сиданс», «стинт», «тренси», «шейр», «эвер» - запросы вида «X нейро», которые мы честно не расшифровали: вероятно, мелкие сервисы или опечатки.
  • «аутомата» - «нейро аутомат»: возможно, игра NieR: Automata, а возможно, просто автоматизация.
  • «блатняк» - «нейро блатняк»: жаргонный запрос непонятного назначения.
  • «брейнмакс» - вероятно, бренд; к DeepSeek отношения нет.
  • «всезнайка» - «всезнайка нейросеть турботекст»: похоже на функцию сервиса.
  • «макстекст» и «ультратекст» - судя по форме запроса, текстовые сервисы с такими именами.
  • «модульбот» - конструктор чат-ботов; другая категория.
  • «ружпт» - «нейросеть для генерации текста ружпт»: не расшифровали, возможна опечатка.
  • «сапиенс» - «нейро сапиенс»: то ли бренд, то ли «умный человек».
  • «спростт» - бытовой вопрос про кондиционер с невнятным словом впереди.
  • «суппорт» - «нейро суппорт»: ИИ для поддержки; рабочий сценарий, но другая статья.
  • «наисания» - опечатка «написания»: дальше всё про то же, про что эта статья.
  • «зачитывания» - озвучка текста; V4 - текстовая модель, голос - другой класс сервисов.
  • «нейроинвестор» - ищут ИИ для инвестиций; финансовых советов тут не даём.
  • «нейроинтерфейс» - «нейроинтерфейс мозг»: это про электроды и BCI, не про чат-ботов.
  • «онлифанс» - «нейросеть онлифанс»: контент для OnlyFans; к теме статьи отношения нет.
  • «фортране» - ИИ для кода на Фортране; у V4 в источниках заявлены бенчмарки по коду, шансы есть.

provod.ai — оптимизируйте RAG по качеству, скорости и цене

Поиск, переранжирование, анализ контекста и финальный ответ не обязаны выполнять одна и та же модель: подберите лучший инструмент для каждого этапа и сохраните общую интеграцию.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Считайте экономику пайплайна без ценового шума: каждая модель тарифицируется 1:1 с официальным провайдером, без собственной наценки provod.ai.

Настройте модельный состав RAG: форма регистрации · цены на модели · защита данных по 152-ФЗ · главная provod.ai

Частые вопросы

Коротко: ниже - про опечатки, «навсегда», рублёвый счёт, выбор между Flash и Pro, замену старых имён в коде и российские альтернативы.

Дипсик, димсик, дипсих - это одна и та же нейросеть?
Да. Все эти слова - русские фонетические варианты DeepSeek. Официальные адреса у проекта латиницей: api.deepseek.com для OpenAI-совместимого формата и api.deepseek.com/anthropic для формата Anthropic.

Скидка 75% на V4 Pro правда навсегда?
У прайса нет даты окончания - это подтверждает и официальная страница цен на 19 июля 2026. Но DeepSeek прямо пишет, что может менять цены, и советует пополнять баланс под реальное потребление. Честная формулировка: бессрочно, но не навечно.

Как прикинуть свой счёт в рублях?
Формула одна: токены, умноженные на цену прайса. Сначала списывается подарочный баланс, потом пополненный. Возьми месячный объём запросов в токенах, умножь на $0,435 за вход и $0,87 за вывод - и переведи в рубли по своему курсу. Отдельно следи за статс кэш-хитов: при длинных повторных префиксах реальный счёт за ввод заметно ниже номинала.

Что брать: V4 Flash или V4 Pro?
Flash для потока: $0,14 и $0,28 за миллион, лимит - 2500 одновременных запросов. Pro - для сложных задач: $0,435 и $0,87, лимит 500, и именно старшая линейка показывает 80,6% на SWE-bench Verified. Практичная схема - связка: Flash фильтрует и черновит, Pro дожимает трудное.

Чем заменить deepseek-chat в коде после 24 июля 2026?
Именем deepseek-v4-flash - до дедлайна алиас и так маршрутизирует туда. Если пользовался deepseek-reasoner, переходи на тот же Flash в thinking-режиме. Меняются три вещи: имя модели, при желании base_url и ключ; логику кода не трогаешь.

А что с российскими моделями вроде сберчат?
Сберчат (так в поиске зовут GigaChat от Сбера) - отдельная история со своими тарифами; свежей сверки его цен с DeepSeek у нас в источниках нет, сравнивать вслепую не будем. Логика выбора везде одна: цена за токен, качество на твоих текстах, способ оплаты.

Источники

  1. Официальный прайс DeepSeek, сверено 19.07.2026: https://api-docs.deepseek.com/quick_start/pricing
  2. Анонс DeepSeek-V4 Preview, 24.04.2026: https://api-docs.deepseek.com/news/news260424
  3. Codersera: скидка 75% стала постоянным прайсом, 28.05.2026: https://codersera.com/blog/deepseek-v4-pro-permanent-price-cut-may-2026/
  4. US Tech Automations: хронология промо, 14.06.2026: https://ustechautomations.com/resources/blog/inference-price-war-explained-what-it-changes
  5. Onehuman: свод цен, 29.06.2026: https://onehuman.io/news/deepseek-v4-upgrade-price-cut-june-2026
  6. РБК: оплата DeepSeek API из России, 15.06.2026: https://companies.rbc.ru/news/0Su2q3GJoP/kak-oplatit-deepseek-api-iz-rossii-v-2026-godu-popolnenie-balansa/
  7. DTF: пополнение баланса из РФ, 26.06.2026: https://dtf.ru/howto/5150420-kak-popolnit-balans-deepseek-iz-rossii
  8. DiyAI: прайсинг-гайд со сверкой 13.07.2026: https://diyai.io/ai-tools/text-generation/deepseek-api-pricing/
  9. ThePlanetTools: лонч-разбор V4, 24.05.2026: https://theplanettools.ai/blog/deepseek-v4-launch-flash-pro-hybrid-attention-1m-context-april-2026
  10. Morph: архитектура и бенчмарки V4, 09.06.2026: https://www.morphllm.com/deepseek-v4
  11. Framia: конспект анонса, 29.04.2026: https://framia.converge.ai/page/en-US/news/deepseek-v4-announcement-april-2026

Соберём всё в одно действие. До 24 июля 2026, 15:59 UTC, замени старые имена моделей в коде, перестрой промпты под стабильный префикс ради кэша и реши, какой доле задач хватит Flash. Дальше самое интересное: при цене входа в доли цента экспериментировать почти бесплатно, и вопрос «прогнать через модель всю базу» перестаёт быть вопросом денег.

И trade-off, который каждый решает сам: остаться на привычных западных флагманах и платить в десятки раз больше за предсказуемость бренда - или перевести часть трафика на открытую модель с копеечным прайсом и взять работу по тестированию на себя. Правильного ответа тут нет, есть твоя смета и твой аппетит к проверкам.

provod.ai: DeepSeek V4 за рубли и без наценки - меняются две строки в коде

Проверь DeepSeek V4 Pro и Flash на своих промптах за пять минут: на provod.ai обе модели доступны из России без VPN, с оплатой в рублях с карты РФ или по счёту, для юрлиц - договор и закрывающие документы. Платишь ровно официальный тариф, только в рублях: тестируешь в чате, катишь в прод через тот же ключ.

Top comments (0)