DeepSeek V4 продаётся через три канала по разным ценам: подписки на кодинг-агентов, прямые API-ключи и шлюзы. Каждый канал также предполагает разные гарантии относительно того, какой чекпоинт модели обрабатывает трафик. 16 августа 2026 года именно разница в чекпоинтах оказалась самой дорогой. После того как DeepSeek изменил цены на V4, реселлеры синхронно скорректировали тарифы. Последовавшая волна жалоб в тредах показала, насколько плохо большинство клиентов понимало, что именно они покупают.

Что изменилось в ценообразовании DeepSeek V4 16 августа 2026 года?

DeepSeek перевёл семейство V4 на пиковые и непиковые тарифы 16 августа в 16:00 UTC. Пиковые окна — 01:00–04:00 и 06:00–10:00 UTC. В этих окнах тарификация ровно вдвое выше непиковой. Непиковая стоимость V4 Flash составляет $0,007 / $0,22 / $0,66 за миллион токенов для кэш-попаданий по входу, промахов мимо кэша и выходных токенов соответственно; в пиковые часы эти цифры удваиваются. Непиковая стоимость V4 Pro — $0,022 / $0,66 / $1,98.

Основное внимание привлёк скачок цен на попадания в кэш. InfoWorld сообщил о росте более чем в 10 раз на отдельных тарифах. Непиковая цена за кэш-попадания по входу для V4 Pro выросла более чем в шесть раз, а пиковая — более чем в двенадцать. DeepSeek давал скидку на попадания в кэш порядка 98%, что значительно выше отраслевой нормы, близкой к 90%. Поэтому значительная часть счёта каждого агента приходилась на чтение кэша, тарифицируемое почти по нулевой ставке.

Именно этот разрыв объясняет, почему пересмотр цен ударил по кодинг-агентам сильнее, чем по чат-интерфейсам. Агент на каждом шаге повторно отправляет длинный системный промпт и расширяющуюся историю диалога. Поэтому большая часть его входных токенов считается попаданием в кэш. Повышение цен на попадания в кэш ударило по агентам особенно сильно.

Почему OpenCode Go сократил лимиты на DeepSeek?

OpenCode Go стоит $10 в месяц и изначально рекламировался как покрывающий до $60 совокупного использования моделей. После публикации новых тарифов те же $10 стали давать значительно меньше токенов. OpenCode сократил лимиты в течение нескольких часов. Лимит на V4 Flash снизился на 50% — до $30 в месяц, а на V4 Pro — на 75%, до $15.

На r/opencode реакция последовала быстро. Пост с заголовком «Bye bye OpenCode Go» набрал 315 апвоутов и 108 комментариев, а отдельный тред о бюджете на Flash добавил ещё 173. На следующий день OpenCode вернул лимит на Flash, а публичное объяснение CEO набрало 1 517 очков, став самым популярным постом недели.

Те же принципы применимы к любому реселлеру с фиксированной оплатой. Подписка, перепродающая тарифицируемую ёмкость апстрима, переносит ценовой риск апстрима на баланс реселлера. Если апстрим повышает цены в 10 раз, реселлер либо поглощает разницу, либо поднимает цену, либо сокращает лимит. OpenCode публично сократил лимит менее чем за сутки — быстрее и откровеннее, чем большинство. Покупатели по-прежнему сталкиваются с очевидным компромиссом: фиксированная плата отражает чужую структуру затрат, а эта структура может измениться.

Получаете ли вы настоящую DeepSeek V4 Flash?

Самое неприятное здесь — отсутствие какой-либо определённости.

DeepSeek V4 Flash построена на обучении с учётом квантизации. Маршрутизируемые эксперты, составляющие примерно 96% модели, нативно хранятся в MXFP4. Остальные параметры используют FP8 или BF16. Именно эта архитектура позволяет опубликованным весам демонстрировать заявленное поведение. Многие серверлесс-провайдеры затем квантизуют активации до fp8 поверх этой нативной точности, снижая собственные затраты на инференс. Последствия описаны в бенчмарк-отчёте ZenMux: ответы отклоняются от эталонных весов, и два провайдера, обслуживающие одну и ту же модель, возвращают измеримо разные результаты.

Тот же механизм даёт жалобам «один промпт — разные ответы» проверяемое объяснение и выводит их за рамки анекдотов. Он также ставит более острый вопрос. В репозитории OpenCode есть открытый тикет #40409, в котором зафиксировано сообщение о том, что deepseek-v4-flash в Go самоидентифицируется как DeepSeek V3.2 с датой отсечения знаний в мае 2025 года, при этом использование тарифицируется по квоте V4 Flash. Это стоит рассматривать как сообщение одного пользователя по нерешённому тикету, а не как подтверждённый факт. Самоидентификация — ненадёжное доказательство: модель узнаёт свою версию из обучающих данных, а не из стека обслуживания. Тикет остаётся открытым и конкретным, опровержения не опубликовано.

Этот практический вывод остаётся в силе независимо от того, как будет решён тикет. Воспроизводимость требует провайдера, который раскрывает, какой чекпоинт и с какой точностью обработал каждый запрос. Большинство подписок такое раскрытие опускают, потому что маршрутизация через общий пул апстримов — это то, что делает фиксированную плату устойчивой.

УЗНАЙТЕ, ЧТО ИМЕННО ОТВЕЧАЕТ НА ВАШИ ЗАПРОСЫ

Как соотносятся три способа покупки DeepSeek V4?

Подписка на кодинг-агентаПрямой API DeepSeekШлюз
ТарификацияФиксированная месячная плата, ограниченная квотаОплата по факту потребления, с разделением на пиковые и непиковые часыОплата по факту потребления, один ключ для нескольких провайдеров
Гарантия чекпоинтаОбычно не раскрываетсяЭталонные веса, собственный сервис DeepSeekВарьируется; уточняйте перед подключением
Риск изменения ценРеселлер поглощает, затем корректирует лимитыВы поглощаете напрямуюПеренаправление на другой апстрим
Широта моделейКурируемый списокТолько DeepSeekСотни моделей
Лучше всего дляНеравномерная исследовательская работаВоспроизводимая и непиковая пакетная обработкаПродакшн-трафик с несколькими моделями

Покупатели больше не могут пропускать строку, которую раньше игнорировали. Цену и широту легко проверить на лендинге. Происхождение по умолчанию нигде не раскрывается, и именно этот параметр сместился в этом месяце.

Как получать доступ к DeepSeek V4?

Выбирайте, исходя из того, какая гарантия критична для вашей нагрузки, а не из рекламируемого тарифа.

  • haimaker.ai — один OpenAI-совместимый эндпоинт, обслуживающий DeepSeek V4 и сотни других моделей, со встроенным логированием стоимости каждого запроса. В этом случае пересмотр цен провайдером отразится в вашей телеметрии, а не в треде на Reddit. Выбирайте, когда нужна широта шлюза и маршрутизацию можно контролировать. Страница AI API-шлюза подробно описывает модель маршрутизации.
  • Собственный API DeepSeek — эталонная реализация и единственный источник, позволяющий с уверенностью подтвердить чекпоинт. Подходит для нагрузок, которые можно перенести в непиковые часы, где стоимость выходных токенов Flash составляет $0,66 за миллион.
  • OpenCode Go и аналогичные подписки — подходят для неравномерных нагрузок с фиксированной месячной стоимостью. Несколько пользователей в августовских тредах сообщили, что им сложно исчерпать даже сокращённые недельные лимиты. Компромисс: невозможно проверить, какой чекпоинт вы получаете.
  • Другие шлюзы — OpenRouter маршрутизирует более 400 моделей от 80+ провайдеров и предоставляет явные режимы маршрутизации. Однако консолидация ускоряется: Stripe согласилась приобрести OpenRouter за более чем $7 млрд 16 августа — с мультипликатором 5,4x к оценке раунда Series B, полученной три месяца назад.

Когда провайдер уже выбран и нужны только детали конфигурации, руководство по настройке DeepSeek в OpenCode содержит блок провайдера и типичные ошибки /models. По более широкому вопросу о том, какой низкобюджетный API заслуживает ключа, самый дешёвый AI API-ключ охватывает уровень ниже цен передовых моделей, а альтернативы OpenRouter сравнивает шлюзы напрямую.

Что сделать до следующего пересмотра цен?

DeepSeek изменил цены дважды за один месяц. Введение пиковых и непиковых тарифов говорит о том, что ограничение связано с доступной ёмкостью, а не с маржой прибыли. Оценка инженера OpenCode в тот момент заключалась в том, что повышение отражало управление трафиком, а не финансовые трудности. Если это объяснение верно, дальнейшие изменения цен будут определяться планированием нагрузки, а не возвратом к прежним тарифам.

Минимальная подготовка — логировать стоимость каждого запроса на собственной инфраструктуре. Тогда следующая корректировка тарифов появится в метриках раньше, чем всплывёт в треде на Reddit. Если вынести имя модели и базовый URL в конфигурационные файлы, а не зашивать их в код, смена провайдера сведётся к деплою, а не к переработке кодовой базы. После этого ключевой архитектурный вопрос — требует ли нагрузка верифицированного чекпоинта. Решение этого единственного вопроса превращает остальные решения в стандартное сравнение цен.

Одно ограничение остаётся: в настоящее время эти детали невозможно верифицировать извне на уровне отдельного запроса. Ни один крупный провайдер не включает точность обслуживания или хеш чекпоинта в свои API-ответы. Пока это не изменится, подтвердить происхождение можно только прямым запросом к вендору, а не независимой проверкой.

ПОЛУЧИТЕ ОДИН КЛЮЧ ДЛЯ DEEPSEEK И ВСЕГО ОСТАЛЬНОГО

Часто задаваемые вопросы

Дешевле ли OpenCode Go, чем прямой API DeepSeek?

Для неравномерной, исследовательской работы фиксированная месячная подписка оправдана: постоянная стоимость поглощает всплески использования, за которые при оплате по факту потребления пришлось бы платить больше. Однако при устойчивой высокой нагрузке прямой API, как правило, обходится дешевле, особенно в непиковые часы. Это также единственный способ убедиться, какой именно чекпоинт обработал конкретный запрос.

Почему ответы DeepSeek V4 Flash различаются у разных провайдеров?

DeepSeek V4 Flash поставляется с весами, обученными с учётом квантизации: маршрутизируемые эксперты нативно хранятся в MXFP4, а остальные параметры — в FP8 или BF16. Многие серверлесс-провайдеры дополнительно квантизуют активации до fp8, чтобы снизить стоимость инференса, из-за чего выходы отклоняются от опубликованных эталонных весов. На практике два провайдера, указывающие одно и то же название модели, могут выдавать измеримо разные результаты.

Что изменилось в ценообразовании DeepSeek V4 в августе 2026 года?

Пиковое и непиковое ценообразование вступило в силу 16 августа 2026 года в 16:00 UTC. Пиковые окна — 01:00–04:00 и 06:00–10:00 UTC, тарифы в них ровно вдвое выше непиковых. Сильнее всего выросли цены на входные токены с попаданием в кэш — до примерно 1 100% на отдельных тарифах, что больнее всего ударило по агентным нагрузкам, полагающимся на кэширование промптов.