13 августа 2026 г.
Бюджет на DeepSeek V4-Pro придётся пересчитать: с 16 августа ответы в пик дорожают в 4,5 раза
DeepSeek открыла V4-Pro всем и сразу назначила дату подорожания: 16 августа, 16:00 UTC.

Дешёвый DeepSeek живёт до 16 августа, 16:00 UTC. Потом цена начнёт зависеть от часа суток.
DeepSeek открыла V4-Pro в общий доступ 13 августа. Переезжать никуда не нужно: имя модели в API прежнее, `deepseek-v4-pro`, а в приложении и вебе модель включается режимом Expert Mode. Заявленные вендором цифры сборки 0813 - 80,6% на SWE-bench Verified и 67,9% на Terminal Bench 2.0.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Что меняется в цене
Раньше час не влиял ни на что. Выход стоил $0.87 за 1M токенов в любое время суток. Вход при промахе кэша стоил $0.435, при попадании кэша $0.003625.
С 16:00 UTC 16 августа сетка делится на пиковую и непиковую:
- выход: $3.96 в пик и $1.98 вне пика (было $0.87) - вход при промахе кэша: $1.32 и $0.66 (было $0.435) - вход при попадании кэша: $0.044 и $0.022 (было $0.003625)
Пик по UTC: 01:00-04:00 и 06:00-10:00. По московскому времени это 04:00-07:00 и 09:00-13:00, остальные часы идут по дешёвому тарифу.
Рядом остаётся deepseek-v4-flash. До 16 августа он стоит $0.14 за 1M входных токенов и $0.28 за 1M выходных. Контекст у обеих моделей 1M токенов, ответ до 384K.
Как включить в Codex
Вендор даёт установку одной командой. На macOS и Linux она такая: `bash <(curl -fsSL https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.sh)`. В PowerShell работает `irm https://cdn.deepseek.com/api-docs/codex-deepseek-setup-en.ps1 | iex`. Скрипт спросит API-ключ и сам поправит конфиг.
Руками правится `~/.codex/config.toml`. В корень пишутся `model = "deepseek-v4-pro"` и `model_provider = "deepseek"`, в блок `[model_providers.deepseek]` идут `base_url = "https://api.deepseek.com/"` и `wire_api = "responses"`. Дальше запускается `codex` из папки проекта, модель видна в стартовом баннере.
Усилие рассуждения задаёт параметр `reasoning_effort` со значениями low, high и max, по умолчанию стоит high. В Responses API то же пишется как `{"output_config": {"effort": "low"}}`, а думанье выключается через `{"thinking": {"type": "disabled"}}`.
Старые имена отключены с 24 июля: код на `deepseek-chat` и `deepseek-reasoner` уже не работает, его переписывают на `deepseek-v4-pro` или `deepseek-v4-flash`.
Первые счета по новой сетке уйдут после 16:00 UTC 16 августа.
Первоисточник