10 сентября 2026 г.
DeepSeek V4.1 Flash дешевле Pro в работе: расходы на задачу в тесте упали в 2,5 раза
В замерах Artificial Analysis от 10 сентября новая Flash обошла Pro и потратила меньше денег, хотя генерирует больше токенов.

Artificial Analysis
@artificialanlys
DeepSeek V4.1 Flash обошла DeepSeek V4 Pro 0813 и стала новым флагманом DeepSeek с результатом 40 баллов в Artificial Analysis Intelligence Index. При всего 552 млрд параметров она превосходит Pro с её 1,6 трлн параметров, а токены стоят примерно в 4 раза дешевле. Из-за многословности модель немного не дотягивает до границы Парето по соотношению интеллекта и стоимости. @deepseek_ai выпустила DeepSeek V4.1 Flash, преемницу DeepSeek V4 Flash 0731. Модель с 552 млрд параметров использует новую каузальную архитектуру Encoder–Decoder, благодаря которой при обработке входа активны всего 8 млрд параметров, а при генерации ответа 16 млрд. В собственном API DeepSeek миллион входных токенов V4.1 Flash стоит $0,30, миллион выходных токенов стоит $1,20. Входные токены из кеша обходятся всего в $0,006 за миллион, со скидкой 98%. В непиковые часы действует дополнительная скидка 50% на входные, кешированные и выходные токены. V4.1 Flash примерно на 20% дешевле DeepSeek V4 Flash 0731 и примерно в 4 раза дешевле DeepSeek V4 Pro 0813, при этом результаты у неё выше. Ключевые результаты: ➤ DeepSeek V4.1 Flash улучшила результаты в агентных задачах и рассуждениях по длинному контексту. В Terminal-Bench v4.0 DeepSeek V4.1 Flash набрала 27%, что более чем вдвое выше результата DeepSeek V4.0 Flash в 27%. В GDPval-AA v2 её рейтинг вырос на 164 балла Elo, с 1468 до 1632, и теперь V4.1 Flash опережает Kimi K3 с 1584 баллами. В AA-LCR v1.1 DeepSeek V4.1 Flash также набрала 84%, на уровне GPT-5.6 Sol и Gemini 3.8 Flash, у которых тоже по 84%. С контекстным окном в 1 млн токенов это сильный вариант для работы с длинными документами и большими репозиториями по цене моделей линейки Flash. ➤ DeepSeek V4.1 Flash заняла первое место в AutomationBench-AA с результатом 69%, наравне с GPT-6 Astra, у которой тоже 69%, и немного выше Grok 4.6 с 67%. AutomationBench-AA проверяет агентные рабочие процессы на 657 задачах в 39 SaaS-приложениях, включая Salesforce, Jira, Gmail, Zendesk и Google Sheets. Тест оценивает, достигла ли модель цели, не нарушив ограничений. DeepSeek V4.1 Flash прибавила 15 процентных пунктов к результату DeepSeek V4 Flash 0731 в 54%. Она опережает DeepSeek V4 Pro 0813 с её 57% на 12 пунктов, а GLM-5.3 с 62% на 7 пунктов. ➤ DeepSeek V4.1 Flash оказалась одной из самых многословных моделей в наших замерах: 89 тыс. токенов на задачу Intelligence Index. Это на 25% больше, чем у флагманской GLM-5.3 от Z AI с её 71 тыс. токенов, на 29% больше, чем у GLM-5.3-Flash с 69 тыс., и на 62% больше, чем у DeepSeek V4 Pro 0813 с 55 тыс. Она генерирует больше выходных токенов даже по сравнению с ведущими моделями, включая Fable 5.1 с 78 тыс. и Claude Opus 5 с 73 тыс. ➤ Несмотря на такую многословность, задача Intelligence Index на DeepSeek V4.1 Flash всё равно обходится всего в $0,27. Главная причина в низких тарифах: $0,30 за миллион входных токенов и $1,20 за миллион выходных. Входные токены из кеша стоят всего $0,006 за миллион, со скидкой 98%. Это примерно в 7 раз дешевле, чем у GLM-5.3 с $2,01 за задачу и Kimi K3 с $2,00, и примерно в 2,5 раза дешевле, чем у DeepSeek V4 Pro 0813 с $0,67. Дополнительные сведения о модели: ➤ Контекстное окно: 1 млн токенов ➤ Цена: $0,30 / $1,20 за миллион входных/выходных токенов в собственном API DeepSeek, со скидкой 98% при попадании в кеш ($0,006 за миллион кешированных входных токенов) ➤ Входные данные: текст и изображения ➤ Размер: всего 763 млрд параметров, при обработке входа активны 8 млрд, при генерации ответа 16 млрд ➤ Лицензия: MIT ➤ Провайдеры: собственный API DeepSeek

· 972 просмотров
DeepSeek V4.1 Flash набрала 40 баллов в Intelligence Index и обошла V4 Pro 0813. По замерам Artificial Analysis на 10 сентября, Flash стала лидером DeepSeek.
Стоимость задачи. Токены новой Flash стоят примерно в 4 раза дешевле, чем у Pro. Но на задачу в Intelligence Index модель расходует на 62% больше токенов, поэтому разница в стоимости готовой работы меньше.
| Модель | Токенов на задачу Intelligence Index | Стоимость задачи | | --- | ---: | ---: | | DeepSeek V4.1 Flash | 89 тыс. | $0,27 | | DeepSeek V4 Pro 0813 | 55 тыс. | $0,67 | | GLM-5.3 | 71 тыс. | $2,01 | | Kimi K3 | — | $2,00 |
Расчёты Artificial Analysis, 10 сентября 2026 года.
Flash принимает текст и изображения, поддерживает контекст до 1 млн токенов. В тесте AA-LCR v1.1 на рассуждения по длинному контексту она сравнялась с GPT-5.6 Sol и Gemini 3.8 Flash. В AutomationBench-AA, где модели выполняют задачи в рабочих приложениях, Flash разделила первое место с GPT-6 Astra.
Как подключить. Для вызова через API нужен ключ платформы DeepSeek и настройки `model="deepseek-flash"`, `base_url="https://api.deepseek.com"`. API совместим с OpenAI SDK. OpenCode и WorkBuddy, включая CodeBuddy, уже подключили модель.
С 10 сентября миллион входных токенов стоит $0,30, выходных — $1,20. Повторный вход из кеша обходится в $0,006 за миллион токенов. В непиковые часы DeepSeek снижает все три тарифа вдвое.
14 сентября в 12:00 по Пекину DeepSeek перенаправит запросы к `deepseek-v4-pro` на V4.1 Flash по её тарифам до выхода V4.1 Pro.
Первоисточник
