10 сентября 2026 г.
DeepSeek V4.1-Flash ускоряет ответы: 217 токенов/с в замере Artificial Analysis
DeepSeek V4.1-Flash показала 217 токенов/с в таблице Artificial Analysis от 12 сентября 2026 года. На DeepSWE v1.1 доля решённых задач составила 74,2%, на Terminal-Bench 3.0 модель получила 30,0%. API даёт контекст 1 млн токенов, выход до 384K и 2500 одновременных запросов.

V4-Flash и V4-Flash-Vision-Exp были отдельными ID. Теперь оба имени обслуживает V4.1-Flash, а V4-Pro сохранится с прежней тарификацией после 14 сентября 2026 года.
Что изменилось. Это самая маленькая модель новой архитектуры DeepSeek с пониманием изображений. В API доступны Tool Calls, JSON Output, Responses API и Anthropic API.
Подключение. В `client.chat.completions.create` нужны DeepSeek API Key, `base_url="https://api.deepseek.com"` и `model="deepseek-flash"`. Изображение можно передать через Base64 data URL, публичную ссылку `image_url` или `file_id` после Files API. Поддерживаются JPEG, PNG, GIF и WebP.
Цена. Пик действует по будням с 01:00 до 04:00 и с 06:00 до 10:00 UTC. В это время 1 млн токенов стоит $0,006 за кешированный вход, $0,30 за обычный вход и $1,20 за выход. Вне пика тарифы составляют $0,003, $0,15 и $0,60.
Замеры. В открытой таблице Artificial Analysis от 12 сентября 2026 года сравнение выглядит так:
| Показатель | V4.1-Flash (max) | GPT-5.6 Sol (high) | |---|---:|---:| | Скорость генерации | 217 токенов/с | 60 токенов/с | | Время задачи | 310,83 с | 221,09 с | | Стоимость задачи | $0,27 | $0,81 |
Локально. Веса опубликованы на Hugging Face под MIT. Для запуска DeepSeek предлагает установить `requirements.txt`, преобразовать веса через `convert.py` с `--model-parallel 8 --expert-dtype fp4`, затем запустить `generate.py` через `torchrun`. Карточка модели также содержит инструкции по воспроизведению DeepSWE v1.1.
Архитектура. По данным DeepSeek, KV cache требует в 4 раза меньше HBM и в 8 раз меньше SSD, чем у предыдущего поколения. Causal Encoder–Decoder активирует 8B параметров на входе и 16B на выходе.
После 14 сентября 2026 года V4-Pro останется доступной с прежней тарификацией, а старые V4-Flash ID будут вести на V4.1-Flash.
Первоисточник
