DeepSeek выпустила V4.1 Flash: миллион токенов — от $0,003

DeepSeek выпустила V4.1 Flash: миллион токенов — от $0,003

DeepSeek выпустила V4.1 Flash — самую компактную модель в новом семействе архитектур. Она доступна через API под именем deepseek-flash и умеет работать с текстом и изображениями.

Главная цифра релиза — $0,003 за миллион входных токенов. Но такая цена действует только для данных, найденных в кэше, и только вне часов пик. Для обычного входа тариф составляет $0,15, а для генерации ответа — $0,60 за миллион токенов.

В часы пик расценки удваиваются: $0,006 за кэшированный вход, $0,30 за обычный и $1,20 за выход. Пиковыми считаются промежутки с 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням.

У модели контекст на один миллион токенов и максимальный ответ на 384 тысячи токенов. Она поддерживает режим рассуждений, вызов внешних инструментов, JSON, Responses API и интерфейс, совместимый с API Anthropic.

V4.1 Flash заменяет прежние V4 Flash и V4 Flash Vision Experimental. Их старые идентификаторы пока будут перенаправлять запросы на новую модель. С 14 сентября то же произойдет с deepseek-v4-pro: до выхода V4.1 Pro запросы получит Flash, а пользователи заплатят по ее тарифу.

DeepSeek утверждает, что новая компактная модель превзошла V4 Pro по качеству, скорости и стоимости. Компания приводит высокие результаты в тестах по научным вопросам, программированию и работе в терминале. Независимых сравнений в одинаковых условиях пока нет.

На фоне GPT-5.6 Luna предложение выглядит дешево не во всех сценариях. Вне пика обычный вход у DeepSeek на 25% дешевле, а выход — вдвое дешевле. В часы пик вход обходится дороже, а цена выхода совпадает. Рекордные $0,003 — узкий тариф для кэша, а не универсальная стоимость работы модели.

Анна Маркова
Анна Маркова

Специализируется на технологической журналистике с фокусом на искусственный интеллект. Пишет о реальном применении ИИ в бизнесе и повседневной жизни.