DeepSeek без анонса выпустила V4 Pro с контекстом на миллион токенов

DeepSeek без анонса выпустила V4 Pro с контекстом на миллион токенов

Китайский ИИ-стартап DeepSeek без отдельной презентации добавил в API модель DeepSeek V4 Pro 0813. Ее название и тарифы появились в официальной документации компании, а внимание к релизу привлекли пользователи соцсетей и разработчики ИИ-инструментов.

Главная ставка модели — работа с кодом и самостоятельное выполнение задач на компьютере. По данным, которые приводит технологический автор Chris из аккаунта @ChrisGPT, результат V4 Pro 0813 в Terminal-Bench 2.1 вырос с 72,1% до 87,9%. Этот тест проверяет, насколько точно ИИ справляется с реальными командами и задачами в Linux-терминале.

В CyberGym, наборе испытаний по кибербезопасности, показатель вырос с 52,7% до 83,3%. В тесте программирующих агентов DeepSWE — с 12,8% до 62,7%. Все цифры заявлены самой DeepSeek.

Разработчики открытого ИИ-агента Cline утверждают, что модель получила 1,6 трлн параметров, но при каждом запросе использует 49 млрд из них. Такой подход снижает вычислительные расходы. Размер контекстного окна составляет один миллион токенов — модель может обработать крупную кодовую базу или очень длинный набор документов за один запрос.

DeepSeek установила цену в $0,435 за миллион входных токенов и $0,87 за миллион выходных. При повторном использовании уже обработанного текста вход стоит $0,003625 за миллион токенов. Cline сравнивает производительность новинки с Claude Fable 5 и заявляет, что DeepSeek обходится примерно в 57 раз дешевле, однако методика этого сравнения не раскрыта.

V4 Pro 0813 уже доступна через API. Релиз прошел без отдельного публичного анонса.

Ирина Задорожная
Ирина Задорожная

Журналист с опытом работы в оффлайн-медиа и онлайн-изданиях. Пишу про искусственный интеллект, ИТ-системы и сервисы, про ИТ-бизнес уже 10 лет.