Китайская DeepSeek открыла публичную бету API для своей флагманской модели V4 Flash. Подключиться может любой разработчик.
Главное, что компания вынесла в анонс, — агентные способности.
Что значит «агентные»
Обычная модель отвечает на вопрос и останавливается. Агентная берёт задачу и доводит её до конца сама: вызывает внешние инструменты, читает результат, исправляет себя, делает следующий шаг. Написать код, запустить, увидеть ошибку, переписать — без человека в середине цикла.
Агентность — общая гонка сезона. OpenAI, Anthropic и Google продают уже не собеседника, а исполнителя.
Приставка Flash в названиях моделей — конвенция Google: так в линейке Gemini обозначают быструю и дешёвую версию, рассчитанную на поток запросов, а не на редкие тяжёлые задачи. DeepSeek раньше свои модели так не называла, а ни цену, ни скорость V4 Flash не раскрыла. Если компания следует привычной логике именования, речь о модели для массовых агентных задач — но это догадка по названию, а не заявление разработчика.
Почему на это смотрят
DeepSeek — та самая компания, которая в январе 2025-го выпустила рассуждающую модель R1: качество на уровне американских топов, цена в разы ниже. Акции Nvidia тогда рухнули за один день, а рынок впервые всерьёз усомнился, что сильный ИИ обязательно стоит миллиарды.
Свои прошлые модели DeepSeek выкладывала с открытыми весами — их можно скачать и запустить на собственном железе.
Что это меняет для России
Прямого доступа к API OpenAI и Anthropic отсюда нет. У китайских моделей такого ограничения нет — их здесь широко используют.
Публичная бета значит: API работает, но лимиты, тарифы и поведение модели компания вправе поменять в любой момент. Продакшн на этом строят на свой риск.
Бета — это ещё и сбор данных о том, где модель ломается на реальных задачах. Чужими руками.