toolcall.
Модели10 сент. 2026 г., 14:28 UTC

DeepSeek снижает цену AI-моделей с V4.1 Flash

Новая API-модель поддерживает контекст 1M токенов, tool calls и OpenAI- или Anthropic-совместимый доступ, а cache-hit input стоит от 0.003 USD за 1M токенов.

DeepSeek сделала V4.1 Flash своей новой дешевой API-моделью и снова усилила давление на цены в AI-инференсе. В документации компании deepseek-flash теперь указан как DeepSeek-V4.1-Flash: модель доступна через OpenAI-совместимый и Anthropic-совместимый API, поддерживает tool calls, Responses API и vision.

Главная часть новости - цена. DeepSeek указывает off-peak cache-hit input от 0.003 USD за 1M токенов, peak cache-hit input за 0.006 USD, cache-miss input от 0.15 USD и output от 0.6 USD за 1M токенов. У модели также заявлен контекст 1M токенов и максимальный output 384K токенов.

DeepSeek говорит, что по ее тестам V4.1 Flash обошла V4 Pro по качеству, стоимости, скорости и общему времени ответа, поэтому запросы к V4 Pro будут маршрутизироваться на V4.1 Flash до выхода будущей Pro-версии. Bloomberg описывает запуск как новый удар по конкурентам, включая OpenAI, Anthropic и Z AI: для разработчиков API-доступ к сильной модели становится дешевле.

Оговорка простая: цена в прайсе не доказывает одинаковое качество на всех задачах. Но для агентов, coding-сценариев и больших API-нагрузок DeepSeek снова двигает рынок к более дешевому инференсу.

Источники

Упоминаются

APIdeepseekmodelspricing