DeepSeek снижает цену AI-моделей с V4.1 Flash
Новая API-модель поддерживает контекст 1M токенов, tool calls и OpenAI- или Anthropic-совместимый доступ, а cache-hit input стоит от 0.003 USD за 1M токенов.
DeepSeek сделала V4.1 Flash своей новой дешевой API-моделью и снова усилила давление на цены в AI-инференсе. В документации компании deepseek-flash теперь указан как DeepSeek-V4.1-Flash: модель доступна через OpenAI-совместимый и Anthropic-совместимый API, поддерживает tool calls, Responses API и vision.
Главная часть новости - цена. DeepSeek указывает off-peak cache-hit input от 0.003 USD за 1M токенов, peak cache-hit input за 0.006 USD, cache-miss input от 0.15 USD и output от 0.6 USD за 1M токенов. У модели также заявлен контекст 1M токенов и максимальный output 384K токенов.
DeepSeek говорит, что по ее тестам V4.1 Flash обошла V4 Pro по качеству, стоимости, скорости и общему времени ответа, поэтому запросы к V4 Pro будут маршрутизироваться на V4.1 Flash до выхода будущей Pro-версии. Bloomberg описывает запуск как новый удар по конкурентам, включая OpenAI, Anthropic и Z AI: для разработчиков API-доступ к сильной модели становится дешевле.
Оговорка простая: цена в прайсе не доказывает одинаковое качество на всех задачах. Но для агентов, coding-сценариев и больших API-нагрузок DeepSeek снова двигает рынок к более дешевому инференсу.
Источники
- DeepSeek API Docs: Models & Pricingapi-docs.deepseek.com
- Bloomberg: DeepSeek low-cost modelbloomberg.com