DeepSeek оставит 75% скидку на API после промо
DeepSeek указала в официальной документации, что 75-процентная скидка на API для deepseek-v4-pro не закончится как обычная промоакция. После 31 мая 2026 года цена модели будет «официально скорректирована» до четверти от прежнего уровня: $0,435 за 1 млн входных токенов при cache miss, $0,003625 при cache hit и $0,87 за 1 млн выходных токенов.
Для обычного пользователя это звучит как бухгалтерия. Для разработчика, который строит агентов, аналитические пайплайны, поиск по документам или автоматизацию с длинным контекстом, это очень конкретная новость: одна из самых заметных китайских моделей пытается забрать не внимание, а рабочую нагрузку.
Что именно подешевело
В таблице DeepSeek deepseek-v4-pro описана как модель с контекстом до 1 млн токенов, поддержкой режима рассуждения, JSON-вывода, вызовов инструментов, автодополнения диалогового префикса и дописывания кода в обычном режиме. Это не нишевая демка для чата, а набор возможностей, который нужен для прикладных сценариев: работы с большими документами, кодом, внутренними базами знаний и агентными цепочками.
Снижение цен особенно важно для задач, где стоимость быстро растет из-за длинного ввода и множества промежуточных вызовов. Агент, который читает репозиторий, проверяет документы или делает серию вызовов инструментов, тратит не один красивый запрос, а десятки и сотни операций. В таких сценариях разница между «дорого, но можно протестировать» и «достаточно дешево, чтобы встроить в продукт» часто решает судьбу проекта.
DeepSeek отдельно отмечает, что для всех моделей цена cache hit уже снижена до одной десятой от стартовой. Это бьет ровно в практические сценарии с повторяющимся контекстом: корпоративные инструкции, кодовая база, справочник, история клиента или память агента могут кэшироваться и удешевлять последующие запросы.
Почему это важнее обычной скидки
На этой неделе Techmeme также вынесло сообщение Bloomberg о том, что DeepSeek продвигает раунд финансирования примерно на $10 млрд, а менеджмент говорит инвесторам о приоритете фундаментальных исследований над быстрой коммерциализацией. В связке с постоянным снижением API-цен это выглядит как понятная стратегия: сначала сделать модель массовой инфраструктурой, а уже потом монетизировать поверх масштаба.
Для западных провайдеров это неприятная форма конкуренции. Пользователи сравнивают модели не только по лидербордам, но и по тому, сколько стоит реальный рабочий процесс: прогнать тысячу документов, держать агента в длинной сессии, автоматически проверять код или обрабатывать клиентские обращения. Если качество достаточно близко, цена начинает менять архитектурные решения.
Кому стоит следить
Разработчикам и компаниям, которые уже платят за API, стоит пересчитать не один запрос, а полный рабочий процесс: входной контекст, кэш, число вызовов инструментов, выходные токены и повторные проходы. Именно там дешевые модели обычно оказываются не «заменой ChatGPT», а экономическим слоем для фоновых задач, где важна цена за объем.
Но низкая цена не отменяет обычные вопросы: надежность, приватность, юрисдикция, задержки, совместимость с инструментами и качество на конкретном языке или домене. DeepSeek усиливает ценовое давление на рынок, но не снимает с команд обязанность тестировать модель на своих данных.
Главный вывод простой: гонка моделей снова перешла из презентаций в прайс-листы. И если 2025 год показал, что открытые и китайские модели могут догонять по качеству, то 2026-й все чаще показывает другую ставку: кто сделает интеллект достаточно дешевым, чтобы его стали использовать везде.
- api-docs.deepseek.comModels & Pricing | DeepSeek API Docs
- techmeme.comSources: DeepSeek execs told potential investors in its ongoing $10B round that it will prioritize groundbreaking AI research over short-term commercialization
- reddit.comDeepSeek pricing / funding Reddit discovery signal
- reuters.comReuters DeepSeek editorial image













