Назад
22 мая 2026 г. в 15:00 AI DeepSeek API Models China Pricing DeepSeek API Docs

DeepSeek оставит 75% скидку на API после промо

DeepSeek оставит 75% скидку на API после промо

DeepSeek указала в официальной документации, что 75-процентная скидка на API для deepseek-v4-pro не закончится как обычная промоакция. После 31 мая 2026 года цена модели будет «официально скорректирована» до четверти от прежнего уровня: $0,435 за 1 млн входных токенов при cache miss, $0,003625 при cache hit и $0,87 за 1 млн выходных токенов.

Для обычного пользователя это звучит как бухгалтерия. Для разработчика, который строит агентов, аналитические пайплайны, поиск по документам или автоматизацию с длинным контекстом, это очень конкретная новость: одна из самых заметных китайских моделей пытается забрать не внимание, а рабочую нагрузку.

Что именно подешевело

В таблице DeepSeek deepseek-v4-pro описана как модель с контекстом до 1 млн токенов, поддержкой режима рассуждения, JSON-вывода, вызовов инструментов, автодополнения диалогового префикса и дописывания кода в обычном режиме. Это не нишевая демка для чата, а набор возможностей, который нужен для прикладных сценариев: работы с большими документами, кодом, внутренними базами знаний и агентными цепочками.

Снижение цен особенно важно для задач, где стоимость быстро растет из-за длинного ввода и множества промежуточных вызовов. Агент, который читает репозиторий, проверяет документы или делает серию вызовов инструментов, тратит не один красивый запрос, а десятки и сотни операций. В таких сценариях разница между «дорого, но можно протестировать» и «достаточно дешево, чтобы встроить в продукт» часто решает судьбу проекта.

DeepSeek отдельно отмечает, что для всех моделей цена cache hit уже снижена до одной десятой от стартовой. Это бьет ровно в практические сценарии с повторяющимся контекстом: корпоративные инструкции, кодовая база, справочник, история клиента или память агента могут кэшироваться и удешевлять последующие запросы.

Почему это важнее обычной скидки

На этой неделе Techmeme также вынесло сообщение Bloomberg о том, что DeepSeek продвигает раунд финансирования примерно на $10 млрд, а менеджмент говорит инвесторам о приоритете фундаментальных исследований над быстрой коммерциализацией. В связке с постоянным снижением API-цен это выглядит как понятная стратегия: сначала сделать модель массовой инфраструктурой, а уже потом монетизировать поверх масштаба.

Для западных провайдеров это неприятная форма конкуренции. Пользователи сравнивают модели не только по лидербордам, но и по тому, сколько стоит реальный рабочий процесс: прогнать тысячу документов, держать агента в длинной сессии, автоматически проверять код или обрабатывать клиентские обращения. Если качество достаточно близко, цена начинает менять архитектурные решения.

Кому стоит следить

Разработчикам и компаниям, которые уже платят за API, стоит пересчитать не один запрос, а полный рабочий процесс: входной контекст, кэш, число вызовов инструментов, выходные токены и повторные проходы. Именно там дешевые модели обычно оказываются не «заменой ChatGPT», а экономическим слоем для фоновых задач, где важна цена за объем.

Но низкая цена не отменяет обычные вопросы: надежность, приватность, юрисдикция, задержки, совместимость с инструментами и качество на конкретном языке или домене. DeepSeek усиливает ценовое давление на рынок, но не снимает с команд обязанность тестировать модель на своих данных.

Главный вывод простой: гонка моделей снова перешла из презентаций в прайс-листы. И если 2025 год показал, что открытые и китайские модели могут догонять по качеству, то 2026-й все чаще показывает другую ставку: кто сделает интеллект достаточно дешевым, чтобы его стали использовать везде.

Ещё новости

GitHub открыла API для запуска проверок кода Copilot
5 октября 2026 г.
GitHub открыла API для запуска проверок кода Copilot

GitHub разрешила запускать проверку pull request’ов Copilot через REST и GraphQL API. Одновременно для новых и уже существующих репозиториев стандартным уровнем тщательности стал Balanced.

AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком
5 октября 2026 г.
AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком

AWS открыла предварительный доступ к Well-Architected Agent — сервису, который анализирует инфраструктуру и предлагает исправления для стоимости, производительности, устойчивости и безопасности. Рекомендации могут включать изменения IaC, но AWS отдельно предупреждает: генеративный ИИ способен ошибаться.

Google урезает доступ к Gemini: бесплатным оставят Flash-Lite
4 октября 2026 г.
Google урезает доступ к Gemini: бесплатным оставят Flash-Lite

Google меняет набор моделей Gemini для бесплатных пользователей и подписки AI Plus. С 9 октября доступ к Pro исчезнет у обоих уровней, а платный AI Pro получит Deep Think.

Руководитель по безопасности OpenAI ушёл, назвав культуру компании сломанной
4 октября 2026 г.
Руководитель по безопасности OpenAI ушёл, назвав культуру компании сломанной

Дэвид Робинсон, руководивший подготовкой отчётов по безопасности к релизам OpenAI, покинул компанию. В эссе он заявил, что темп запусков не оставляет ей достаточной осторожности; OpenAI ответила, что продолжает усиливать практики безопасности и при необходимости замедляет обучение или выпуск моделей.

PFNYC: в Нью-Йорке сжимаются стартовые вакансии в профессиях, уязвимых для ИИ
4 октября 2026 г.
PFNYC: в Нью-Йорке сжимаются стартовые вакансии в профессиях, уязвимых для ИИ

В Нью-Йорке с 2022 года заметно сократилось число стартовых вакансий в нескольких офисных профессиях с высокой подверженностью ИИ, сообщает Partnership for New York City. Данные PFNYC и отдельная работа Stanford фиксируют совпадающие ранние паттерны, но не доказывают, что их причиной стал именно ИИ.

Фишинг под видом обсуждения ИИ-политики: как TA419 охотилась за доступом к Microsoft 365
4 октября 2026 г.
Фишинг под видом обсуждения ИИ-политики: как TA419 охотилась за доступом к Microsoft 365

Proofpoint описала кампанию TA419 против экспертов по ИИ-политике: злоумышленники начинали с правдоподобного письма, а после ответа вели жертву на поддельную страницу входа Microsoft.

GitHub Copilot получил доступ к настольным приложениям
4 октября 2026 г.
GitHub Copilot получил доступ к настольным приложениям

GitHub открыл preview режима Computer Use для Copilot CLI и приложения Copilot на macOS и Windows. Агент может работать с графическим интерфейсом, но перед управлением программой обязан запросить подтверждение.

За ИИ платят лишь 2,2% домохозяйств США — но чек растёт
3 октября 2026 г.
За ИИ платят лишь 2,2% домохозяйств США — но чек растёт

В отчёте a16z State of Markets II доля американских домохозяйств с платной AI-подпиской достигла 2,2% к весне 2026 года. Это не оценка всего рынка ИИ и не число пользователей: график фиксирует только оплачиваемые подписки домохозяйств, зато показывает одновременно рост проникновения и среднего ежемесячного чека.

NVIDIA выпустит DGX Spark с 64 ГБ памяти за $4 999
3 октября 2026 г.
NVIDIA выпустит DGX Spark с 64 ГБ памяти за $4 999

NVIDIA добавляет более доступную версию DGX Spark с 64 ГБ объединённой памяти. Один компьютер рассчитан на локальные модели до 100 млрд параметров, а пара устройств может объединять память до 128 ГБ.

Meta открыла SDK для устройств Muse: агент можно подключить к ESP32 и Raspberry Pi
3 октября 2026 г.
Meta открыла SDK для устройств Muse: агент можно подключить к ESP32 и Raspberry Pi

Meta опубликовала открытые SDK и прошивки для самодельных устройств, подключаемых к персональному агенту Muse. Практический смысл — вывести агента из приложения на кнопки, дисплеи, датчики и домашние сценарии, но для сопряжения всё равно нужен токен и режим разработчика.

ИИ помог прочитать шифр Наполеоновской войны, молчавший 217 лет
2 октября 2026 г.
ИИ помог прочитать шифр Наполеоновской войны, молчавший 217 лет

ИИ-инженер Картер Чёрч с помощью GPT-6 Astra расшифровал письмо для генерала Огюста де Мармона, известное лишь по скану 1969 года. Важен не только результат, но и рабочий процесс: модель одновременно читала рукописные знаки, строила ключ гомофонического шифра и проверяла гипотезы по исходному изображению.

Microsoft выпустила расшифровку, которая начинает работать до конца фразы
2 октября 2026 г.
Microsoft выпустила расшифровку, которая начинает работать до конца фразы

Microsoft AI представила потоковую модель MAI-Transcribe-2-Streaming и две голосовые модели. Главная ставка — голосовые агенты, которые могут начать обработку запроса ещё во время речи.