Назад
13 августа 2026 г. в 14:50 AI DeepSeek Open Source AI Agents Developers Coding Agents API DeepSeek / DeepSeek API Docs / DeepSeek Harness

DeepSeek связала Harness с обновлением V4 Pro: агентам дали гибкий режим рассуждений

DeepSeek связала Harness с обновлением V4 Pro: агентам дали гибкий режим рассуждений

DeepSeek связала Harness с обновлением V4 Pro: агентам дали гибкий режим рассуждений

DeepSeek обновила флагманскую API-модель до версии V4 Pro-0813 и одновременно раскрыла, как проверяла её в агентных задачах. В официальном анонсе компания заявила гибкий выбор интенсивности рассуждений для V4 Pro и V4 Flash: низкий — для простых запросов, высокий — для повседневной агентной работы, максимальный — для сложных задач. Также DeepSeek добавила нативную поддержку OpenAI Responses API и настройку для Codex.

Связь с недавно открытым DeepSeek Harness оказалась прямой. На части публичных бенчмарков кодовых агентов V4 Pro-0813 тестировали именно через этот фреймворк в минимальном режиме, с максимальным уровнем рассуждений, top_p=0.95 и температурой 1.0. DeepSeek приводит, в частности, 87,9 на Terminal Bench 2.1, 62,7 на DeepSWE и 74,1 на Toolathlon-Verified. Это заявления разработчика, а не независимое сравнение: в таблице отдельно указано, что другая среда исполнения может дать немного иной результат.

Не только модель, но и контур для агента

DeepSeek опубликовала DeepSeek Harness (dsh) — открытую среду для запуска и разработки AI-агентов. Её принцип сформулирован прямо в документации: всё является плагином. Это относится не только к модели и инструментам, но и к журналу сессии, агентному циклу, песочнице и правилам, по которым агент запрашивает разрешение на действие.

Проект вышел под лицензией MIT и отмечен как Developer Preview с предупреждением о ломающих изменениях совместимости. Это пока площадка для разработчиков и ранних интеграций, а не готовая замена рабочему агенту.

Что можно запустить уже сейчас

Самый короткий путь — npx @deepseek-ai/dsh web. Он запускает веб-интерфейс на локальном адресе 127.0.0.1:3080. После выбора рабочей папки агент может читать и изменять файлы, выполнять команды, вести план и делегировать задачи; чувствительные операции должны проходить через активную политику одобрений.

В настройках есть собственный провайдер DeepSeek, а также каталог Anthropic и OpenAI. Можно добавить совместимый с OpenAI шлюз или локальный сервер, вручную задать модели и их поддержку изображений. Ключи хранятся отдельно от настроек: интерфейс возвращает только скрытое описание учётных данных, а не их значение.

Зачем здесь плагины

Обычно агентный продукт поставляется как связка: выбранная модель, набор инструментов и правила исполнения уже предрешены разработчиком. В DeepSeek Harness их можно менять конфигурацией. Профиль собирается из упорядоченных наборов плагинов, поверх которых пользователь накладывает собственные изменения. У проекта есть готовые профили для веб-интерфейса и однократного запуска без сервера.

Это даёт разработчику более прямой контроль над тем, где выполняется код, как сохраняется история, какие инструменты видит агент и какие действия требуют подтверждения. Но цена гибкости — необходимость разбираться в конфигурации и следить за меняющимся API ранней версии.

Для команд это означает, что DeepSeek строит не только модель, но и заменяемый слой вокруг неё. Экспериментировать с ранней версией лучше в отдельной папке и с включёнными подтверждениями: у агента с доступом к терминалу безопасность определяется конкретной политикой доступа, а не интерфейсом.

Ещё новости

Google добавила говорящие аватары в Gemini Enterprise
26 сентября 2026 г.
Google добавила говорящие аватары в Gemini Enterprise

Google открыла для Gemini Enterprise Live Avatar: корпоративный голосовой агент теперь может отвечать с синхронизированным видеоаватаром. Функция полезна для сервисных сценариев, но создание собственных персонажей пока требует allowlist.

Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам
26 сентября 2026 г.
Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам

Google расширяет поставки Beam — системы видеосвязи с эффектом присутствия — на шесть стран и запускает сеть демонстрационных переговорных. Важно не само обещание «как в одной комнате», а то, что устройство начинает появляться там, где его можно испытать до покупки.

Microsoft встраивает Word, Excel и PowerPoint в новый Copilot
26 сентября 2026 г.
Microsoft встраивает Word, Excel и PowerPoint в новый Copilot

Microsoft представила новый интерфейс Copilot: в нём объединяются чат и агентный режим, а документы Word, таблицы Excel и презентации PowerPoint можно создавать и править прямо из разговора. Первые функции доступны не всем: Home и Code начинают раскатывать в программе Frontier, а Autopilot пока идёт в закрытый предварительный доступ.

Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел
23 сентября 2026 г.
Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел

Google расширяет Connected Apps в Gemini: ассистент получает новые связки с Adobe, Airtable, Linear, Peloton и другими сервисами. Главный вопрос теперь не в количестве подключений, а в том, какие действия и данные пользователь готов отдать в один чат.

AWS запустила CloudWatch Omni для отладки ИИ-агентов
23 сентября 2026 г.
AWS запустила CloudWatch Omni для отладки ИИ-агентов

AWS представила CloudWatch Omni — отдельную среду наблюдаемости для приложений и ИИ-агентов. Сервис собирает трассы, метрики и логи в одном интерфейсе и позволяет расследовать сбои через чат или IDE.

Meta представила Muse — агента, который работает после закрытия приложения
23 сентября 2026 г.
Meta представила Muse — агента, который работает после закрытия приложения

Meta запускает Muse — персонального ИИ-агента для поручений в браузере, почте и покупках. Главный вопрос не в обещанной автономности, а в том, как пользователь ограничит доступ к своим данным и деньгам.

OpenAI создала совет математиков после спора о доказательствах ИИ
22 сентября 2026 г.
OpenAI создала совет математиков после спора о доказательствах ИИ

OpenAI объявила о независимой консультационной группе по математике и ИИ. Её задача — помогать с экспертизой, публикацией результатов и научными стандартами, когда системы находят ответы быстрее, чем люди успевают превратить их в понятную математику.

Anthropic выпустила Claude Opus 5.5 и снизила цену на работу с ним
22 сентября 2026 г.
Anthropic выпустила Claude Opus 5.5 и снизила цену на работу с ним

Anthropic представила Claude Opus 5.5 — первую модель семейства 5.5. Компания снизила API-цены, ускорила генерацию и увеличила пятитичасовые лимиты подписок, но сохранила строгие ограничения для чувствительных задач.

OpenAI урезала цены и выпустила GPT-6 Sol и Luna
22 сентября 2026 г.
OpenAI урезала цены и выпустила GPT-6 Sol и Luna

OpenAI представила GPT-6 Sol и GPT-6 Luna — более дешёвые модели семейства GPT-6 для повседневной агентной, программной и офисной работы. Sol и Luna не претендуют на место Astra: ставка релиза — сохранить заметную часть её возможностей при меньшей цене и с более выгодным кэшированием контекста.

Anthropic: Claude ведёт 26% исследований моделей
20 сентября 2026 г.
Anthropic: Claude ведёт 26% исследований моделей

Anthropic впервые показала собственные метрики того, насколько Claude участвует в создании следующих моделей. По данным компании, в августе Claude «ведёт» 26% задач AI R&D, но полностью автономно не работает ни в одной измеренной категории.

Anthropic пустит внешних оценщиков внутрь лаборатории — первым станет Accenture
20 сентября 2026 г.
Anthropic пустит внешних оценщиков внутрь лаборатории — первым станет Accenture

Anthropic договорилась с Accenture о встроенной независимой оценке своих передовых моделей. Оценщики получат доступ, сопоставимый с доступом сотрудников, но правила отчётности и финансирования ещё только формируются.

Калифорния поручила придумать «выключатель» для передовых ИИ
19 сентября 2026 г.
Калифорния поручила придумать «выключатель» для передовых ИИ

Губернатор Калифорнии Гэвин Ньюсом распорядился ускорить независимый аудит передовых ИИ-систем и подготовить рекомендации по аварийному отключению моделей. Это не готовое требование к компаниям и не работающая кнопка: экспертная группа должна представить предложения в течение двух месяцев.