Назад
13 мая 2026 г. в 09:10 AI OpenAI Codex AI Agents macOS Desktop Automation Developer Tools OpenAI Developers; OpenAI; MacStories

Codex теперь может управлять вашим компьютером

Codex теперь может управлять вашим компьютером

OpenAI вывела Codex за пределы привычного сценария «агент работает с кодом, файлами и терминалом». В документации приложения Codex появился режим Computer Use: он позволяет агенту видеть и управлять графическими интерфейсами на macOS — нажимать кнопки, печатать, пользоваться окнами, меню, браузером и другими настольными приложениями, если пользователь дал соответствующие разрешения.

Это не просто ещё одна эффектная демка «ИИ двигает мышкой». Важная новость в том, что OpenAI описала Computer Use как штатную часть Codex app с отдельной моделью разрешений, сценариями применения и ограничениями безопасности. И именно эти границы делают функцию интересной для рынка: desktop-агенты начинают переходить из видео в рабочий продукт, но им приходится встраиваться в реальные правила операционной системы и корпоративной безопасности.

Что реально умеет Computer Use

По документации OpenAI, Computer Use нужен там, где командной строки, файлового анализа или структурированной интеграции недостаточно. Типовые случаи: проверить macOS-приложение или iOS Simulator, пройти браузерный сценарий, изменить настройки через интерфейс, воспроизвести баг, который возникает только в GUI, посмотреть данные в приложении без отдельного плагина или выполнить цепочку действий между несколькими программами.

Запускается это через Codex app: пользователь устанавливает Computer Use plugin, затем macOS запрашивает два системных разрешения. Разрешение Screen Recording нужно, чтобы Codex видел целевое приложение; Accessibility — чтобы он мог кликать, печатать и перемещаться по интерфейсу. После этого задача формулируется явно: например, открыть конкретное приложение, пройти конкретный сценарий, воспроизвести ошибку в первом запуске и после правки снова проверить тот же путь.

OpenAI отдельно подчёркивает: если у приложения есть специализированный плагин или MCP-сервер, для доступа к данным и повторяемых операций лучше использовать его. Computer Use — это вариант для визуального контроля и работы с интерфейсом, а не универсальная замена API.

Где проходят разрешения и стоп-линии

Самая важная часть документации — не список возможностей, а список ограничений. Системные разрешения macOS отделены от подтверждений внутри Codex. Первые позволяют приложению видеть экран и управлять интерфейсом; вторые определяют, какие именно приложения пользователь разрешил Codex использовать. При этом чтение файлов, изменения в проекте и команды оболочки по-прежнему подчиняются песочнице и настройкам подтверждений конкретного треда.

Во время задачи Codex должен запросить разрешение на работу с приложением. Пользователь может выбрать Always allow, но OpenAI советует использовать это только для приложений, которым он действительно готов доверить автоматические действия в будущем. Список таких приложений можно убрать в настройках Computer Use.

Есть и жёсткие запреты. Computer Use не может автоматизировать терминальные приложения и сам Codex, потому что это могло бы обходить политики безопасности Codex. Он также не может аутентифицироваться как администратор и подтверждать системные запросы безопасности и приватности на компьютере. Для аккаунтов, платежей, сетевых и приватных настроек, а также действий с учётными данными OpenAI советует оставаться рядом и подтверждать каждый шаг.

Почему это важно для рынка агентов

До сих пор большая часть AI-автоматизации держалась на трёх опорах: текстовом чате, IDE/CLI и API-интеграциях. Это удобно там, где задача хорошо описывается файлами, командами или структурированными вызовами. Но значительная часть реальной работы по-прежнему живёт в интерфейсах: внутренние панели, десктопные приложения, браузеры с активной сессией, настройки, симуляторы, старые системы без API.

Computer Use показывает следующий слой конкуренции: кто сможет безопасно посадить агента за обычный компьютер пользователя. Это особенно важно для разработчиков, тестировщиков и небольших команд. Агент, который может не только предложить правку, но и сам открыть приложение, пройти нужный сценарий и проверить результат, сокращает разрыв между «код написан» и «работа действительно выполнена».

Но вместе с этим растёт цена доверия. Если Codex использует браузер, он может взаимодействовать со страницами, где пользователь уже вошёл в аккаунт. Сайты будут воспринимать клики, формы и действия как действия самого пользователя. Видимые окна, скриншоты, открытые файлы и содержимое приложений становятся контекстом, который агент может обработать во время задачи. Поэтому OpenAI прямо советует держать задачи узкими, закрывать чувствительные приложения, не давать агенту работать с секретами без присутствия человека и останавливать задачу, если он взаимодействует не с тем окном.

Важно отделить факты от демо

Официально подтверждённая часть выглядит так: Computer Use доступен в Codex app на macOS, но на старте не доступен в Европейской экономической зоне, Великобритании и Швейцарии; функция требует плагин Computer Use, разрешения Screen Recording и Accessibility; Codex может работать только с разрешёнными приложениями; отдельные действия с файлами и командами оболочки остаются под песочницей и подтверждениями; терминалы, сам Codex и системные запросы безопасности не автоматизируются.

OpenAI в апрельском анонсе описывала это шире — как переход Codex к работе с большим числом инструментов и приложений на компьютере. MacStories в независимом практическом обзоре отдельно отмечал сильную сторону реализации на Mac: Codex может работать с несколькими приложениями и, по наблюдениям автора, точнее управлять интерфейсами, чем многие решения, которые опираются в основном на скриншоты и координатные клики. Но это уже пользовательский опыт и интерпретация, а не гарантия для всех сценариев.

💬 Мнение редакции Neuro.ee

Смысл Computer Use не в том, что ИИ научился «двигать мышкой». Мышку давно умели двигать скрипты. Сдвиг в другом: крупный AI-поставщик начинает превращать desktop automation в нормальный слой агентной работы, с разрешениями, ограничениями и пользовательским контролем. Если этот подход закрепится, рынок агентов будет конкурировать не только качеством моделей, но и тем, насколько безопасно они получают доступ к рабочей поверхности человека: приложениям, браузеру, файлам, сессиям и решениям, где ошибка уже имеет реальные последствия.

Ещё новости

Google добавила говорящие аватары в Gemini Enterprise
26 сентября 2026 г.
Google добавила говорящие аватары в Gemini Enterprise

Google открыла для Gemini Enterprise Live Avatar: корпоративный голосовой агент теперь может отвечать с синхронизированным видеоаватаром. Функция полезна для сервисных сценариев, но создание собственных персонажей пока требует allowlist.

Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам
26 сентября 2026 г.
Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам

Google расширяет поставки Beam — системы видеосвязи с эффектом присутствия — на шесть стран и запускает сеть демонстрационных переговорных. Важно не само обещание «как в одной комнате», а то, что устройство начинает появляться там, где его можно испытать до покупки.

Microsoft встраивает Word, Excel и PowerPoint в новый Copilot
26 сентября 2026 г.
Microsoft встраивает Word, Excel и PowerPoint в новый Copilot

Microsoft представила новый интерфейс Copilot: в нём объединяются чат и агентный режим, а документы Word, таблицы Excel и презентации PowerPoint можно создавать и править прямо из разговора. Первые функции доступны не всем: Home и Code начинают раскатывать в программе Frontier, а Autopilot пока идёт в закрытый предварительный доступ.

Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел
23 сентября 2026 г.
Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел

Google расширяет Connected Apps в Gemini: ассистент получает новые связки с Adobe, Airtable, Linear, Peloton и другими сервисами. Главный вопрос теперь не в количестве подключений, а в том, какие действия и данные пользователь готов отдать в один чат.

AWS запустила CloudWatch Omni для отладки ИИ-агентов
23 сентября 2026 г.
AWS запустила CloudWatch Omni для отладки ИИ-агентов

AWS представила CloudWatch Omni — отдельную среду наблюдаемости для приложений и ИИ-агентов. Сервис собирает трассы, метрики и логи в одном интерфейсе и позволяет расследовать сбои через чат или IDE.

Meta представила Muse — агента, который работает после закрытия приложения
23 сентября 2026 г.
Meta представила Muse — агента, который работает после закрытия приложения

Meta запускает Muse — персонального ИИ-агента для поручений в браузере, почте и покупках. Главный вопрос не в обещанной автономности, а в том, как пользователь ограничит доступ к своим данным и деньгам.

OpenAI создала совет математиков после спора о доказательствах ИИ
22 сентября 2026 г.
OpenAI создала совет математиков после спора о доказательствах ИИ

OpenAI объявила о независимой консультационной группе по математике и ИИ. Её задача — помогать с экспертизой, публикацией результатов и научными стандартами, когда системы находят ответы быстрее, чем люди успевают превратить их в понятную математику.

Anthropic выпустила Claude Opus 5.5 и снизила цену на работу с ним
22 сентября 2026 г.
Anthropic выпустила Claude Opus 5.5 и снизила цену на работу с ним

Anthropic представила Claude Opus 5.5 — первую модель семейства 5.5. Компания снизила API-цены, ускорила генерацию и увеличила пятитичасовые лимиты подписок, но сохранила строгие ограничения для чувствительных задач.

OpenAI урезала цены и выпустила GPT-6 Sol и Luna
22 сентября 2026 г.
OpenAI урезала цены и выпустила GPT-6 Sol и Luna

OpenAI представила GPT-6 Sol и GPT-6 Luna — более дешёвые модели семейства GPT-6 для повседневной агентной, программной и офисной работы. Sol и Luna не претендуют на место Astra: ставка релиза — сохранить заметную часть её возможностей при меньшей цене и с более выгодным кэшированием контекста.

Anthropic: Claude ведёт 26% исследований моделей
20 сентября 2026 г.
Anthropic: Claude ведёт 26% исследований моделей

Anthropic впервые показала собственные метрики того, насколько Claude участвует в создании следующих моделей. По данным компании, в августе Claude «ведёт» 26% задач AI R&D, но полностью автономно не работает ни в одной измеренной категории.

Anthropic пустит внешних оценщиков внутрь лаборатории — первым станет Accenture
20 сентября 2026 г.
Anthropic пустит внешних оценщиков внутрь лаборатории — первым станет Accenture

Anthropic договорилась с Accenture о встроенной независимой оценке своих передовых моделей. Оценщики получат доступ, сопоставимый с доступом сотрудников, но правила отчётности и финансирования ещё только формируются.

Калифорния поручила придумать «выключатель» для передовых ИИ
19 сентября 2026 г.
Калифорния поручила придумать «выключатель» для передовых ИИ

Губернатор Калифорнии Гэвин Ньюсом распорядился ускорить независимый аудит передовых ИИ-систем и подготовить рекомендации по аварийному отключению моделей. Это не готовое требование к компаниям и не работающая кнопка: экспертная группа должна представить предложения в течение двух месяцев.