Назад
16 мая 2026 г. в 11:05 AI OpenClaw OpenAI Agents Software Development Consulting X; CodexBar; OpenClaw; GitHub

Сотня AI-агентов и $1,3 млн за месяц за токены языковой модели: как эксперты используют Codex

Сотня AI-агентов и $1,3 млн за месяц за токены языковой модели: как эксперты используют Codex

Сотня AI-агентов и $1,3 млн за месяц за токены языковой модели: как эксперты используют Codex

Петер Штайнбергер, создатель OpenClaw и автор CodexBar, показал в X скриншот панели OpenAI API с расходами, которые выглядят почти абсурдно даже по меркам AI-рынка: $19 985,84 за текущий день и $1 305 088,81 за 30 дней. На том же скриншоте видны 603 млрд токенов и 7,6 млн запросов за месяц.

Важно: это не аудированная финансовая отчётность и не независимая проверка банковского счёта. Neuro.ee опирается на видимый скриншот поста Штайнбергера и атрибутирует цифры именно ему. Но интереснее здесь не сама сумма. В соседнем посте Штайнбергер объясняет реакцию на свои расходы на ИИ так: вокруг OpenClaw постоянно крутится около сотни Codex-агентов в облаке, а главный вопрос эксперимента — «как мы будем строить софт в будущем, если токены не имеют значения?»

Почему это уже не просто «дорого погонял модель»

Обычно счёт за API воспринимают как расход: сколько запросов, сколько токенов, где поставить лимит. Штайнбергер предлагает смотреть иначе. Если агент может часами читать код, искать регрессии, писать тесты, проверять гипотезы и возвращаться с готовым патчем, токены становятся не расходом на чат, а производственным ресурсом.

Это похоже на момент, когда облака перестали быть «арендой серверов» и стали способом быстрее запускать эксперименты. В разработке с агентами новая единица экономики — не один промпт и даже не один инженерный час. Новая единица — связка «эксперт + параллельная армия агентов + проверка результата».

Поэтому $1,3 млн за 30 дней, если читать эту цифру как публичный эксперимент, — не история о роскоши. Это предельный кейс: что произойдёт, если опытный инженер перестанет экономить на модельном труде и начнёт покупать им скорость.

OpenClaw как лаборатория агентной работы

Контекст делает историю сильнее. OpenClaw — открытый персональный AI-ассистент, который работает через привычные каналы вроде Telegram, WhatsApp, Slack или Discord, подключается к локальным инструментам, файлам и браузеру, а не живёт только в одном чате. На GitHub проект описан как «personal AI assistant» для собственных устройств пользователя; на момент проверки у репозитория — сотни тысяч звёзд и десятки тысяч форков.

Штайнбергер не случайный комментатор. На своём сайте он писал, что присоединился к OpenAI, чтобы работать над агентами, а OpenClaw должен остаться открытым и независимым. В другом тексте он описывал разработку «на скорости инференса»: Codex иногда дольше читает код перед изменениями, но именно поэтому может экономить время на переделках.

CodexBar здесь тоже не просто красивая менюшка. По описанию проекта, это приложение для macOS, которое показывает лимиты, кредиты, расходы и окна сброса по AI-провайдерам. То есть инструмент возник из реальной боли: когда работаешь не с одним чат-ботом, а с парком агентных процессов, наблюдаемость расходов становится частью инженерной инфраструктуры.

Что это меняет для консалтинга и малых команд

Для консалтинга эта логика особенно опасна и привлекательна одновременно. Раньше масштаб упирался в количество старших специалистов: хороший архитектор или разработчик мог вести ограниченное число проектов, потому что у него одна голова и один день. Агентная модель меняет форму бутылочного горлышка. Эксперт по-прежнему нужен, но часть работы уходит в параллельные очереди: исследовать кодовую базу, подготовить миграцию, проверить API, написать тесты, собрать отчёт, сравнить подходы.

Малая команда получает шанс вести себя как команда гораздо большего размера — но только если умеет управлять задачами, контекстом, проверкой и ответственностью. Агент не отменяет архитектуру, продуктовый вкус и инженерную дисциплину. Он делает их ещё важнее, потому что плохая постановка задачи теперь может умножаться на десятки параллельных процессов.

Для бизнеса главный вопрос звучит не «сколько стоит запрос?», а «где дорогой запрос дешевле задержки?». Если агентная пачка за ночь проверяет то, что команда откладывала бы две недели, экономика может сходиться даже при большом счёте. Но если агенты бесконтрольно жгут токены без тестов, метрик и ревью, та же система превращается в очень быстрый способ сжечь бюджет.

Новая роль разработчика: не печатать код, а управлять вычислительным трудом

Эта история хорошо показывает сдвиг в профессии. Ценность разработчика всё меньше сводится к ручному набору строк и всё больше — к умению разложить работу на проверяемые задачи, выбрать модель и инструмент, дать агенту правильный контекст, заметить слабый результат и не пропустить опасное изменение.

В старой экономике сильный инженер масштабировался через найм, процессы и менеджмент. В новой — ещё и через агентный парк. Это не означает, что «люди больше не нужны». Наоборот: чем дешевле становится модельный труд, тем дороже становится человек, который понимает, какой труд вообще стоит запускать.

Вывод Neuro.ee

Скриншот Штайнбергера не стоит читать как универсальный совет «тратьте миллион на токены». Для большинства команд это был бы абсурдный и опасный рецепт. Но как ранний сигнал он важен: эксперты уже используют AI-агентов в масштабе, который похож не на помощника в редакторе кода, а на маленькую вычислительную фабрику вокруг одного сильного оператора.

Следующая конкурентная граница в разработке может пройти не между теми, кто «использует ИИ» и «не использует ИИ». Она пройдёт между теми, кто умеет управлять модельным трудом как производственной системой, и теми, кто всё ещё считает токены странной статьёй расходов в конце месяца.

Фраза «токены не имеют значения» не означает, что деньги перестали иметь значение. Она означает другое: когда модельный труд становится достаточно доступным, главным ограничением снова становится человеческая способность задавать правильные вопросы, строить систему проверки и превращать параллельную работу агентов в настоящий продукт.

Ещё новости

Anthropic идёт к IPO с убытком $42 млрд и планом потратить $518 млрд на ИИ
29 сентября 2026 г.
Anthropic идёт к IPO с убытком $42 млрд и планом потратить $518 млрд на ИИ

Reuters ознакомилось с конфиденциальным проспектом Anthropic перед IPO: при выручке $4,6 млрд за 2025 год компания показала чистый убыток $42 млрд и описала план расходов на вычисления и инфраструктуру в $518 млрд на 2027 год. Большая часть убытка — бухгалтерская переоценка инструментов, связанных с будущими акциями; откуда возьмутся деньги на заявленный план, в материале не раскрывается.

Manus даёт личному ИИ-агенту почту, телефон и кошелёк
29 сентября 2026 г.
Manus даёт личному ИИ-агенту почту, телефон и кошелёк

Manus представила Manus 2.0 и приложение Cue, где персональному агенту обещают собственные email, телефон, кошелёк и компьютер. Для бизнеса это переносит главный вопрос от качества ответов к управлению учётными записями, деньгами и журналом действий.

NVIDIA открыла платформу безопасности для ИИ-агентов
28 сентября 2026 г.
NVIDIA открыла платформу безопасности для ИИ-агентов

NVIDIA представила Open Agent Safety Platform — набор открытых компонентов и эталонную архитектуру для контроля действий ИИ-агентов. Ключевая идея: критические ограничения должны проверяться вне самой модели.

NYT: правительства всё сильнее отстают от развития ИИ
28 сентября 2026 г.
NYT: правительства всё сильнее отстают от развития ИИ

The New York Times пишет, что разрыв между скоростью развития ИИ и скоростью выработки правил стал шире, чем когда-либо. Пока модели и агенты быстро выходят за пределы лабораторий, у мира нет общего механизма, который определял бы допустимый риск и ответственность.

Bloomberg: Китай расширил ограничения на поездки семей AI- и чип-специалистов
28 сентября 2026 г.
Bloomberg: Китай расширил ограничения на поездки семей AI- и чип-специалистов

Bloomberg сообщает, что Китай распространил ограничения на зарубежные поездки ключевых сотрудников частных AI- и полупроводниковых компаний на членов их семей. Публикация не подтверждает появление отдельной системы «выездных виз»: речь идёт о мерах контроля поездок, а не о визе, которую выдаёт другая страна.

Meta добавит в WhatsApp говорящий аватар для звонков с очков
26 сентября 2026 г.
Meta добавит в WhatsApp говорящий аватар для звонков с очков

Meta готовит Hologram — цифровое изображение лица для звонков из очков Meta Ray-Ban Display. Аватар будет реагировать на голос, но первый запуск ограничен ранним доступом в США.

Google добавила говорящие аватары в Gemini Enterprise
26 сентября 2026 г.
Google добавила говорящие аватары в Gemini Enterprise

Google открыла для Gemini Enterprise Live Avatar: корпоративный голосовой агент теперь может отвечать с синхронизированным видеоаватаром. Функция полезна для сервисных сценариев, но создание собственных персонажей пока требует allowlist.

Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам
26 сентября 2026 г.
Google Beam выходит в шесть стран: 3D-видеосвязь становится ближе к офисам

Google расширяет поставки Beam — системы видеосвязи с эффектом присутствия — на шесть стран и запускает сеть демонстрационных переговорных. Важно не само обещание «как в одной комнате», а то, что устройство начинает появляться там, где его можно испытать до покупки.

Microsoft встраивает Word, Excel и PowerPoint в новый Copilot
26 сентября 2026 г.
Microsoft встраивает Word, Excel и PowerPoint в новый Copilot

Microsoft представила новый интерфейс Copilot: в нём объединяются чат и агентный режим, а документы Word, таблицы Excel и презентации PowerPoint можно создавать и править прямо из разговора. Первые функции доступны не всем: Home и Code начинают раскатывать в программе Frontier, а Autopilot пока идёт в закрытый предварительный доступ.

Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел
23 сентября 2026 г.
Gemini подключает Adobe, Airtable и Linear: ИИ добирается до списка дел

Google расширяет Connected Apps в Gemini: ассистент получает новые связки с Adobe, Airtable, Linear, Peloton и другими сервисами. Главный вопрос теперь не в количестве подключений, а в том, какие действия и данные пользователь готов отдать в один чат.

AWS запустила CloudWatch Omni для отладки ИИ-агентов
23 сентября 2026 г.
AWS запустила CloudWatch Omni для отладки ИИ-агентов

AWS представила CloudWatch Omni — отдельную среду наблюдаемости для приложений и ИИ-агентов. Сервис собирает трассы, метрики и логи в одном интерфейсе и позволяет расследовать сбои через чат или IDE.

Meta представила Muse — агента, который работает после закрытия приложения
23 сентября 2026 г.
Meta представила Muse — агента, который работает после закрытия приложения

Meta запускает Muse — персонального ИИ-агента для поручений в браузере, почте и покупках. Главный вопрос не в обещанной автономности, а в том, как пользователь ограничит доступ к своим данным и деньгам.