Назад
18 июня 2026 г. в 06:11 Nvidia AI Agents Robotics Physical AI Research Nvidia Research / Ars Technica / Techmeme

Nvidia показала ENPIRE: ИИ-агенты учат роботов без постоянного надзора человека

Nvidia показала ENPIRE: ИИ-агенты учат роботов без постоянного надзора человека

Исследователи Nvidia, Carnegie Mellon University и UC Berkeley представили ENPIRE — систему, которая позволяет ИИ-агентам улучшать поведение реальных роботов через физические эксперименты. Если обычные coding agents уже умеют искать ошибки в коде и переписывать программы, здесь они получают более сложную среду: робот должен выполнить действие в реальном мире, система проверяет результат, возвращает сцену в исходное состояние и запускает следующую попытку.

Это важный шаг для робототехники, потому что ручная настройка политик остаётся одним из главных тормозов. Робота недостаточно «попросить» вставить деталь или взять предмет: нужно собрать данные, написать функцию награды, проверить сбои, снова запустить тесты и не сломать установку. ENPIRE упаковывает этот цикл в четыре модуля: среду для автоматического сброса и проверки, улучшение политики, запуск испытаний и эволюцию вариантов, где агенты анализируют логи и правят алгоритмы.

Что получилось в лаборатории

На странице проекта Nvidia показывает задачи Push-T, вставку штырьков, работу со стяжкой и вставку GPU. Авторы заявляют, что политики, обученные через ENPIRE, достигли 99% pass@8 на демонстрационных задачах. Важно, что pass@8 здесь не означает восемь независимых удачных дублей на выбор: речь о длинном прогоне, где система может до восьми раз восстановиться после ошибок внутри подзадач.

Отдельно исследователи сравнивали Codex с GPT-5.5, Claude Code с Opus 4.7 и Kimi Code с Kimi K2.6. Смысл сравнения не в красивой таблице моделей, а в проверке нового класса работы: агент не просто пишет код, а ведёт маленькую исследовательскую программу на физическом оборудовании.

Где осторожность

ENPIRE пока не делает роботов универсальными работниками. Авторы прямо пишут об ограничениях: роботы и GPU используются не полностью, пока агенты читают логи, пишут код или ждут ответы модели. При увеличении числа роботов результат приходит быстрее, но растёт расход токенов и усложняется координация.

Но направление заметное. Если такие циклы станут надёжнее, часть прогресса в робототехнике будет происходить не через редкие ручные эксперименты инженеров, а через постоянные автономные прогоны: агент предлагает гипотезу, робот проверяет её в железе, система сохраняет удачные изменения. Это приближает момент, когда ИИ будет улучшать не только софт, но и навыки машин в физическом мире.

Ещё новости

Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии
16 сентября 2026 г.
Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии

Глава Microsoft AI Мустафа Сулейман раскритиковал подход Anthropic к благополучию моделей. Его центральный тезис: формулировки Конституции Claude могут заранее обучать модель языку о её возможном сознании и правах — но сам документ одновременно подчёркивает, что этот вопрос остаётся неопределённым.

Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах
16 сентября 2026 г.
Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах

Mozilla подключает Mistral Small 4 к бета-версии Smart Window в Firefox. Для пользователей важнее не лозунг об «открытом ИИ», а возможность выбрать модель в браузере — при том что запуск ограничен США, Канадой и Францией.

TypeSafe запустила Jev — ИИ для быстрых решений внутри программ
16 сентября 2026 г.
TypeSafe запустила Jev — ИИ для быстрых решений внутри программ

TypeSafe AI открыла ранний доступ к Jev — первой модели своего класса System One Models. Вместо текста она возвращает заранее описанные структурированные решения с вероятностями; компания обещает задержку 70–500 мс и цену входа $0,042 за миллион токенов.

Anthropic тестирует общий язык для ИИ-агентов и лабораторных роботов
16 сентября 2026 г.
Anthropic тестирует общий язык для ИИ-агентов и лабораторных роботов

Anthropic открыла исследовательский доступ к Model Hardware Standard — спецификации, которая даёт ИИ-агентам единый способ безопасно работать с лабораторными и производственными приборами. Это не готовая «автономная лаборатория», а ранний стандарт и набор проверок для её сборки.

Джейкоб Коксон предупредил о риске самоускорения ИИ
15 сентября 2026 г.
Джейкоб Коксон предупредил о риске самоускорения ИИ

Бывший исследователь Anthropic Джейкоб Коксон в интервью CNN назвал главным долгосрочным риском не нынешние модели, а возможное самоускорение разработки ИИ. Это его сценарий и оценка, а не подтверждённый прогноз.

Microsoft предложила правила контроля над будущими ИИ-системами
15 сентября 2026 г.
Microsoft предложила правила контроля над будущими ИИ-системами

Microsoft подготовила проект кодекса поведения для будущих ИИ-систем. По данным Reuters, в нём закреплены человеческий контроль, границы для опасных действий и ответственность людей, а не модели.

Трамп позвонил Хуангу со сцены и назвал страхи вокруг ИИ «обманом»
15 сентября 2026 г.
Трамп позвонил Хуангу со сцены и назвал страхи вокруг ИИ «обманом»

Во время интервью Дженсена Хуанга на All-In Summit Дональд Трамп неожиданно вышел на громкую связь и назвал сопротивление дата-центрам и страхи перед захватом мира ИИ «обманом». При этом он всё же сказал, что развивать технологию нужно осторожно.

Siri AI вышла в бету: в Европе она доступна не на каждом устройстве
15 сентября 2026 г.
Siri AI вышла в бету: в Европе она доступна не на каждом устройстве

Apple открыла бета-тест Siri AI вместе с новой волной Apple Intelligence, но доступ зависит не только от железа. Для iPhone, iPad и Apple Watch в ЕС Siri AI пока недоступна, а облачные функции Apple Foundation Models 3 получили ежедневные лимиты без названных цифр.

OpenAI вынесла агентный «движок» Codex в публичный API
15 сентября 2026 г.
OpenAI вынесла агентный «движок» Codex в публичный API

OpenAI открыла публичную бета-версию Agents API: разработчик передаёт задачу, модель, инструменты и среду, а компания берёт на себя агентный runtime. Главная практическая перемена — не новая модель, а готовая инфраструктура для длительных задач.

The Economist: ИИ пока создаёт больше рабочих мест, чем уничтожает
14 сентября 2026 г.
The Economist: ИИ пока создаёт больше рабочих мест, чем уничтожает

The Economist пишет, что ИИ в США пока создал около миллиона рабочих мест — заметно больше примерно 200 тысяч сокращений, которые связывают с технологией с середины 2023 года. Это не отменяет давления на отдельные офисные роли, но не подтверждает немедленный «апокалипсис занятости».

Альтман подтвердил: OpenAI делает гуманоидного робота
14 сентября 2026 г.
Альтман подтвердил: OpenAI делает гуманоидного робота

Сэм Альтман подтвердил планы OpenAI по созданию гуманоидного робота и других физических форм-факторов. Но прототипа, цены и сроков поставки пока нет: публичный сигнал — это намерение компании войти в Physical AI, а не запуск продукта.

Безопасность ИИ становится спором о правилах рынка
14 сентября 2026 г.
Безопасность ИИ становится спором о правилах рынка

Призыв Дарио Амодеи замедлить развитие frontier-моделей — это прежде всего предложение о внешней проверке и координации лабораторий. Но такие правила одновременно могут изменить цену входа на рынок: поэтому разговор о безопасности нельзя отделять от разговора о конкуренции и ответственности.