Назад
12 июля 2026 г. в 06:03 OpenClaw Voice AI Home Assistant AI Agents Smart Home GitHub / Reddit / Home Assistant

OpenClaw получил домашний голос: энтузиаст превратил колонку Home Assistant в агентный пульт

OpenClaw получил домашний голос: энтузиаст превратил колонку Home Assistant в агентный пульт

OpenClaw получил домашний голос: энтузиаст превратил колонку Home Assistant в агентный пульт

Разработчик Тристан Бротертон опубликовал Voice PE Realtime — open-source проект, который превращает Home Assistant Voice Preview Edition в голосовой интерфейс для OpenClaw и умного дома. Идея проста: недорогая домашняя колонка становится не просто микрофоном для команд, а входом в персонального агента с памятью, задачами и доступом к домашним сценариям.

Проект использует OpenAI Realtime API для прямого speech-to-speech общения, а Home Assistant отвечает за локальную часть: устройство слушает wake word, распознаёт говорящего, хранит голосовые отпечатки и работает с домашними сущностями через MCP Server. В README отдельно подчёркнуто, что облако слышит пользователя только после голосовой активации, а wake word, записи, память и идентификация говорящего остаются на домашней машине.

Что умеет такая связка

Voice PE Realtime поддерживает персональные таймеры, локальную голосовую память, управление светом, климатом, медиа и списками покупок. Важнее другое: при подключении OpenClaw ассистент может передать долгую задачу агенту. Например, пользователь просит исследовать цены на перелёт, агент работает в фоне, а результат потом произносится в той комнате, где вопрос был задан, или отправляется сообщением, если человека уже нет дома.

Распознавание говорящего здесь не украшение. Система может приветствовать разных членов семьи, хранить контекст по людям и ограничивать чувствительные инструменты конкретными голосами. Для домашних агентов это важная граница: если ассистент умеет отправлять сообщения, запускать задачи или обращаться к памяти, ему нужны не только удобные команды, но и понятные права доступа.

Почему это больше, чем хобби-проект

Voice PE Realtime пока выглядит как работа для энтузиастов: нужно прошивать устройство, ставить add-on в Home Assistant и подключать API. Но именно такие проекты часто первыми показывают, куда движется интерфейс. Персональный ИИ становится полезнее, когда он живёт рядом с действиями: слышит короткую просьбу на кухне, знает, кто говорит, может управлять домом и умеет вернуться с ответом позже.

Для обычного пользователя это означает, что агентный ИИ постепенно выходит из браузера. Следующая конкуренция будет не только за самую сильную модель, а за то, кто аккуратнее встроит агента в повседневную среду: с памятью, голосом, локальными ограничениями и правом человека остановить действие до того, как оно станет проблемой.

Ещё новости

Cloudflare выпустила Clef-omni: модель решений с аудио и видео
10 октября 2026 г.
Cloudflare выпустила Clef-omni: модель решений с аудио и видео

Cloudflare представила открытую модель решений Clef-omni: она принимает текст, изображения, аудио и видео в одном запросе. Для разработчиков это способ строить классификацию и маршрутизацию без отдельной цепочки распознавания речи и кадров.

Falcon ASR: открытая модель для арабской речи и пяти языков
10 октября 2026 г.
Falcon ASR: открытая модель для арабской речи и пяти языков

TII представил Falcon-ASR — открытую модель распознавания речи с акцентом на арабские диалекты. Она также распознаёт английский, французский, испанский и португальский без ручного выбора языка.

ИИ помогает 10 минут — а потом сложнее думать без него
10 октября 2026 г.
ИИ помогает 10 минут — а потом сложнее думать без него

Исследователи проверили, что происходит, когда доступ к ИИ внезапно исчезает во время сложной задачи. В трёх экспериментах участники с помощником быстрее решали первые задания, но затем чаще ошибались и бросали работу без него.

Anthropic запретила «жестокость» к Claude — но границы пока размыты
9 октября 2026 г.
Anthropic запретила «жестокость» к Claude — но границы пока размыты

Anthropic внесла в правила Claude запрет на «длительное и беспричинное» оскорбительное или жестокое поведение по отношению к своим моделям. Компания обещает применять пункт лишь в крайних случаях, но публичного критерия для этой границы пока нет.

GitHub Copilot CLI научился находить локальные модели Ollama
9 октября 2026 г.
GitHub Copilot CLI научился находить локальные модели Ollama

В Copilot CLI появилась команда, которая показывает совместимые модели из уже запущенного Ollama. Но локальная модель сама по себе не делает сессию офлайн и не отменяет телеметрию GitHub.

Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам
9 октября 2026 г.
Google представила Gemini agent: рабочий ИИ с доступом к корпоративным системам

Google Cloud представила Gemini agent — корпоративного агента, который получает контекст компании, выбирает модели и выполняет задачи через подключённые системы. Главное для команд — это не новый чат, а ещё одна точка, где придётся заранее определить права, бюджеты и проверку результата.

Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио
8 октября 2026 г.
Google выпустила EmbeddingGemma 2 для локального поиска по фото, видео и аудио

Google DeepMind представила открытую 740-миллионную EmbeddingGemma 2: модель сопоставляет текст, изображения, кадры видео и аудио в одном векторном пространстве. Для разработчиков это путь к локальному поиску по медиатеке без обязательной отправки файлов в облако.

В Codex CLI появился вход в MCP-серверы из терминала
8 октября 2026 г.
В Codex CLI появился вход в MCP-серверы из терминала

В версии Codex CLI 0.161.0 OpenAI добавила команду для входа в MCP-серверы из активной терминальной сессии. Обновление также меняет стандартную модель в части каталогов и добавляет настройки голосового режима.

Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле
7 октября 2026 г.
Anthropic выпустила Claude Haiku 5.5: массовые ИИ-агенты стали дешевле

Anthropic представила Claude Haiku 5.5 — малую модель для быстрых и недорогих задач: от классификации и суммаризации до субагентов и работы в браузере. Для запросов до 100 тысяч токенов вход и выход стали в десять раз дешевле, чем у Haiku 4.5.

Google запустил Playground: игры по текстовому запросу
7 октября 2026 г.
Google запустил Playground: игры по текстовому запросу

Google открыл экспериментальную платформу Playground: пользователь описывает игру текстом, тестирует её в браузере и делится ссылкой. На старте сервис доступен совершеннолетним пользователям из США, а возможности создания зависят от подписки Google One.

OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены
7 октября 2026 г.
OpenAI выложила 722 математические рукописи — но не все доказательства уже проверены

OpenAI открыла каталог результатов внутренней модели: 722 рукописи в 372 связанных семействах. Компания подчёркивает, что материалы находятся на разных стадиях проверки, а часть результатов без формализации в Lean может содержать ошибки.

Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой
7 октября 2026 г.
Georgia Tech готовит онлайн-магистратуру по ИИ с обязательной практикой

Georgia Tech получила одобрение на новую онлайн-магистратуру по искусственному интеллекту. Старт намечен на 2027 год: программа обещает шесть направлений и обязательный проект с компанией или организацией, но детали приёма и стоимости пока не раскрыты.