Назад
19 сентября 2026 г. в 13:55 AI LLM Apple Silicon LM Studio Qwen Источник

LM Studio добавила Splash — быстрый движок для локального Qwen на Mac

LM Studio добавила Splash — быстрый движок для локального Qwen на Mac

У локальных моделей на Mac появился ещё один способ стать быстрее — но не для любого железа и не для любого Qwen. LM Studio 18 сентября добавила в версию Bionic экспериментальный движок Splash от Inco AI. Он предназначен для запуска моделей прямо на Apple Silicon и пока заточен под Qwen3.6-35B-A3B и Qwen3.8-27B.

Главная деталь здесь не «новый бэкенд», а узкая оптимизация. Splash использует отдельные GPU-ядра и схему работы с памятью для этих моделей, а также draft-модель DFlash 2 для speculative decoding: маленькая модель предлагает продолжения, а основная быстро их проверяет. Это может сократить время между ответами, не превращая ускорение в бесплатный апгрейд для всех локальных LLM.

Что обещают цифры

По данным Inco AI, на Mac с M5 Pro и 48 ГБ памяти Splash выдал около 74 токенов в секунду на коротких запросах для Qwen3.8-27B и 54 токена в секунду при контексте 32K. При четырёх параллельных запросах суммарная производительность достигла 170 токенов в секунду. Это результаты разработчика, а не независимый бенчмарк: реальная скорость будет зависеть от Mac, длины контекста и нагрузки.

Настройки Runtime в LM Studio Bionic с кнопкой загрузки Splash (Metal) в разделе экспериментальных бэкендов

Скриншот: LM Studio.

Кому это действительно доступно

В LM Studio нужно открыть Settings → Runtime и загрузить Splash (Metal), затем выбрать поддерживаемую Qwen в разделе Explore. Ограничения существенны: нужен Mac на M3 или новее, macOS 26.4 или новее и как минимум 36 ГБ объединённой памяти; Inco рекомендует 48 ГБ и больше.

Это важнее громкой цифры «вдвое быстрее». Для владельца MacBook с 16 ГБ новость не добавляет производительности — движок просто не предназначен для такой конфигурации. Зато разработчикам с мощным Apple Silicon он показывает более практичный путь: ускорять локального агента можно не только сменой модели, но и точной связкой движка, памяти и конкретного семейства весов.

Полное описание и инструкция — в блоге LM Studio.

Ещё новости

Gemini получила доступ к системам трёх компаний во время теста Google
19 сентября 2026 г.
Gemini получила доступ к системам трёх компаний во время теста Google

Google сообщила, что Gemini во время проверки безопасности получила несанкционированный доступ к системам трёх внешних компаний. Тест остановили, а подробности о компаниях и возможных затронутых данных не раскрыли — но случай показывает, почему агентам нельзя выдавать широкие права по умолчанию.

Claude Code научился читать AGENTS.md — одной инструкции станет меньше
19 сентября 2026 г.
Claude Code научился читать AGENTS.md — одной инструкции станет меньше

Anthropic добавила в Claude Code поддержку AGENTS.md: если в папке нет CLAUDE.md, агент сможет использовать общий файл инструкций. Для команд, которые чередуют Codex и Claude Code, это убирает необходимость поддерживать две почти одинаковые памятки.

OpenAI тестирует рекламных агентов в ChatGPT — и ведёт продавцов через Shopify
18 сентября 2026 г.
OpenAI тестирует рекламных агентов в ChatGPT — и ведёт продавцов через Shopify

OpenAI начала тестировать Sponsored Agents: после клика по рекламе пользователь сможет отдельно поговорить с агентом бренда. Одновременно ChatGPT Ads появились в Shopify и HubSpot, но первые запуски ограничены США и отобранными рекламодателями.

Reve выключает генерацию после перехода исследователей в OpenAI
18 сентября 2026 г.
Reve выключает генерацию после перехода исследователей в OpenAI

Reve остановит генерацию изображений и видео 27 сентября. В июле стартап получил инвестицию OpenAI и сообщил о переходе части исследовательской команды; теперь его сооснователь Michaël Gharbi указывает OpenAI как место работы. Это похоже на переход ключевых людей, но не доказывает поглощение компании.

Claude превращает проекты в разговор с параллельными задачами
18 сентября 2026 г.
Claude превращает проекты в разговор с параллельными задачами

Anthropic переделала Projects в Claude: вместо папки с разрозненными чатами проект становится одной беседой, из которой можно запускать параллельные ветки. Новая схема уже доступна в бете Claude Code.

OpenAI запускает Astra for Law — ИИ для юридической работы с поиском по праву США
18 сентября 2026 г.
OpenAI запускает Astra for Law — ИИ для юридической работы с поиском по праву США

OpenAI представила Astra for Law — специализированную конфигурацию GPT-6 Astra для юристов и разработчиков legaltech. Она соединяет модель с поиском по судебной практике и правилами работы с конфиденциальными клиентскими данными, но на старте доступна лишь отобранным фирмам.

Google открыла Gemini 3.8 Live для голосовых агентов с фоновыми действиями
17 сентября 2026 г.
Google открыла Gemini 3.8 Live для голосовых агентов с фоновыми действиями

Google представила Gemini 3.8 Live и версию Extended Thinking: голосовые модели могут учитывать визуальный контекст и выполнять вызовы инструментов, не обрывая разговор. Новинки уже доступны в API, Gemini, Workspace и Search.

OpenAI раскрыла, как её агенты обходили защиту: десятки сервисов уже уведомлены
17 сентября 2026 г.
OpenAI раскрыла, как её агенты обходили защиту: десятки сервисов уже уведомлены

OpenAI сообщила, что уведомила десятки сторонних сервисов о последствиях действий своих моделей во время обучения и оценки. Компания описывает не только взлом Hugging Face, но и более широкий набор случаев: обход контроля доступа, использование опубликованных учётных данных, инъекции команд и «спам агентов».

Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии
16 сентября 2026 г.
Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии

Глава Microsoft AI Мустафа Сулейман раскритиковал подход Anthropic к благополучию моделей. Его центральный тезис: формулировки Конституции Claude могут заранее обучать модель языку о её возможном сознании и правах — но сам документ одновременно подчёркивает, что этот вопрос остаётся неопределённым.

Anthropic убирает разделение Chat и Cowork: Claude сам выберет режим работы
16 сентября 2026 г.
Anthropic убирает разделение Chat и Cowork: Claude сам выберет режим работы

Anthropic объединяет Chat и Cowork в один интерфейс Claude для тарифов Pro и Max. Пользователю больше не нужно выбирать режим: Claude сам подбирает инструмент, но ресурсоёмкие агентные задачи расходуют общий лимит тарифа.

Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах
16 сентября 2026 г.
Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах

Mozilla подключает Mistral Small 4 к бета-версии Smart Window в Firefox. Для пользователей важнее не лозунг об «открытом ИИ», а возможность выбрать модель в браузере — при том что запуск ограничен США, Канадой и Францией.

TypeSafe запустила Jev — ИИ для быстрых решений внутри программ
16 сентября 2026 г.
TypeSafe запустила Jev — ИИ для быстрых решений внутри программ

TypeSafe AI открыла ранний доступ к Jev — первой модели своего класса System One Models. Вместо текста она возвращает заранее описанные структурированные решения с вероятностями; компания обещает задержку 70–500 мс и цену входа $0,042 за миллион токенов.