Назад
6 октября 2026 г. в 08:00 LLM Open Source AI Agents Developer Tools Reflection Источник

Reflection показала Beam на 501 млрд параметров — но веса выйдут позже

Reflection показала Beam на 501 млрд параметров — но веса выйдут позже

Новая «открытая» модель не всегда означает, что её уже можно скачать. Reflection представила Beam — MoE-модель для кода, рассуждений и агентных задач — с 501 млрд общих параметров, из которых в каждом вычислении активны 23 млрд. Но в день анонса доступ ограничен ранней программой: компания собирает заявки, а веса, технический отчёт и model card обещает выпустить позже в октябре.

Большая модель с меньшим числом активных параметров

Beam использует архитектуру mixture-of-experts: вместо расчёта всей сети для каждого токена маршрутизатор выбирает часть «экспертов». Именно поэтому число общих параметров само по себе не описывает стоимость запуска. Reflection утверждает, что на сложных задачах рассуждений Beam сопоставима с GLM-5.2, но требует в 3–4 раза меньше вычислений на инференсе. Это заявление разработчика, а не независимый тест, поэтому его стоит читать как ориентир до появления весов и воспроизводимых замеров.

Официальный график Reflection: масштабирование предобучения Beam по вычислениям и качеству на тестовых данных

График: Reflection.

В опубликованной таблице компания приводит, например, 80,9 на SWE-bench Verified и 80,1 на Terminal-Bench v2.1. Такие бенчмарки полезны для сравнения направлений, но не заменяют проверку на собственном репозитории, стеке инструментов и лимитах по времени.

Ставка на код и агентов

По описанию Reflection, Beam обучали для программирования, вызова инструментов и длинных агентных траекторий. Компания сообщает о предобучении на 23,8 трлн токенов и четырёхнедельном RL-запуске на 10,5 тыс. NVIDIA GB300. Для разработчика важнее другой факт: пока нельзя проверить, как эти заявления переживут реальный self-hosting, ограничения памяти и интеграцию с привычными harness’ами.

Reflection обещает выпустить веса под Apache 2.0, документацию и инструменты для запуска, оценки и fine-tuning. До этого Beam — не готовая замена локальной модели, а интересный кандидат в очереди на тестирование. Когда артефакты появятся, первые практические вопросы будут не о 501 млрд параметров, а о требованиях к железу, скорости на конкретных задачах и том, сохраняется ли заявленная экономия вне лаборатории.

Ещё новости

Mistral Large 4: API уже доступен, веса — в конце октября
6 октября 2026 г.
Mistral Large 4: API уже доступен, веса — в конце октября

Mistral открыла public preview Mistral Large 4 — мультимодальной модели с 1 трлн параметров, из которых активно 49 млрд. В API её уже можно попробовать, но обещанные open weights появятся лишь в конце октября.

OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС
6 октября 2026 г.
OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС

OpenAI сообщила, что будет добавлять невидимую маркировку в тексты ChatGPT и Codex для пользователей из ЕС. Метка должна помочь выполнять требования AI Act, но компания признаёт: после существенной правки текста её будет труднее обнаружить.

GitHub открыла API для запуска проверок кода Copilot
5 октября 2026 г.
GitHub открыла API для запуска проверок кода Copilot

GitHub разрешила запускать проверку pull request’ов Copilot через REST и GraphQL API. Одновременно для новых и уже существующих репозиториев стандартным уровнем тщательности стал Balanced.

AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком
5 октября 2026 г.
AWS показала Well-Architected Agent: ИИ-ревизор для облака, но с правами и проверкой человеком

AWS открыла предварительный доступ к Well-Architected Agent — сервису, который анализирует инфраструктуру и предлагает исправления для стоимости, производительности, устойчивости и безопасности. Рекомендации могут включать изменения IaC, но AWS отдельно предупреждает: генеративный ИИ способен ошибаться.

Google урезает доступ к Gemini: бесплатным оставят Flash-Lite
4 октября 2026 г.
Google урезает доступ к Gemini: бесплатным оставят Flash-Lite

Google меняет набор моделей Gemini для бесплатных пользователей и подписки AI Plus. С 9 октября доступ к Pro исчезнет у обоих уровней, а платный AI Pro получит Deep Think.

Руководитель по безопасности OpenAI ушёл, назвав культуру компании сломанной
4 октября 2026 г.
Руководитель по безопасности OpenAI ушёл, назвав культуру компании сломанной

Дэвид Робинсон, руководивший подготовкой отчётов по безопасности к релизам OpenAI, покинул компанию. В эссе он заявил, что темп запусков не оставляет ей достаточной осторожности; OpenAI ответила, что продолжает усиливать практики безопасности и при необходимости замедляет обучение или выпуск моделей.

PFNYC: в Нью-Йорке сжимаются стартовые вакансии в профессиях, уязвимых для ИИ
4 октября 2026 г.
PFNYC: в Нью-Йорке сжимаются стартовые вакансии в профессиях, уязвимых для ИИ

В Нью-Йорке с 2022 года заметно сократилось число стартовых вакансий в нескольких офисных профессиях с высокой подверженностью ИИ, сообщает Partnership for New York City. Данные PFNYC и отдельная работа Stanford фиксируют совпадающие ранние паттерны, но не доказывают, что их причиной стал именно ИИ.

Фишинг под видом обсуждения ИИ-политики: как TA419 охотилась за доступом к Microsoft 365
4 октября 2026 г.
Фишинг под видом обсуждения ИИ-политики: как TA419 охотилась за доступом к Microsoft 365

Proofpoint описала кампанию TA419 против экспертов по ИИ-политике: злоумышленники начинали с правдоподобного письма, а после ответа вели жертву на поддельную страницу входа Microsoft.

GitHub Copilot получил доступ к настольным приложениям
4 октября 2026 г.
GitHub Copilot получил доступ к настольным приложениям

GitHub открыл preview режима Computer Use для Copilot CLI и приложения Copilot на macOS и Windows. Агент может работать с графическим интерфейсом, но перед управлением программой обязан запросить подтверждение.

За ИИ платят лишь 2,2% домохозяйств США — но чек растёт
3 октября 2026 г.
За ИИ платят лишь 2,2% домохозяйств США — но чек растёт

В отчёте a16z State of Markets II доля американских домохозяйств с платной AI-подпиской достигла 2,2% к весне 2026 года. Это не оценка всего рынка ИИ и не число пользователей: график фиксирует только оплачиваемые подписки домохозяйств, зато показывает одновременно рост проникновения и среднего ежемесячного чека.

NVIDIA выпустит DGX Spark с 64 ГБ памяти за $4 999
3 октября 2026 г.
NVIDIA выпустит DGX Spark с 64 ГБ памяти за $4 999

NVIDIA добавляет более доступную версию DGX Spark с 64 ГБ объединённой памяти. Один компьютер рассчитан на локальные модели до 100 млрд параметров, а пара устройств может объединять память до 128 ГБ.

Meta открыла SDK для устройств Muse: агент можно подключить к ESP32 и Raspberry Pi
3 октября 2026 г.
Meta открыла SDK для устройств Muse: агент можно подключить к ESP32 и Raspberry Pi

Meta опубликовала открытые SDK и прошивки для самодельных устройств, подключаемых к персональному агенту Muse. Практический смысл — вывести агента из приложения на кнопки, дисплеи, датчики и домашние сценарии, но для сопряжения всё равно нужен токен и режим разработчика.