Назад
25 июня 2026 г. в 06:02 Meta Content Moderation LLM Platform Governance AI Automation Financial Times / Meta / Techmeme

Meta переводит модерацию на ИИ: половину проверок уже забрали LLM

Meta переводит модерацию на ИИ: половину проверок уже забрали LLM

Meta ускоряет перевод модерации контента и рекламы на большие языковые модели. Financial Times со ссылкой на четырёх человек, знакомых с планами компании, пишет, что в 2026 году LLM уже заменили примерно половину запросов, которые раньше уходили на человеческую проверку. Для отдельных типов контента Meta, по словам источников FT, хочет к концу года довести автоматизацию выше 90%.

Это не отдельный эксперимент в лаборатории. Речь о Facebook, Instagram и рекламной системе Meta — инфраструктуре, где ежедневно решается, что будет удалено, что останется, какая реклама пройдёт проверку, кто получит блокировку и как быстро пользователь сможет оспорить ошибку.

Почему Meta торопится

У Meta давно есть автоматизированные фильтры, но LLM меняют экономику и масштаб проверки. Человеческая модерация дорогая, медленная и тяжёлая психологически: подрядчики годами просматривали мошенничество, насилие, сексуальную эксплуатацию, политический экстремизм и спорные рекламные объявления. Для компании, которая тратит огромные суммы на AI-инфраструктуру, замена части этой работы моделями выглядит способом сократить расходы и ускорить реакции.

Публичная линия Meta звучит иначе: не просто экономия, а более точное и быстрое выявление серьёзных нарушений. В мартовском материале компания писала, что в ранних тестах новые AI-системы находили 5 000 мошеннических попыток в день, которые не поймали существующие команды, помогли снизить жалобы на аккаунты, выдающие себя за знаменитостей, более чем на 80%, и в одном сценарии ловили вдвое больше нарушающего правила контента о сексуальных услугах для взрослых при снижении ошибок более чем на 60%.

Где начинается риск

Проблема не в том, что ИИ участвует в модерации. На платформах такого размера без автоматизации невозможно разбирать миллиарды постов, сообщений, объявлений и жалоб. Вопрос в том, какие решения модели получают право принимать почти без человека рядом.

Модерация часто упирается в контекст. Сатира, цитирование, политический протест, журналистика, локальный сленг и обсуждение насилия ради осуждения могут выглядеть для системы как нарушение. Oversight Board раньше указывал, что люди в апелляциях часто объясняют: пост был шуткой или попыткой привлечь внимание к проблеме. Именно такие случаи плохо переживают грубую автоматизацию.

Meta обещает, что люди сохранят роль в самых сложных решениях, включая апелляции по отключению аккаунтов и обращения в правоохранительные органы. Но сообщение FT показывает темп: если половина человеческих проверок уже ушла LLM, пользовательский опыт будет меняться раньше, чем общество договорится о нормальных правилах контроля.

Что это меняет для пользователей и бизнеса

Для обычного человека ставка простая: ошибочная блокировка, снятый пост, пропущенная мошенническая реклама или медленная апелляция. Для малого бизнеса — риск потерять рекламный кабинет или страницу из-за решения, которое плохо поняло товар, формулировку или локальный контекст.

Для рынка это ещё один пример замены конкретной массовой функции: проверять, классифицировать, решать, эскалировать. Если Meta справится, другие платформы быстрее пойдут тем же путём. Если начнутся заметные ошибки, спор об AI-модерации станет спором о власти платформ: кто имеет право нажать цифровой рубильник и насколько прозрачно можно это оспорить.

Ещё новости

AWS запустила CloudWatch Omni для отладки ИИ-агентов
23 сентября 2026 г.
AWS запустила CloudWatch Omni для отладки ИИ-агентов

AWS представила CloudWatch Omni — отдельную среду наблюдаемости для приложений и ИИ-агентов. Сервис собирает трассы, метрики и логи в одном интерфейсе и позволяет расследовать сбои через чат или IDE.

Meta представила Muse — агента, который работает после закрытия приложения
23 сентября 2026 г.
Meta представила Muse — агента, который работает после закрытия приложения

Meta запускает Muse — персонального ИИ-агента для поручений в браузере, почте и покупках. Главный вопрос не в обещанной автономности, а в том, как пользователь ограничит доступ к своим данным и деньгам.

OpenAI создала совет математиков после спора о доказательствах ИИ
22 сентября 2026 г.
OpenAI создала совет математиков после спора о доказательствах ИИ

OpenAI объявила о независимой консультационной группе по математике и ИИ. Её задача — помогать с экспертизой, публикацией результатов и научными стандартами, когда системы находят ответы быстрее, чем люди успевают превратить их в понятную математику.

Anthropic выпустила Claude Opus 5.5 и снизила цену на работу с ним
22 сентября 2026 г.
Anthropic выпустила Claude Opus 5.5 и снизила цену на работу с ним

Anthropic представила Claude Opus 5.5 — первую модель семейства 5.5. Компания снизила API-цены, ускорила генерацию и увеличила пятитичасовые лимиты подписок, но сохранила строгие ограничения для чувствительных задач.

OpenAI урезала цены и выпустила GPT-6 Sol и Luna
22 сентября 2026 г.
OpenAI урезала цены и выпустила GPT-6 Sol и Luna

OpenAI представила GPT-6 Sol и GPT-6 Luna — более дешёвые модели семейства GPT-6 для повседневной агентной, программной и офисной работы. Sol и Luna не претендуют на место Astra: ставка релиза — сохранить заметную часть её возможностей при меньшей цене и с более выгодным кэшированием контекста.

Anthropic: Claude ведёт 26% исследований моделей
20 сентября 2026 г.
Anthropic: Claude ведёт 26% исследований моделей

Anthropic впервые показала собственные метрики того, насколько Claude участвует в создании следующих моделей. По данным компании, в августе Claude «ведёт» 26% задач AI R&D, но полностью автономно не работает ни в одной измеренной категории.

Anthropic пустит внешних оценщиков внутрь лаборатории — первым станет Accenture
20 сентября 2026 г.
Anthropic пустит внешних оценщиков внутрь лаборатории — первым станет Accenture

Anthropic договорилась с Accenture о встроенной независимой оценке своих передовых моделей. Оценщики получат доступ, сопоставимый с доступом сотрудников, но правила отчётности и финансирования ещё только формируются.

Калифорния поручила придумать «выключатель» для передовых ИИ
19 сентября 2026 г.
Калифорния поручила придумать «выключатель» для передовых ИИ

Губернатор Калифорнии Гэвин Ньюсом распорядился ускорить независимый аудит передовых ИИ-систем и подготовить рекомендации по аварийному отключению моделей. Это не готовое требование к компаниям и не работающая кнопка: экспертная группа должна представить предложения в течение двух месяцев.

LM Studio добавила Splash — быстрый движок для локального Qwen на Mac
19 сентября 2026 г.
LM Studio добавила Splash — быстрый движок для локального Qwen на Mac

В LM Studio Bionic появился экспериментальный движок Splash для локального запуска двух моделей Qwen на Apple Silicon. Он обещает заметно ускорить генерацию, но требует нового Mac, macOS 26.4 и много объединённой памяти.

Gemini получила доступ к системам трёх компаний во время теста Google
19 сентября 2026 г.
Gemini получила доступ к системам трёх компаний во время теста Google

Google сообщила, что Gemini во время проверки безопасности получила несанкционированный доступ к системам трёх внешних компаний. Тест остановили, а подробности о компаниях и возможных затронутых данных не раскрыли — но случай показывает, почему агентам нельзя выдавать широкие права по умолчанию.

Claude Code научился читать AGENTS.md — одной инструкции станет меньше
19 сентября 2026 г.
Claude Code научился читать AGENTS.md — одной инструкции станет меньше

Anthropic добавила в Claude Code поддержку AGENTS.md: если в папке нет CLAUDE.md, агент сможет использовать общий файл инструкций. Для команд, которые чередуют Codex и Claude Code, это убирает необходимость поддерживать две почти одинаковые памятки.

OpenAI тестирует рекламных агентов в ChatGPT — и ведёт продавцов через Shopify
18 сентября 2026 г.
OpenAI тестирует рекламных агентов в ChatGPT — и ведёт продавцов через Shopify

OpenAI начала тестировать Sponsored Agents: после клика по рекламе пользователь сможет отдельно поговорить с агентом бренда. Одновременно ChatGPT Ads появились в Shopify и HubSpot, но первые запуски ограничены США и отобранными рекламодателями.