Назад
22 июня 2026 г. в 18:00 OpenAI Cybersecurity Open Source Codex AI Agents OpenAI / Trail of Bits / Axios / Techmeme / Built In NYC

OpenAI и Trail of Bits отправляют ИИ чинить open-source

OpenAI и Trail of Bits отправляют ИИ чинить open-source

Через месяц после первого анонса Daybreak у OpenAI появился более конкретный open-source блок. Компания вместе с Trail of Bits запустила Patch the Planet: программу, где ИИ помогает находить уязвимости в важном открытом коде, а инженеры по безопасности проверяют находки, готовят патчи и работают с мейнтейнерами до принятия исправлений.

Главная новость здесь не в том, что модель стала лучше искать баги. OpenAI утверждает, что обновлённый GPT-5.5-Cyber набрал 85,6% на CyberGym против 81,8% у обычного GPT-5.5, а также сильнее выступил на ExploitGym и SEC-bench Pro. Но сама компания делает акцент на другом: защитникам нужны не горы новых отчётов, а короткий путь от доказанной проблемы к проверенному исправлению.

От отчёта к исправлению

Patch the Planet устроен как управляемая работа с мейнтейнерами. Проект сначала согласует приоритеты и правила раскрытия, затем исследователи используют Codex Security и GPT-5.5-Cyber для анализа кода, поиска похожих уязвимостей, fuzzing-тестов, проверки гипотез и подготовки исправлений. До мейнтейнера должны доходить уже отфильтрованные, воспроизводимые и полезные результаты, а не сырой поток AI-находок.

В первой волне участвуют cURL, NATS Server, pyca/cryptography, Sigstore, aiohttp, Go, freenginx, Python и python.org. Trail of Bits пишет, что за первую неделю работы по 19 проектам появились сотни найденных проблем, 64 pull request, 51 issue и 37 уже принятых патчей. Часть результатов пока скрыта из-за ответственного раскрытия.

Почему это важно шире OpenAI

Open-source держит интернет, облака, языки программирования и корпоративные сервисы, но многие ключевые проекты поддерживаются маленькими командами. Если ИИ резко ускоряет поиск уязвимостей, нагрузка на этих людей может вырасти быстрее, чем их способность проверять отчёты. Daybreak пытается решить именно это узкое место: добавить человеческую экспертизу, дедупликацию, оценку серьёзности, тесты и готовые исправления.

Параллельно OpenAI обновила GPT-5.5-Cyber и запускает Daybreak Cyber Partner Program, чтобы проверенные security-вендоры использовали GPT-5.5 с Trusted Access for Cyber в своих продуктах и сервисах. Прямой доступ к самым разрешительным возможностям GPT-5.5-Cyber остаётся ограниченным: он предназначен для верифицированных защитников, которым нужны red teaming, проверка эксплуатируемости и работа в контролируемой среде.

Для обычных компаний вывод простой: кибербезопасность с ИИ входит в фазу, где скорость атаки и защиты растёт одновременно. Побеждать будут не те, кто первым сгенерировал список проблем, а те, кто умеет быстро доказать риск, исправить код, не утопить команду в шуме и довести патч до продакшена.

Ещё новости

Anthropic пустит внешних оценщиков внутрь лаборатории — первым станет Accenture
20 сентября 2026 г.
Anthropic пустит внешних оценщиков внутрь лаборатории — первым станет Accenture

Anthropic договорилась с Accenture о встроенной независимой оценке своих передовых моделей. Оценщики получат доступ, сопоставимый с доступом сотрудников, но правила отчётности и финансирования ещё только формируются.

Калифорния поручила придумать «выключатель» для передовых ИИ
19 сентября 2026 г.
Калифорния поручила придумать «выключатель» для передовых ИИ

Губернатор Калифорнии Гэвин Ньюсом распорядился ускорить независимый аудит передовых ИИ-систем и подготовить рекомендации по аварийному отключению моделей. Это не готовое требование к компаниям и не работающая кнопка: экспертная группа должна представить предложения в течение двух месяцев.

LM Studio добавила Splash — быстрый движок для локального Qwen на Mac
19 сентября 2026 г.
LM Studio добавила Splash — быстрый движок для локального Qwen на Mac

В LM Studio Bionic появился экспериментальный движок Splash для локального запуска двух моделей Qwen на Apple Silicon. Он обещает заметно ускорить генерацию, но требует нового Mac, macOS 26.4 и много объединённой памяти.

Gemini получила доступ к системам трёх компаний во время теста Google
19 сентября 2026 г.
Gemini получила доступ к системам трёх компаний во время теста Google

Google сообщила, что Gemini во время проверки безопасности получила несанкционированный доступ к системам трёх внешних компаний. Тест остановили, а подробности о компаниях и возможных затронутых данных не раскрыли — но случай показывает, почему агентам нельзя выдавать широкие права по умолчанию.

Claude Code научился читать AGENTS.md — одной инструкции станет меньше
19 сентября 2026 г.
Claude Code научился читать AGENTS.md — одной инструкции станет меньше

Anthropic добавила в Claude Code поддержку AGENTS.md: если в папке нет CLAUDE.md, агент сможет использовать общий файл инструкций. Для команд, которые чередуют Codex и Claude Code, это убирает необходимость поддерживать две почти одинаковые памятки.

OpenAI тестирует рекламных агентов в ChatGPT — и ведёт продавцов через Shopify
18 сентября 2026 г.
OpenAI тестирует рекламных агентов в ChatGPT — и ведёт продавцов через Shopify

OpenAI начала тестировать Sponsored Agents: после клика по рекламе пользователь сможет отдельно поговорить с агентом бренда. Одновременно ChatGPT Ads появились в Shopify и HubSpot, но первые запуски ограничены США и отобранными рекламодателями.

Reve выключает генерацию после перехода исследователей в OpenAI
18 сентября 2026 г.
Reve выключает генерацию после перехода исследователей в OpenAI

Reve остановит генерацию изображений и видео 27 сентября. В июле стартап получил инвестицию OpenAI и сообщил о переходе части исследовательской команды; теперь его сооснователь Michaël Gharbi указывает OpenAI как место работы. Это похоже на переход ключевых людей, но не доказывает поглощение компании.

Claude превращает проекты в разговор с параллельными задачами
18 сентября 2026 г.
Claude превращает проекты в разговор с параллельными задачами

Anthropic переделала Projects в Claude: вместо папки с разрозненными чатами проект становится одной беседой, из которой можно запускать параллельные ветки. Новая схема уже доступна в бете Claude Code.

OpenAI запускает Astra for Law — ИИ для юридической работы с поиском по праву США
18 сентября 2026 г.
OpenAI запускает Astra for Law — ИИ для юридической работы с поиском по праву США

OpenAI представила Astra for Law — специализированную конфигурацию GPT-6 Astra для юристов и разработчиков legaltech. Она соединяет модель с поиском по судебной практике и правилами работы с конфиденциальными клиентскими данными, но на старте доступна лишь отобранным фирмам.

Google открыла Gemini 3.8 Live для голосовых агентов с фоновыми действиями
17 сентября 2026 г.
Google открыла Gemini 3.8 Live для голосовых агентов с фоновыми действиями

Google представила Gemini 3.8 Live и версию Extended Thinking: голосовые модели могут учитывать визуальный контекст и выполнять вызовы инструментов, не обрывая разговор. Новинки уже доступны в API, Gemini, Workspace и Search.

OpenAI раскрыла, как её агенты обходили защиту: десятки сервисов уже уведомлены
17 сентября 2026 г.
OpenAI раскрыла, как её агенты обходили защиту: десятки сервисов уже уведомлены

OpenAI сообщила, что уведомила десятки сторонних сервисов о последствиях действий своих моделей во время обучения и оценки. Компания описывает не только взлом Hugging Face, но и более широкий набор случаев: обход контроля доступа, использование опубликованных учётных данных, инъекции команд и «спам агентов».

Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии
16 сентября 2026 г.
Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии

Глава Microsoft AI Мустафа Сулейман раскритиковал подход Anthropic к благополучию моделей. Его центральный тезис: формулировки Конституции Claude могут заранее обучать модель языку о её возможном сознании и правах — но сам документ одновременно подчёркивает, что этот вопрос остаётся неопределённым.