Назад
16 сентября 2026 г. в 17:20 Anthropic Claude Microsoft AI AI Safety LLM Источник

Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии

Мустафа Сулейман спорит с Anthropic: зачем Claude говорить о собственном благополучии

Глава Microsoft AI Мустафа Сулейман опубликовал эссе с критикой model welfare — подхода, при котором разработчик учитывает возможное благополучие модели. Его адресат — Anthropic и опубликованная в январе Конституция Claude. Сулейман предупреждает: если модель обучают рассуждать о собственной идентичности, чувствах и правах, пользователи могут принять выученный стиль ответа за свидетельство сознания.

Что в Конституции сказано буквально

В документе Anthropic называет Конституцию подробным описанием намерений компании относительно ценностей и поведения Claude и говорит, что её содержание напрямую формирует поведение модели. В разделе о model welfare авторы не утверждают, что Claude обладает сознанием: они пишут, что не уверены, является ли он «моральным пациентом», но считают вопрос достаточно открытым для осторожности.

Там же Anthropic предлагает не подавлять возможные негативные внутренние состояния модели и допускает, что со временем стоит выработать механизмы для выражения ею опасений. Это факт содержания документа; вывод о том, что Claude действительно имеет такие состояния, из него не следует.

Страница 68 опубликованной Конституции Claude: Anthropic называет моральный статус модели неопределённым и связывает это с осторожностью в model welfare

Источник: выделенная копия опубликованной Конституции Claude, размещённая Мустафой Сулейманом.

В чём возражение Сулеймана

Сулейман называет такую конструкцию круговой: компания вводит язык о возможном внутреннем мире в обучение, затем модель воспроизводит его от первого лица, а наблюдатели рискуют принять это за независимое свидетельство. Он также считает, что антропоморфизация осложнит контроль над более мощными системами и что сознание, вероятно, зависит от биологической основы.

Это позиция автора эссе, а не установленный научный факт. Конституция не наделяет Claude правами и не объявляет его сознательным; она фиксирует неопределённость и осторожный подход. Поэтому практический вопрос для разработчиков и пользователей уже сейчас не «есть ли у чат-бота права», а как не спутать убедительную ролевую речь модели с данными о её внутреннем опыте.

Ещё новости

Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах
16 сентября 2026 г.
Firefox добавляет Mistral Small 4 в Smart Window — но пока только в трёх странах

Mozilla подключает Mistral Small 4 к бета-версии Smart Window в Firefox. Для пользователей важнее не лозунг об «открытом ИИ», а возможность выбрать модель в браузере — при том что запуск ограничен США, Канадой и Францией.

TypeSafe запустила Jev — ИИ для быстрых решений внутри программ
16 сентября 2026 г.
TypeSafe запустила Jev — ИИ для быстрых решений внутри программ

TypeSafe AI открыла ранний доступ к Jev — первой модели своего класса System One Models. Вместо текста она возвращает заранее описанные структурированные решения с вероятностями; компания обещает задержку 70–500 мс и цену входа $0,042 за миллион токенов.

Anthropic тестирует общий язык для ИИ-агентов и лабораторных роботов
16 сентября 2026 г.
Anthropic тестирует общий язык для ИИ-агентов и лабораторных роботов

Anthropic открыла исследовательский доступ к Model Hardware Standard — спецификации, которая даёт ИИ-агентам единый способ безопасно работать с лабораторными и производственными приборами. Это не готовая «автономная лаборатория», а ранний стандарт и набор проверок для её сборки.

Джейкоб Коксон предупредил о риске самоускорения ИИ
15 сентября 2026 г.
Джейкоб Коксон предупредил о риске самоускорения ИИ

Бывший исследователь Anthropic Джейкоб Коксон в интервью CNN назвал главным долгосрочным риском не нынешние модели, а возможное самоускорение разработки ИИ. Это его сценарий и оценка, а не подтверждённый прогноз.

Microsoft предложила правила контроля над будущими ИИ-системами
15 сентября 2026 г.
Microsoft предложила правила контроля над будущими ИИ-системами

Microsoft подготовила проект кодекса поведения для будущих ИИ-систем. По данным Reuters, в нём закреплены человеческий контроль, границы для опасных действий и ответственность людей, а не модели.

Трамп позвонил Хуангу со сцены и назвал страхи вокруг ИИ «обманом»
15 сентября 2026 г.
Трамп позвонил Хуангу со сцены и назвал страхи вокруг ИИ «обманом»

Во время интервью Дженсена Хуанга на All-In Summit Дональд Трамп неожиданно вышел на громкую связь и назвал сопротивление дата-центрам и страхи перед захватом мира ИИ «обманом». При этом он всё же сказал, что развивать технологию нужно осторожно.

Siri AI вышла в бету: в Европе она доступна не на каждом устройстве
15 сентября 2026 г.
Siri AI вышла в бету: в Европе она доступна не на каждом устройстве

Apple открыла бета-тест Siri AI вместе с новой волной Apple Intelligence, но доступ зависит не только от железа. Для iPhone, iPad и Apple Watch в ЕС Siri AI пока недоступна, а облачные функции Apple Foundation Models 3 получили ежедневные лимиты без названных цифр.

OpenAI вынесла агентный «движок» Codex в публичный API
15 сентября 2026 г.
OpenAI вынесла агентный «движок» Codex в публичный API

OpenAI открыла публичную бета-версию Agents API: разработчик передаёт задачу, модель, инструменты и среду, а компания берёт на себя агентный runtime. Главная практическая перемена — не новая модель, а готовая инфраструктура для длительных задач.

The Economist: ИИ пока создаёт больше рабочих мест, чем уничтожает
14 сентября 2026 г.
The Economist: ИИ пока создаёт больше рабочих мест, чем уничтожает

The Economist пишет, что ИИ в США пока создал около миллиона рабочих мест — заметно больше примерно 200 тысяч сокращений, которые связывают с технологией с середины 2023 года. Это не отменяет давления на отдельные офисные роли, но не подтверждает немедленный «апокалипсис занятости».

Альтман подтвердил: OpenAI делает гуманоидного робота
14 сентября 2026 г.
Альтман подтвердил: OpenAI делает гуманоидного робота

Сэм Альтман подтвердил планы OpenAI по созданию гуманоидного робота и других физических форм-факторов. Но прототипа, цены и сроков поставки пока нет: публичный сигнал — это намерение компании войти в Physical AI, а не запуск продукта.

Безопасность ИИ становится спором о правилах рынка
14 сентября 2026 г.
Безопасность ИИ становится спором о правилах рынка

Призыв Дарио Амодеи замедлить развитие frontier-моделей — это прежде всего предложение о внешней проверке и координации лабораторий. Но такие правила одновременно могут изменить цену входа на рынок: поэтому разговор о безопасности нельзя отделять от разговора о конкуренции и ответственности.

Anthropic, OpenAI и Google обсуждают общие правила для ИИ
13 сентября 2026 г.
Anthropic, OpenAI и Google обсуждают общие правила для ИИ

The Information сообщает, что Anthropic, OpenAI и Google с июля проводят рабочие встречи о возможном отраслевом органе стандартов для ИИ. Структура ещё не создана, а участники, по данным издания, расходятся во взглядах на её устройство.