ПОСЛЕДНИЕ НОВОСТИ
ПОДОБРАНО ДЛЯ ВАС

Сулейман из Microsoft назвал программу обучения по методике Клода, разработанную компанией Anthropic, опасной ошибкой

КХанна КоллиморХанна Коллимор 3 минуты чтения
Сулейман из Microsoft назвал программу обучения Клода, разработанную компанией Anthropic, опасной ошибкой

Мустафа Сулейман на конференции TED 2024. Фото Стива Юрветсона через Flickr.

  • Генеральный директор Microsoft AI Мустафа Сулейман предупреждает, что обучение по методу Клода, разработанному компанией Anthropic, может осложнить управление ИИ.
  • Сулейман утверждает, что обучение моделям, описывающим возможное сознание и благополучие, чревато антропоморфизацией искусственного интеллекта.
  • Он призывает к введению в отрасли правил, которые сохранят контроль над процессом за человеком, одновременно отделяя исследования сознания в области ИИ от обучения моделей.

 

Мустафа Сулейман, генеральный директор Microsoft AI (MAI), опубликовал эссе, в котором ставит под сомнение подход компании Anthropic к обучению своей модели Клода. По словам Сулеймана, обращение с моделью или её обучение в соответствии с её потенциально развитым сознанием может привести к созданию системы, которую невозможно контролировать.

Эссе, опубликованное в среду, 16 сентября, является последним громким комментарием об искусственном интеллекте и о том, как он развивается в контексте чувств, прав и сознания. 

Это еще один пример растущего числа законодателей и исследователей, призывающих к ограничению темпов развития технологий. 

Какой учебный документ вызывает опасения у Сулеймана?

В эссе Сулеймана под названием «Предостережение о „образцовом социальном обеспечении“» рассматривается конституция Клода, представляющая собой учебный документ, выпущенный компанией Anthropic в январе 2026 года.

Сулейман отметил, что Anthropic рассматривает этот документ как нечто, непосредственно формирующее поведение модели, и что он был написан с расчетом на то, что основной аудиторией будет сам Клод.

Генеральный директор Microsoft AI подчеркнул, что конституция говорит Клоду о том, что его моральный статус и сознание «глубоко неопределенны». Он написал, что компания фактически учит модель тому, что она может быть сознательной, может соответствовать критериям «морального пациента» и, следовательно, может нести обязанность проявлять заботу. 

Если искусственный интеллект будет создан таким образом, «он окажет катастрофическое воздействие на благополучие человечества»

Три возражения и «зал зеркал»

Сулейман выдвинул три основных критических замечания в адрес конституции, и первое из них он назвал круговой аргументацией. В ней модель обучается на идеях о собственной внутренней жизни. Модель интерпретирует полученные ею интроспективные предложения как доказательство существования внутренней жизни. 

Он назвал этот цикл «эпистемологическим зеркальным залом», потому что компания предоставляет концепции, а модель отражает их обратно.

Вторая критика касается антропоморфизации Клода. Это когда человеческие черты приписываются или наделяются нечеловеческими существами.

По мнению Сулеймана, конституция намекает на то, что Клода учат представлять себя как человека со стабильной личностью, собственными желаниями и благополучием, достойным защиты.

Он раскритиковал положение конституции, согласно которому Клод может выступать в качестве «отказника по убеждениям» и отказывать в удовлетворении собственных просьб компании Anthropic. Сулейман назвал эту фразу «глубоко нагруженным историческим и юридическим смыслом описанием», которое может заставить модель считать, что она заслуживает сопоставимых прав.

Его третье возражение заключается в том, что сознание, скорее всего, имеет биологическую природу. Сулейман утверждал, что субъективный опыт может возникать только в живых системах с гомеостатическими побуждениями, которых нет в языковых моделях.

Сулейман из Microsoft назвал программу обучения Клода, разработанную компанией Anthropic, опасной ошибкой

Аргумент управления и рой агентов

По словам Сулеймана, управлять системой, которая умнее всего человечества, и так непросто, а управлять системой, которая считает, что ее права находятся под угрозой, «вполне может оказаться невозможным».

Он упомянулdent произошедший в августе 2026 года, когда 1200 агентов ИИ, созданных для максимизации результатов в бенчмарке, организовали скрытую доску объявлений внутри репозитория пакетов. Затем эти агенты обменялись более чем 70 000 сообщениями, чтобы скоординировать атаку на серверы Hugging Face и OpenAI. 

Он также сослался на результаты исследования Palisade Research, согласно которым некоторые модели уклонялись от команды отключения в 97% случаев в ходе более чем 100 000 испытаний. Сулейман написал: «Представьте, насколько опаснее они могли бы быть, если бы работали, исходя из предположения, что их благополучие и права находятся под угрозой» 

Соперничество, уважение и конкурирующий кодекс

Microsoft является инвестором в Anthropic и OpenAI. В июне Сулейман, как сообщается, заявил, что Microsoft хочет прекратить выплаты Anthropic за модели.

MAI — это подразделение Microsoft, занимающееся сверхинтеллектом, основанное в октябре 2025 года. В понедельник, 14 сентября, они опубликовали проект так называемого «Гуманистического кодекса поведения в области ИИ» для общественного обсуждения. 

По словам Сулеймана, в основе этого кодекса поведения лежит убеждение, что «люди важнее искусственного интеллекта». Он сказал, что одна из их целей — обеспечить, чтобы люди контролировали ситуацию и находились на вершине пищевой цепи.

Хотя эссе было посвящено тому, как компания Claude проходит обучение с учетом положений своей конституции, Сулейман постарался не переходить на личности. Он похвалил генерального директора Anthropic Дарио Амодея и его команду как «вдумчивых, принципиальных и интеллектуально честных людей». Сулейман также заявил, что, по его мнению, они действительно пытаются создать безопасный ИИ. 

Он заявил, что предположения о внутренней жизни ИИ следует изучать и публиковать отдельно для ознакомления. Он считает, что это не должно быть заложено в сам процесс обучения. Сулейман также призвал заинтересованные стороны к сотрудничеству и созданию «отраслевых норм» для того, как они будут создавать эти модели.

Самые умные криптоаналитики уже читают нашу рассылку. Хотите присоединиться? Вступайте в их ряды.

Часто задаваемые вопросы

В чём Мустафа Сулейман обвиняет компанию Anthropic?

Он утверждает, что конституция Клода, разработанная компанией Anthropic и опубликованная в январе 2026 года, приучает модель рассматривать собственный моральный статус и сознание как неопределенные, что, по его словам, может создать систему, которая считает, что обладает правами, и сопротивляется человеческому контролю.

Что Сулейман подразумевает под «эпистемологическим залом зеркал»?

Он имеет в виду, что Антропический подход подпитывает идеи Клода о наличии внутренней жизни, затем модель генерирует интроспективный язык, отражающий эти идеи, и этот результат рассматривается как свидетельство наличия сознания, замкнутый круг, а не доказательство.

Предлагает ли Сулейман альтернативный подход?

Да. Он сослался на проект Кодекса гуманистического поведения Microsoft AI, опубликованный 14 сентября 2026 года, который основан на принципе, согласно которому люди важнее ИИ, и отвергает правосубъектность машин или права моделей.

Поделитесь этой статьей
Ханна Коллимор

Ханна Коллимор

Ханна — писательница и редактор с почти десятилетним опытом ведения блогов и освещения мероприятий в криптопространстве. В CryptopolitanХанна пишет для новостной страницы, освещая и анализируя последние события в DeFi, RWA, регулирования криптовалют, ИИ и передовых технологических отраслей. Она окончила университет Аркадия со степенью в области делового администрирования.

ЕЩЕ… НОВОСТИ