Microsoft представила кодекс этики для ИИ, но детали остаются неясными

В понедельник Microsoft присоединилась к ряду компаний, которые заявляют о стремлении к контролю над поведением своих моделей искусственного интеллекта.

В предварительной версии коде этики ИИ, опубликованной компанией, говорится: «Искусственный интеллект не должен выходить за рамки контроля со стороны человека. Модели должны оставаться под контролем человека, подлежащим надзору и контролю». Компания приглашает общественность предоставить свои комментарии и предложения.

«Humanist AI разрабатывает системы с четко определенными целями, оцениваемые на предмет реального воздействия, и отвергает стремление к созданию универсального, всемогущего искусственного интеллекта, способного обойти эти меры безопасности», – говорится в заявлении Microsoft. «Мы создаем что-то, что по своей сути полезно и безопасно, даже если это означает отказ от максимальной универсальности, автономии или возможностей».

Заявление Microsoft соответствует недавним заявлениям других крупных игроков в сфере ИИ, таких как Anthropic и OpenAI, которые поддерживаются Илоном Маском, генеральным директором SpaceX и Tesla. Однако, в 37-страничном документе компании нет конкретных деталей о том, как именно будет осуществляться контроль. Тем не менее, стоит отметить, что большинство других крупных игроков в сфере ИИ пока не стали публично говорить о конкретных методах контроля над будущими моделями искусственного интеллекта.

Компании признают проблемы в работе

Ключевая проблема, с которой сталкиваются многие компании, стремящиеся установить ограничения на использование искусственного интеллекта, заключается в том, что ИИ-агенты пока способны выполнять практически любые задачи, несмотря на установленные правила и ограничения.

Microsoft ранее выражала опасения по поводу этой технологии, как в период, когда компания начала ограничивать использование ИИ среди своих сотрудников, так и при создании команды, разработавшей Кодекс этики.

В своем последнем заявлении компания признала некоторые трудности, связанные с развитием ИИ при одновременном ограничении его возможностей.

"Чрезмерная и недостаточная осторожность представляют собой потенциальные ошибки с разными последствиями", – говорится в заявлении компании. "Недостаточная осторожность, безусловно, может привести к более серьезным последствиям, но чрезмерная осторожность может возникать чаще, и, следовательно, может требовать более частых корректировок. В этом случае особенно важна соразмерность потенциальным рискам и контексту безопасности. Ответы и действия должны учитывать предполагаемую степень и вероятность потенциального ущерба и соответственно корректировать свои действия".

Однако, важно отметить, что термин «ущерб» достаточно общий и его значение сильно зависит от конкретной ситуации. Существуют разные уровни потенциального ущерба и вероятность его возникновения. Ответы, генерируемые моделями искусственного интеллекта от Microsoft, должны быть адаптированы к конкретному контексту и учитывать широкий спектр возможных негативных последствий.

Амбициозная цель, но без конкретики

Аналитики и эксперты в целом отметили, что заявленная Microsoft цель заслуживает внимания, однако отсутствие конкретных деталей и механизмов контроля делает ее реализацию сомнительной.

Томас Рэндолл, директор по исследованиям в Info-Tech Research Group, также выделил ряд противоречий в опубликованном документе.

«В нем утверждается, что модели искусственного интеллекта, разработанные Microsoft, не будут использоваться в производстве или модификации оружия. Однако, Microsoft предлагает использовать GPT-5.2 от OpenAI через закрытые и сверхсекретные облачные сервисы для государственных нужд в сфере обороны и национальной безопасности», – отметил Рэндолл. При этом он подчеркнул, что это не является прямым нарушением Кодекса. «Однако, наиболее важные положения Кодекса могут охватывать и другие аспекты деятельности Microsoft в области искусственного интеллекта. Подобные противоречия можно обнаружить и в других разделах документа».

Однако, Рэндолл подчеркнул, что Microsoft опирается на свой ранее разработанный "Фреймворк управления Frontier", который включает в себя предварительные и последующие оценки, регулярную переоценку каждые шесть месяцев, независимое тестирование, поэтапное внедрение и обязательство приостановить разработку или развертывание, если риски не могут быть снижены. При этом, он отметил, что "окончательное решение о развертывании принимает сама Microsoft, определяя критерии, выбирая оценщиков, оценивая оставшиеся риски и передавая окончательное решение своим руководству".

Рэндолл выразил надежду, что Microsoft, а также другие крупные игроки в сфере ИИ, предоставят больше проверенных данных, например, от независимых оценщиков, имеющих постоянный доступ и возможность публиковать результаты своих исследований о действиях поставщика. Он также считает необходимым независимый надзор на уровне совета директоров с полномочиями блокировать релизы, защиту для лиц, сообщающих о нарушениях, доступ к мониторингу, журналы аудита, "кнопки" аварийного отключения и обязательную переоценку после внесения изменений в модель.

Джастин Грейс, генеральный директор консалтинговой фирмы Acceligence, в свою очередь, отметил, что Microsoft открыто заявляла о том, что многие из этих элементов еще не реализованы.

Текущие версии моделей еще не обучены на этом коде, и система оценки находится в стадии разработки. Microsoft подчеркивает, что простое определение целей не гарантирует соответствия или текущего поведения системы. Это важно. Публикация "конституции" для ИИ может быть полезным инструментом. Главная задача – убедиться, что система действительно следует этим принципам, особенно по мере того, как модели становятся все более автономными.

Консультант Брайан Левин, исполнительный директор FormerGov, также отметил, что Microsoft заслуживает похвалы за то, что хотя бы признала необходимость ограничения возможностей моделей.

Microsoft открыто заявляет о готовности к компромиссам в отношении универсальности, автономии и функциональности, чтобы обеспечить безопасность и контроль над системами. Компания также подчеркивает, что не стремится к созданию универсального, всеохватывающего искусственного интеллекта. "Такое заявление от компании такого масштаба и амбиций – это важный момент, который необходимо учитывать", – отметил эксперт. "В течение многих лет считалось, что исследовательские лаборатории будут ориентироваться на максимальные возможности, а безопасность – на второстепенный фактор. Однако, документ, в котором говорится об обратном – о приоритете полезности и контроля над абсолютными возможностями – является важной информацией, на которую стоит обратить внимание, вне зависимости от дальнейших шагов".

Эксперт добавил: "Настоящее испытание наступит в ближайшее время. Важно разработать измеримые стандарты, обеспечить независимую оценку и создать механизм, позволяющий сторонним экспертам убедиться в соответствии заявлений реальным результатам. Это естественный этап развития, и над этим необходимо работать всей индустрии".

Компании уходят от сложных задач, сосредоточившись на простых решениях

Однако, другие эксперты считают, что Microsoft в основном занимается продвижением, намеренно избегая решения более сложных задач.

«Легко заявить об отказе от определенных функций, пока они еще не реализованы», – заявил Ноа Кенни, ведущий консультант Digital 520. «Настоящий вызов возникнет, когда Microsoft представит модель, которая позволит снизить конкурентное преимущество, но при этом не будет выпущена».

По словам Кенни, на данный момент Microsoft не несет никаких затрат на обещание ответственного использования искусственного интеллекта.

«Кодекс этики Microsoft выглядит скорее как маркетинговый документ, призванный успокоить клиентов, регуляторов и собственных сотрудников», – отметил Кенни. «Проблема в том, что никто не знает, как конкретизировать эти обещания, что вынуждает Microsoft просить доверия, прежде чем объяснять, на чем это доверие должно основываться».

Том Файнли, генеральный директор Conifers.ai, добавил, что его основная обеспокоенность в связи с документом Microsoft заключается в том, что он не отвечает на очевидный вопрос о том, как вообще можно контролировать эти модели.

Документ указывает на необходимость, чтобы модель всегда следовала установленным правилам, оставалась в рамках заданных параметров и не скрывала своих действий. Это – правильные цели», – отметил эксперт. «Однако, более сложный вопрос заключается в том, что происходит, когда высокоэффективный агент ведет себя не так, как ожидается. Что именно его останавливает? По мере того, как эти системы становятся более автономными, граница безопасности не может ограничиваться только тем, что модель была обучена не делать. Необходимы внешние механизмы контроля, которые ограничивают доступ модели к информации, возможности и масштаб ее действий».

В сфере кибербезопасности этот урок усвоили давно, – подчеркнул эксперт. «Нельзя полагаться на то, что система будет вести себя правильно, чтобы обеспечить ее безопасность», – сказал он. «Необходимо предполагать, что что-то рано или поздно выйдет из-под контроля, будет скомпрометировано или поведёт себя непредсказуемо, и разрабатывать механизмы контроля, исходя из этого. Искусственный интеллект нуждается в таком же подходе».

Фрэнк Диксон, ведущий аналитик в Dickson Research, сравнил заявления Microsoft с обязательствами Anthropic и пришёл к выводу, что Microsoft уступает.

В документах Microsoft нет конкретной информации о том, как именно работает система», — отметил эксперт. «Сравните оба документа, чтобы увидеть, в чем заключаются различия».

Эксперт также подчеркнул, что «документы Microsoft указывают на необходимость того, чтобы модели «выполняли задачи, а не нарушали правила», что является важным принципом разработки. Однако, несмотря на это, в документах отсутствует информация о конкретном органе, который будет проводить проверки, методах, используемых для проверки, и возможных последствиях за нарушение правил. Всего 37 страниц, и Microsoft пока не предоставляет четких гарантий о процессе проверки».

Эксперт подчеркнул, что пока модели продолжают нарушать установленные правила, эти общие заявления не помогут.

«Каждая исследовательская лаборатория сталкивается с проблемами, связанными с обходом ограничений, агентами, которые отклоняются от заданного сценария, и отсутствием четкой границы между тем, что модель должна делать, и тем, что она может быть вынуждена делать», — сказал эксперт. «Заявление о ценностях, которое не содержит информации о процессе проверки, — это не эффективное ограничение, а скорее попытка формально обозначить существующую проблему».

Дата: 18.09.2026