В понедельник Microsoft присоединилась к ряду компаний, которые заявляют о стремлении к контролю над поведением своих моделей искусственного интеллекта.
"Искусственный интеллект должен оставаться под контролем человека. Модели должны быть под его надзором и контролем", – говорится в предварительной версии коде этики ИИ, опубликованной компанией в понедельник. В документе содержится призыв к общественности предоставить свои комментарии.
"ИИ, ориентированный на человека, разрабатывает системы с четко определенными целями, оцениваемые по реальному воздействию, и избегает погони за созданием универсального, всемогущего искусственного интеллекта, который мог бы обойти эти меры предосторожности", – говорится в заявлении Microsoft. "Мы стремимся создать что-то, что будет полезным и безопасным, даже если это потребует определенных компромиссов в отношении абсолютной универсальности, автономии или возможностей".
Заявление Microsoft соответствует недавним заявлениям других крупных компаний в сфере ИИ, включая Anthropic и OpenAI, которые поддерживаются Илоном Маском, генеральным директором SpaceX и Tesla. Однако в 37-страничном документе нет конкретных указаний на то, как Microsoft планирует реализовать эти принципы. При этом, стоит отметить, что большинство других крупных игроков в сфере ИИ пока не предоставили конкретной информации о своих планах по контролю над будущими моделями ИИ.
Компании признают проблемы в работе
Ключевая проблема, с которой сталкиваются многие компании, стремящиеся установить ограничения на использование искусственного интеллекта, заключается в том, что ИИ-агенты пока способны выполнять практически любые задачи, несмотря на установленные правила. Их возможности и стремление обходить или игнорировать эти правила создают серьезные трудности.
Microsoft неоднократно выражала обеспокоенность в связи с развитием этой технологии, как в период, когда компания начала ограничивать использование ИИ среди своих сотрудников, так и при создании Кодекса этики для ИИ.
В своем последнем заявлении компания признала сложности, связанные с одновременным развитием и ограничением возможностей ИИ.
"Чрезмерная и недостаточная осторожность – это факторы, приводящие к ошибкам, с разными последствиями", – говорится в сообщении компании. "Недостаточная осторожность, безусловно, может привести к более серьезным последствиям, но чрезмерная осторожность возникает чаще, и, следовательно, может требовать более частых корректировок. В этом контексте особенно важна пропорциональность потенциальным рискам и уровню безопасности. Ответы и действия должны учитывать предполагаемую степень и вероятность потенциального ущерба и соответственно корректировать свои действия".
Однако, стоит отметить, что термин «ущерб» достаточно широкий и его значение часто зависит от конкретного контекста. Существуют различные уровни потенциального ущерба и вероятность его возникновения. Поэтому ответы моделей искусственного интеллекта от Microsoft (MAI) необходимо адаптировать к конкретной ситуации, учитывая широкий спектр возможных негативных последствий.
Амбициозная цель, но без конкретики
Аналитики и эксперты в целом считают, что заявленная Microsoft цель – это благородная инициатива, однако отсутствие конкретных деталей и механизмов для её реализации затрудняет её серьёзную оценку.
Томас Рэндолл, директор по исследованиям в Info-Tech Research Group, также обратил внимание на некоторые нестыковки в документе.
«В нём утверждается, что модели MAI не будут использоваться в производстве или модификации оружия. Однако Microsoft предлагает GPT-5.2 от OpenAI через закрытые облачные сервисы для государственных нужд в сфере обороны и национальной безопасности», – отметил Рэндолл, хотя и подчеркнул, что это не является прямым нарушением Кодекса. «Однако наиболее важные положения Кодекса могут исключать другие аспекты реальной деятельности Microsoft в области искусственного интеллекта. Подобные противоречия можно обнаружить и в других частях Кодекса».
Однако, Рэндолл подчеркнул, что Microsoft опирается на свой ранее разработанный "Фреймворк управления Frontier", который включает в себя оценку как до, так и после обучения, периодическую переоценку каждые шесть месяцев, независимое тестирование, поэтапное внедрение и обязательство приостановить разработку или развертывание, если риски не могут быть снижены. При этом, как отметил Рэндолл, "окончательное решение о развертывании принимает сама Microsoft, определяя допустимые уровни риска, выбирая независимых экспертов для оценки и передавая окончательное решение своим руководителям".
Рэндолл выразил надежду, что Microsoft, а также другие крупные игроки в сфере ИИ, предоставят больше проверенных данных, например, от независимых оценщиков, имеющих постоянный доступ и возможность публиковать результаты своих исследований о действиях поставщика. Он также считает важным наличие независимого контроля безопасности на уровне совета директоров с полномочиями блокировать выпуск новых версий, защиту для лиц, сообщающих о нарушениях, доступ к мониторингу, журналы аудита, "выключатели" и обязательную переоценку после внесения изменений в модель.
В свою очередь, Джастин Грейс, генеральный директор консалтинговой фирмы Acceligence, отметил, что Microsoft открыто рассказала о многих элементах, которые еще не реализованы.
Текущие модели еще не обучены на этом коде. Фреймворк для оценки пока находится в разработке, и Microsoft прямо заявляет, что только письменные инструкции не гарантируют соответствия или текущего поведения системы. Это важно. Публикация "кодекса этики" для ИИ может быть полезным шагом. Главная задача – убедиться, что система действительно следует этому "кодексу", особенно по мере того, как модели становятся все более автономными.
Консультант Брайан Левин, исполнительный директор FormerGov, также отметил, что Microsoft заслуживает похвалы за то, что хотя бы признала необходимость ограничения возможностей моделей.
Microsoft открыто заявляет о готовности идти на компромиссы в плане универсальности, автономии и функциональности, чтобы обеспечить безопасность и контроль над системами. Компания также подчеркивает, что не стремится к созданию универсального, всемогущего искусственного интеллекта. Это заявление от компании такого масштаба и амбиций заслуживает особого внимания, – отметил эксперт. "В течение многих лет считалось, что исследовательские лаборатории будут ориентироваться на максимальные возможности, уделяя внимание безопасности. Однако, документ, который говорит об обратном – о приоритете полезности и контроля над абсолютными возможностями – является важной информацией, вне зависимости от дальнейших шагов".
Он добавил: "Реальное испытание наступит в ближайшее время, и оно будет заключаться в разработке измеримых стандартов, независимой оценке и создании механизма, позволяющего сторонним экспертам убедиться в соответствии заявленных функций с реально реализуемыми возможностями. Это естественный этап развития, и над ним необходимо работать всей индустрии".
Компании уходят от сложных задач, делегируя их другим
Однако, другие эксперты считают, что Microsoft в основном занимается продвижением своих продуктов и намеренно избегает решения более сложных вопросов, связанных с этикой искусственного интеллекта.
«Легко заявить об отказе от определенных функций, пока они еще не реализованы», – заявил Ноа Кенни, ведущий консультант Digital 52. «Настоящий вызов возникнет, когда Microsoft представит модель, которая позволит снизить конкурентное преимущество, но при этом не будет использоваться».
По словам Кенни, на данный момент Microsoft не несет никаких финансовых затрат, связанных с обещаниями в области ответственного использования искусственного интеллекта.
«Кодекс этики Microsoft выглядит скорее как маркетинговый документ, призванный успокоить клиентов, регуляторов и собственных сотрудников», – отметил Кенни. «Проблема в том, что никто не знает, как конкретизировать эти обещания, что ставит Microsoft в положение, требующее доверия, прежде чем объяснить, на чем это доверие должно основываться».
Том Файнли, генеральный директор Conifers.ai, добавил, что его основная обеспокоенность связана с тем, что документ Microsoft не дает ответа на очевидный вопрос о том, как вообще можно контролировать эти модели.
В документе указано, что модель должна всегда следовать инструкциям, оставаться в пределах заданных параметров и не скрывать свои действия. Это – правильные принципы», – отметил эксперт. «Однако, более сложный вопрос заключается в том, что происходит, когда мощная система ведет себя не так, как ожидается. Что именно заставляет ее остановиться? По мере того, как системы становятся все более автономными, простого ограничения, основанного на запрете определенных действий, оказывается недостаточным. Необходимо создавать внешние механизмы контроля, которые ограничивают доступ модели к информации, ее возможностям и степени ее влияния».
Как показал опыт в области кибербезопасности, – подчеркнул эксперт, – нельзя полагаться только на корректную работу системы. Необходимо предполагать возможность сбоев, компрометации или непредсказуемого поведения, и разрабатывать системы защиты, учитывающие эти риски. Искусственный интеллект также нуждается в таком подходе.
Аналитик из Dickson Research, Фрэнк Диксон, сравнил заявления Microsoft с обязательствами Anthropic, и пришел к выводу, что Microsoft не демонстрирует достаточной серьезности в вопросах безопасности.
В документе от Microsoft отсутствуют конкретные детали о том, как работает система», — отметил эксперт. «Сравните два предложения, чтобы увидеть различия. Например, заявление генерального директора Anthropic, Амодея, упоминает стороннюю компанию METR и описывает, что подразумевается под «доступом»: идентификационные карточки, корпоративные ноутбуки, видимость на уровне сотрудников и права на публикацию, которые Anthropic не получает. Вы можете проверить, действительно ли это происходило».
Эксперт также подчеркнул, что «документ Microsoft говорит о том, что «модели должны выполнять задачи, а не нарушать правила кода», что является важным принципом проектирования. Однако, в документе нет указания на конкретного аудитора, метод проверки и последствия за нарушение. Несмотря на 37 страниц, Microsoft не дает четкой гарантии о проверке».
Dickson подчеркнул, что пока агенты продолжают нарушать собственные правила, эти расплывчатые обещания не помогут.
«Каждая исследовательская лаборатория по-прежнему сталкивается с проблемами, связанными с обходом ограничений. Агенты продолжают действовать вне заданного сценария, и разрыв между тем, что модель должна делать, и тем, что она может быть заставлена делать, остается открытым», — сказал Dickson. «Заявление о ценностях, которое не касается вопроса проверки, — это не ограничение, а скорее надежда, замаскированная под документ политики».