В понедельник компания OpenAI представила подробный перечень принципов и приоритетов, разработанный для регулирования оценки моделей сторонними организациями. Эксперты в отрасли оценили этот документ как позитивный, однако отметили, что в нем отсутствуют механизмы, гарантирующие реальное соблюдение правил безопасности.
Аналитики считают, что, если целью OpenAI является убеждение крупных IT-компаний доверять их разработкам, этот документ не окажет значительного влияния. Однако, большинство экспертов сомневаются, что именно является основной целью компании. Более вероятно, что OpenAI планирует использовать этот перечень для достижения соглашения с конкурентами и регулирующими органами, чтобы обеспечить более гибкое применение правил. Предполагается, что OpenAI готова к более строгому контролю, но только в том случае, если все ее основные конкуренты согласятся с идентичными ограничениями.
В опубликованном OpenAI документе говорится: «OpenAI стремится к тому, чтобы независимые организации имели глубокий доступ к информации о процессе обучения, оценке и развертывании моделей. Этот доступ должен позволять оценщикам критически оценивать наши решения, выявлять потенциальные риски и формировать собственные выводы об эффективности наших мер безопасности».
Независимая оценка: когда она действительно полезна?
Независимые оценки становятся все более востребованными, особенно когда речь идет о конкретных, критически важных вопросах. Например, подтверждают ли имеющиеся данные безопасность лаборатории и соответствие заявленным стандартам? Достаточно ли проведенная оценка охватывает все потенциальные риски? И, наконец, насколько эффективно работают предусмотренные меры безопасности в реальных условиях?
Отсутствуют детали о применении новых технологий
Питтер Арнтц, исследователь в компании Malwarebytes, специализирующейся на вопросах безопасности, отметил, что предоставление правилам взаимодействия с третьими сторонами – это, безусловно, позитивный шаг. Однако, он подчеркнул, что эти правила должны каким-то образом соблюдаться. Но в самом документе об этом прямо не говорится.
«Он устанавливает определенные ожидания относительно независимости и строгости, но сам по себе не обязывает OpenAI предоставлять конкретные данные, публиковать негативные результаты или менять решения о развертывании», – заявил Арнтц. «Его надежность будет зависеть от условий, касающихся индивидуальных оценок, и от того, какие данные третьим сторонам разрешено видеть. Поэтому его ценность будет определяться тем, насколько OpenAI готова к реальному контролю, и сможет ли результат, а также решения о корректировке и развертывании, быть проверены независимо».
Валенс Хаден, консультативный эксперт в Info-Tech Research Group, также согласился с тем, что отсутствие механизмов принуждения делает эти правила практически бесполезными.
Документ не содержит каких-либо обязательных требований к компании OpenAI, и, признаться, я был бы удивлен, если бы это было так. Мотивы OpenAI, по сути, не так однозначны, как они утверждают. Кроме того, компания пока не определила, какие конкретные шаги предпримет на основе проведенной оценки. OpenAI сохраняет контроль над масштабом оценки, поскольку для этого требуется согласование с ней. Это, в свою очередь, ограничивает возможности независимых экспертов. Компания также оставляет за собой право определять уровень доступа к информации, что позволяет ей фильтровать предоставляемые данные и затруднять сбор прямых доказательств в тех случаях, которые она считает значимыми или конфиденциальными. Более того, OpenAI контролирует большую часть отчетов и имеет право удалять определенные части информации.
Как отмечает Howden, в конечном итоге документ полезен для определения того, какие аспекты следует оценивать, но значительно слабее в плане обеспечения четкости и определения методов проведения оценки.
Однако, Jason Andersen, ведущий аналитик в Moor Insights & Strategy, придерживается иного мнения, хотя и приходит к аналогичным выводам, как и Howden и Arntz.
"Нельзя считать это проявлением добросовестности, если не предоставить оценщикам необходимые полномочия", – говорит Andersen. "В то же время, руководителям ИТ-отделов необходимо понимать двойственную природу OpenAI в настоящий момент.
Эта проблема характерна для OpenAI, поскольку компания состоит из двух основных подразделений: коммерческого и команды, занимающейся первоначальными задачами. В течение последних двух лет эти подразделения не могли эффективно взаимодействовать. Похоже, что инициировал этот процесс именно первый, занимающийся первоначальными задачами, но затем коммерческие интересы взяли этот документ под контроль и оформили его в юридическом документе.
Принцип, а не оправдание: как новые инструменты меняют подход к разработке
Фрэнк Диксон, ведущий аналитик компании Dickson Research, пришел к выводу, что OpenAI "активно заявляет о рисках, связанных с искусственным интеллектом, но при этом не демонстрирует готовности брать на себя ответственность или предпринимать конкретные шаги. Этот "кодекс этики" больше предназначен для аудиторов, чем для самой OpenAI. Именно этот разрыв между этими двумя позициями и является ключевой проблемой".
Аналитик тщательно изучил документ и выразил свое недовольство. В частности, он отметил, что доступ сторонних экспертов "ограничен юридическими требованиями, касающимися безопасности и защиты интеллектуальной собственности. Это означает, что компания сама определяет границы своей компетенции".
Он также обратил внимание на то, что документ предусматривает, что "публикация результатов анализа происходит только после того, как лаборатории получили разумный срок для устранения выявленных недостатков. Это аналогичная логика "милостивого" периода, которую сейчас критикуют в отношении Google за задержку с публикацией информации о проблемах в Gemini. Теперь этот принцип зафиксирован в документе, что позволяет избежать оправданий".
Начало новой эры: Google, OpenAI и Copilot меняют правила игры
Однако, Саманта Глюде, руководитель отдела управления рисками в KPMG, считает, что данный документ – лишь первый шаг в этом процессе, и его необходимо оценивать соответствующим образом.
«Я полагаю, что дискуссия постепенно перейдет от оценки рисков к определению ответственности за их устранение», – заявила Глюде. «Независимая проверка важна, но долгосрочное доверие будет зависеть от того, как организации будут реагировать, когда будут выявлены существенные риски. Заинтересованные стороны захотят не только убедиться в возможности выявления проблем, но и в том, что будут предприняты конкретные меры по их устранению, которые будут независимо проверены и зафиксированы в процессах управления и внедрения. Следующий этап развития аудита искусственного интеллекта будет заключаться в демонстрации этой ответственности с той же строгостью, что и при первоначальной оценке рисков».
Эдна Конвей, исполнительный советник в консалтинговой фирме Acceligence, согласилась, отметив, что истинную ценность этого усилия можно будет оценить только на следующем этапе.
Следующий вопрос: кто должен нести ответственность за сам процесс оценки? «Кто определяет, когда требуется проведение оценки?» – спросила она. «Какой уровень доступа необходим? Что происходит, когда оценщик и лаборатория не могут прийти к согласию относительно объема работ? Кто имеет доступ к критическим результатам? Важно обеспечить независимость, поскольку оценки, проводимые сторонними организациями, действительно ценны только в том случае, если оценщик может задавать неудобные вопросы, получать достаточный доступ для их решения, опираться на доказательства, выходящие за рамки первоначальной гипотезы, когда это необходимо, и представлять выводы без влияния коммерческих или организационных интересов».
Эта статья изначально была опубликована на CIO.com.