Компании столкнулись с новой и серьезной проблемой в эпоху искусственного интеллекта: что произойдет, если виртуальные помощники перестанут функционировать?
Эта проблема обострилась в четверг, когда ChatGPT от OpenAI, Claude от Anthropic и Grok от SpaceXAI практически одновременно и, казалось бы, необъяснимым образом, столкнулись с серьезными и продолжительными сбоями.
Начиная с утра по восточному времени, несколько версий ChatGPT вышли из строя примерно на два часа, версии Claude – на четыре часа, а версии Grok – почти на три с половиной часа. Все три компании признали "повышенный" уровень проблем и применили исправления.
В то время как пользователи высказывали свои опасения в онлайн-форумах, а IT-команды пытались восстановить работу, этот инцидент показал, насколько быстро некоторые организации внедряют рабочие процессы, основанные на генеративном ИИ, не учитывая потенциальные и неизбежные последствия масштабных сбоев.
Искусственный интеллект все активнее используется для решения рутинных и масштабных задач, и компании могут оказаться в уязвимом положении, если системы на его основе столкнутся с проблемами. Об этом заявил аналитик и журналист Карми Леви. Эта ситуация должна стать сигналом для руководителей IT-отделов, которые, как правило, игнорировали потенциальные риски, связанные с критически важными платформами, которые могут внезапно перестать функционировать. Риск больше не является гипотетическим.
Крупные сервисы Google и OpenAI столкнулись с длительными перебоями в работе
ChatGPT неожиданно остановился в тот же день, когда OpenAI планировала представить GPT-6 Astra – новую модель, которая, по заявлению компании, приближается к искусственному общему интеллекту (AGI) и становится все ближе к созданию автономных систем, превосходящих возможности человека.
Сбой в работе сервиса ChatGPT произошел примерно в 11 утра по восточному времени в четверг и затронул ряд функций, включая поиск, загрузку файлов, агентов, GPTs, голосовой режим, генерацию изображений, работу в ChatGPT, Compliance API, Deep Research, ChatGPT Atlas и другие интеграции и приложения. В некоторых случаях пользователям не удавалось войти в систему, переписка не загружалась, а интерфейс выдавал ошибки при попытке отправки сообщений. Также затронуты сервисы OpenAI, включая веб-интерфейс, API, командную строку (CLI) и расширение для VS Code.
OpenAI устранила проблему к 12:55 по восточному времени и рекомендовала пользователям, использующим Codex для удаленного управления, повторно подключить свои мобильные устройства.
И аналогичные проблемы возникли и у Claude. Anthropic сообщила об "исчерпывающем списке" моделей, которые столкнулись с повышенными ошибками в течение следующих нескольких часов: Mythos и Fable 5.1 и 5, Sonnet 5, а также Opus 5, 4.8 и 4.6.
Проблема была устранена примерно в 11:27 утра по восточному времени. Инцидент произошел после перерыва, который длился около 27 минут и также произошел накануне, из-за повышенного количества ошибок при запросах в Sonnet 5.
В это же время сервис Grok начал испытывать сбои, начиная с 9:30 утра по восточному времени. Затронуты были Grok Web, Build, API, плагины Office/Workspace, Android и X. Сервисы вернулись к нормальной работе примерно в 1:08 утра по восточному времени.
«Это довольно необычная ситуация, когда несколько разных поставщиков сталкиваются с одновременными сбоями», – отметил Брайан Джексон, ведущий исследователь в Info-Tech Research Group. Он предположил, что причиной может быть общая инфраструктура, такая как сеть доставки контента (CDN), система доменных имен (DNS) или общая облачная инфраструктура.
Планирование на случай сбоев: почему это необходимо
Несколько месяцев назад, использование искусственного интеллекта в большинстве компаний ограничивалось простыми задачами: сотрудниками использовались чат-боты для ответов на типовые вопросы или для составления простых писем, – отмечал Леви. Однако, масштабные сбои в работе систем искусственного интеллекта оказывали относительно незначительное влияние на общую производительность организации. "Но ситуация быстро меняется", – заявил он.
Сейчас компании должны более четко понимать, какое влияние оказывают агенты искусственного интеллекта на повседневную работу, и в какой степени они могут затруднять выполнение сотрудниками сложных задач, когда они передают управление автоматизированным облачным инструментам, – отметил Леви.
В ситуациях, подобных той, что произошла в четверг, сотрудники могут вернуться к традиционным ручным методам работы, таким как обновление электронных таблиц или сбор отчетов вручную. Однако, они также могут осознать, что, полагаясь на агентов искусственного интеллекта для выполнения такого объема работы, они становятся чрезмерно зависимыми от автоматизации, и их "когнитивные навыки могут ослабевать".
Распространение систем искусственного интеллекта, способных самостоятельно принимать решения, требует от организаций пересмотра планов восстановления после аварий и обеспечения непрерывности бизнеса, а также оценки потенциального влияния сбоев в работе на производительность.
Хотя облачные платформы, такие как Google Workspace и Microsoft 365, предоставляют ограниченные возможности работы в "оффлайн" режиме, используя локальное хранение данных и синхронизацию документов с жесткими дисками (например, через Dropbox или Google Docs для Desktop), платформы, использующие агентированный ИИ, предлагают меньше вариантов работы в автономном режиме, по крайней мере, в их текущей реализации.
Леви отметил, что компаниям необходимо более тщательно документировать свои рабочие процессы и разрабатывать планы восстановления на случай длительного перебоя в работе платформы искусственного интеллекта. Кроме того, требуется внедрение более эффективных программ обучения, чтобы сотрудники могли поддерживать свои навыки ручной работы и оперативно применять их в случае сбоев в работе сервиса. Поскольку предприятия все больше полагаются на автоматизацию для выполнения критически важных задач, "выводя людей из процесса ради повышения производительности", сотрудники будут менее подготовлены к возвращению к работе в случае неизбежных сбоев, – подчеркнул Леви.
Даже самые авторитетные организации могут чрезмерно полагаться на автоматизацию с помощью искусственного интеллекта», – подчеркнул Леви. «В противном случае, многие компании рискуют столкнуться с серьезными проблемами».
Эксперт Info-Tech, Джексон, также советует использовать модульную архитектуру для больших языковых моделей. Компании должны рассматривать модель как «модуль, который можно легко заменить другим решением». Это может быть другой провайдер облачных услуг (и, надеемся, что у него не возникнет технических проблем) или собственное решение, например, модель с открытым исходным кодом.
«В такой ситуации, когда основной провайдер недоступен, у вас есть альтернативное решение, которое может обеспечить ту же функциональность, даже если это лишь временное решение», – пояснил Джексон.