Утром в четверг, 3 сентября, сразу три ведущих разработчика ИИ-моделей — OpenAI, Anthropic и xAI — столкнулись с редкими сбоями в работе своих чат-ботов. Пользователи ChatGPT, Claude и Grok по всему миру наблюдали ошибки и недоступность сервисов в течение нескольких часов. Хотя инциденты произошли практически одновременно, компании дали разные объяснения, и, судя по всему, общей причины у них нет.

OpenAI сообщила, что проблема началась в 7:43 утра по тихоокеанскому времени и была вызвана ошибкой маршрутизации, которая затронула ChatGPT и Codex для части пользователей. Решение удалось внедрить уже к 8:17 утра, то есть инцидент длился около 34 минут. Представитель OpenAI Кэтлин Чайковски подтвердила, что проблема устранена и ведется мониторинг. Anthropic, в свою очередь, зафиксировала «частичный сбой» в 6:23 утра, связанный с повышенным числом ошибок при запросах к моделям Claude Mythos 5.1, Claude Fable 5.1 и Claude Opus 5. Компания оперативно определила причину и развернула исправление, полностью решив проблему к 9:16 утра. Позже, около 9 утра, кратковременные трудности возникли и у Claude Sonnet 5.

КомпанияНачало сбоя (PT)Окончание (PT)Причина
OpenAI7:438:17Ошибка маршрутизации
Anthropic6:239:16Не раскрыта
xAI6:3010:05Авария в вычислительном центре в Мемфисе

xAI сообщила о сбоях в работе Grok на всех платформах, начиная с 6:30 утра. В публичном заявлении SpaceX, материнской компании xAI, говорится, что проблемы были вызваны «аварией в нашем вычислительном центре в Мемфисе сегодня утром». Инцидент был полностью устранен к 10:05 утра, после чего компания заявила, что «трафик снова в норме». Примечательно, что SpaceX также принесла извинения «затронутым вычислительным партнерам», что может указывать на более широкие последствия инцидента. В мае Anthropic и xAI объявили о «вычислительном партнерстве» со SpaceX, что делает возможным влияние аварии в Мемфисе на обе компании.

Anthropic сообщила о частичном сбое Claude, затронувшем модели Mythos 5.1, Fable 5.1 и Opus 5.

Обычно одновременные сбои в одном секторе указывают на проблемы у общего поставщика облачных услуг или CDN-провайдера. Однако ни OpenAI, ни Anthropic не упомянули внешние причины, а крупные игроки интернет-инфраструктуры, включая Cloudflare, Amazon Web Services и Microsoft Azure, не сообщали об инцидентах в четверг. Это позволяет предположить, что сбои, скорее всего, были независимыми. Также поступали разрозненные сообщения о возможных проблемах у Google Gemini, но компания не подтвердила их и не зафиксировала инциденты на своем статусном дашборде.

Для пользователей и бизнеса, зависящих от этих сервисов, подобные сбои — напоминание о хрупкости инфраструктуры ИИ. Даже кратковременные перерывы в работе ChatGPT, Claude или Grok могут нарушить рабочие процессы, особенно в компаниях, интегрировавших эти модели в свои продукты. Прозрачность компаний в раскрытии причин и сроков устранения становится критически важной для поддержания доверия. В то же время отсутствие единой причины указывает на то, что индустрия пока не достигла уровня отказоустойчивости, характерного для традиционных облачных сервисов, где резервирование и распределенные системы снижают риски.