Атака дрона на дата-центр «Яндекса» во Владимире остановила облачную платформу
Третья площадка за неделю: почему сбои бьют именно по облаку
Сначала отключились вычислительные мощности в двух зонах доступности. Потом стало понятно: площадка во Владимире не работает целиком. Инфраструктуру дата-центра повредил беспилотник — об этом компания сообщила сама, подтвердив, что объект остановлен, а пострадавших нет. На месте работают профильные службы.
Облачная платформа Yandex Cloud перешла в аварийный режим. Две зоны — ru-central1-a и ru-central1-b — недоступны. Консоль управления и программный интерфейс отвечают, виртуальные машины в двух других зонах работают. Дальше начинаются детали, которые касаются уже конкретных команд и проектов.
Часть отказоустойчивых кластеров баз данных переключилась автоматически. Другие остались в режиме только для чтения или вовсе пропали из доступа. Хранилище объектов данные на чтение отдаёт, а вот запись может не пройти. Кластеры Kubernetes, развёрнутые сразу в двух рабочих зонах, держатся. Те, у кого мастер-узел оказался в пострадавшей зоне, не работают. Сервис мониторинга Monium недоступен, реестр контейнеров и система управления доступами функционируют. Часть сервисов безопасности и AI Studio доступна не полностью. С техподдержкой тоже возможны перебои.
Что стоит за серией ударов
Владимир — не первый адрес в этом списке. За несколько дней до этого под удар попал дата-центр в Сасово Рязанской области. Ещё раньше — площадка в Калуге, где, по сообщениям пресс-службы компании, пострадала часть инфраструктуры. Три объекта за короткий срок.
«Пользователям рекомендовано задействовать альтернативные планы по восстановлению ресурсов на внешних площадках» — так компания описывает ситуацию на своём статус-борде.
Рекомендация звучит сухо, но за ней — прямое признание: своими силами закрыть просадку не получается. Клиентам предлагают искать мощности на стороне.
Стоит понимать, как устроены такие площадки. Дата-центр — это не один зал с серверами, а несколько зон доступности, разнесённых физически. Логика в том, чтобы выход из строя одной зоны не ронял весь сервис. Когда беспилотник повреждает инфраструктуру, нагрузка должна перетечь на соседние площадки. В этот раз переток сработал лишь частично. Две зоны выпали, и часть отказоустойчивых схем не выдержала.
Для «Яндекса» облако — одно из ключевых направлений, а не побочный продукт. Корпоративные клиенты платят за предсказуемость. Каждый такой инцидент — удар по репутации надёжности, и восстановить её сложнее, чем поднять серверы.
Пока одни команды переносят ресурсы на внешние площадки, другие ждут, когда заработает мониторинг и вернётся запись в хранилище. Компания сообщает, что продолжает восстановление и стабилизацию ключевых сервисов. Сроков восстановления компания не назвала. Для тех, кто арендует мощности в пострадавших зонах, это самое неприятное — неопределённость.