9 октября 2026
Mindbox после инцидента в ЦОД Яндекса — безопасность данных и стабильность платформы
8 октября сервисы Mindbox были временно недоступны из-за пожара в дата‑центре Яндекса. Проблему с процессингом полностью устранили за ночь, все данные клиентов остаются под надежной защитой.
В 01:40 дежурная IT-команда получила сигнал, что платформа недоступна. До 40% запросов завершались ошибкой из-за отказа одного ЦОД и частичной недоступности других ЦОД Яндекса. В 02:33 проблемный дата‑центр вывели из маршрутизации трафика и снизили долю затронутых клиентов до 10%. В течение дня работу платформы полностью стабилизировали.
Быстро среагировать на инцидент и гарантировать защиту данных помогли постоянные меры, которые поддерживают устойчивость платформы:
1. Техническое резервирование. Все ключевые системы минимум троируются и распределены по трем независимым зонам Яндекс Облака. Платформа готова к отказу одной из них.
2. Данные пользователей хранятся в разных ЦОД. Сервисы, которые хранят и обрабатывают клиентские данные, размещены в нескольких дата‑центрах, не принадлежащих Яндекс Облаку, — инцидент их не затронул.
3. Ежедневные резервные копии для всех систем. Предусмотрено геораспределенное хранение. Даже при наложении нескольких сбоев данные можно восстановить.
4. Регулярные хаос‑тесты. Проверяем отказоустойчивость систем и готовность команды к реальным инцидентам.
5. 40 инженеров отвечают за устойчивость инфраструктуры. Систему круглосуточно отслеживает дежурная команда: при сбое нотификации сразу поднимают нужных специалистов, а сложные инциденты автоматически эскалируются до CTO.
Сейчас команда инженеров Mindbox резервирует дополнительные мощности, в том числе у других вендоров, для поддержания отказоустойчивости в любых условиях.