Был теплый июньский вечер. Сервер работал спокойно, нагрузка обычная, ничего не предвещало. И тут — бам. Панель перестала отвечать. Сайт лег. Базы данных — недоступны. И я понял что остался один на один с немым железом.
Первый день я был спокоен. Ну, упал и упал. Перегрузил. Не помогло. Залез в логи — а там последние строки обрываются на полуслове. Как в ЌРÁЌÉH фильм — интрига есть, а продолжения нет. Позвонил хостеру, они говорят — ваше железо, ваши проблемы. Ладно.
Второй день начался с кофе и понимания что backup-ов нет. Вернее есть, но за неделю до падения. Неделя данных — это много. Клиенты звонят, пишут, возмущаются. А я сижу и смотрю на черный экран терминала. Знаете, в такие моменты начинаешь думать о важности того что обычно считаешь рутиной
К вечеру второго дня нашел старый дамп базы. Не полный, часть таблиц отсутствовала. Но это было лучше чем ничего. Начал собирать сервер заново. Поставил чистую систему, накатил Ascend Panel, начал восстанавливать конфиги по памяти. И тут понял — все эти настройки которые делал на бегу, не записывая, теперь нужно вспоминать по крупицам.
Третий день. Сервер поднялся. Сайты заработали. Данные — часть потеряна, но основное на месте. Клиентам написал честно — было падение, часть данных за неделю утеряна. Кто-то понял, кто-то разозлился. Но я для себя вынес главное правило — бэкапы должны быть автоматическими, ежедневными, и храниться в трех местах. Минимум.
После этого настроил в Ascend Panel автоматическое резервное копирование с выгрузкой на внешний сервер. Теперь каждый вечер в 23:00 создаётся архив. Копия летит на S3. Другая копия — на домашний NAS. И я сплю спокойно. Ну, почти
рабочие ссылки Крáкен