<!-- Начало отчета --> Post Mortem по результатам восстановления веб-сервиса Дата выполнения: [10,06,2025] Ответственный: [Krykunov I.I]
<!-- Описание инцидента -->
На одном из учебных Linux-серверов перестал работать веб-сервис, расположенный по адресу http://18.192.103.67/. Целью работы стало восстановление доступности сайта, выявление причин сбоя и принятие профилактических мер.
<!-- Причины инцидента-->
В процессе анализа были обнаружены следующие ключевые проблемы:
Сервис Apache (httpd) был остановлен.
Отсутствовал файл конфигурации LocalSettings.php, необходимый для запуска MediaWiki.
Сервер не мог подключиться к базе данных из-за нехватки свободного места на файловой системе.
Логи Apache указывали на сбой подключения и ошибки доступа.
Причиной сбоя стала перегрузка файловой системы из-за большого количества логов и временных файлов, что в свою очередь вызвало каскадное отключение сервисов и невозможность корректной работы веб-приложения.
<!-- Предпринятые шаги-->
1.Подтверждена недоступность сайта по URL.
2.Подключение к серверу выполнено через SSH.
3.Проверено состояние Apache: sudo systemctl status httpd
Сервис был остановлен.
4.Выполнен перезапуск: sudo systemctl start httpd 5.После запуска — выявлено отсутствие конфигурационного файла.
6.Попытка скопировать файл из /home/ec2-user/LocalSettings\ (5).php вызвала ошибку.
7.Анализ логов Apache (/var/log/httpd/error_log) показал проблемы с подключением к базе.
8.Проверка места: df -h
Выявила заполнение диска.
9.С помощью: du -sh /*
Найдены и удалены/архивированы крупные устаревшие файлы.
10.После очистки место освободилось.
11.Конфигурационный файл успешно скопирован: sudo cp /home/ec2-user/LocalSettings\ (5).php /var/www/html/mediawiki/LocalSettings.php
12.Сервис начал корректную работу.
<!-- Результаты -->
Сайт полностью восстановлен.
Конфигурационный файл возвращен в нужную директорию.
Apache функционирует в штатном режиме.
Проблема с нехваткой места устранена.
<!-- Рекомендации и предложения -->
1.Настроить автоматическую очистку логов — создан скрипт /home/ec2-user/backup_logs.sh, архивирующий логи и удаляющий старые: #!/bin/bash tar -czf /home/ec2-user/log_backup_$(date +\%F).tar.gz /var/log/httpd/.log find /home/ec2-user/ -name “log_backup_.tar.gz” -mtime +7 -exec rm {} \;
2.Добавить выполнение скрипта в cron:crontab -e
Добавлено:0 1 * * * /home/ec2-user/backup_logs.sh
3.Мониторить дисковое пространство регулярно.
4.Автоматизировать проверку состояния Apache — с оповещением на email/в Telegram при сбоях.
5.Периодически создавать резервную копию LocalSettings.php.
<!-- Вывод -->
Инцидент стал хорошим примером важности регулярного мониторинга серверов и хранения резервных копий. Благодаря системному подходу и пошаговой отладке сервис был полностью восстановлен. В дальнейшем внедрение автоматизированных скриптов и мониторинга позволит избежать подобных ситуаций.