База знаний
Сбои и инциденты
Как подтверждать проблему, определять критичность и передавать её техническому специалисту.
Сайт не открывается: что проверить сначала
1. подтвердите проблему с другого устройства или сети; 2. определите, недоступен весь сайт или отдельная страница; 3. проверьте домен и статус размещения через предусмотренные инструменты; 4. вспомните последнее существенное изменение; 5. зафиксируйте время и сообщение об ошибке; 6. передайте проблему ответственному.
Не меняйте хаотично настройки, если причина неизвестна.
Не публикуются материалы
Проверьте:
- есть ли доступ у редактора;
- сохраняется ли черновик;
- касается ли проблема одного типа материала;
- работает ли CMS;
- не завершился ли выпуск ошибкой;
- не изменились ли права.
Перед технической эскалацией зафиксируйте шаги воспроизведения и время.
Не работает отдельная страница или функция
Определите границы:
- один URL или целый раздел;
- один язык или все;
- один браузер или все;
- только авторизованный пользователь или любой.
Чем точнее границы, тем быстрее диагностика.
После обновления появилась ошибка
Зафиксируйте:
- версию до;
- версию после;
- время выпуска;
- список изменений;
- момент появления проблемы.
Если ошибка критична и связь с выпуском вероятна, используйте заранее определённый процесс отката.
Какие сведения передать техническому специалисту
Полезный отчёт содержит:
- ссылку;
- время;
- что ожидалось;
- что произошло;
- шаги воспроизведения;
- сообщение об ошибке;
- скриншот при необходимости;
- последние изменения.
Сообщение «сайт опять сломался» почти не помогает диагностике.
Как определить критичность проблемы
Критично: весь сайт недоступен, риск потери данных, серьёзная проблема безопасности, невозможен ключевой срочный процесс.
Существенно: важная функция сломана, но основная работа продолжается.
Некритично: локальный дефект без серьёзного влияния.
Критичность определяет порядок эскалации, а не эмоциональность сообщения.
Когда требуется специализированная помощь
Базовая эксплуатация не заменяет:
- расследование безопасности;
- сложное восстановление данных;
- глубокую инфраструктурную диагностику;
- аудит архитектуры;
- юридическую оценку утечки.
Если проблема выходит за компетенцию команды, важно быстро передать её специалисту, а не продолжать случайные эксперименты.
Что делать после устранения сбоя
После восстановления:
1. проверьте ключевой сценарий; 2. зафиксируйте причину, если она известна; 3. определите, что предотвратит повтор; 4. обновите инструкцию, если процесс оказался непонятным; 5. проверьте, нужен ли отдельный security review.
Цель post-incident разбора – улучшить систему, а не найти виноватого.