Одни и те же инциденты повторяются
Вы устраняете непосредственный симптом, но первопричина и ответственность остаются неясными.
Команда знает о проблемах. Сложнее понять, какие требуют внимания в первую очередь. Получите независимую оценку производительности, восстановления, безопасности и ежедневной эксплуатации с чёткой очерёдностью работ.
Работайте напрямую с опытными специалистами по SQL Server.
Начните с проблемы, с которой сталкивается команда. Для обращения не нужен готовый диагноз.
Вы устраняете непосредственный симптом, но первопричина и ответственность остаются неясными.
Документация неполна, обслуживание непоследовательно, а важные знания сосредоточены у одного человека.
Вам нужна техническая отправная точка перед миграцией, покупкой оборудования, запуском приложения или рассмотрением руководством.
Объём адаптируется к вашей среде, а необходимые данные и способ доступа согласуются в начале.
Изучите историю нагрузки, дорогие запросы, ожидания, блокировки, память, хранилище, tempdb и рост. Отличите срочные узкие места от состояний, требующих только наблюдения.
Проверьте охват и хранение резервных копий, подтверждения восстановления, проверки целостности и зависимости переключения. Определите, где план восстановления опирается на предположения.
Проверьте шаблоны доступа, служебные учётные записи, управление шифрованием, задания SQL Agent, маршрутизацию оповещений, установку исправлений и передачу эксплуатации.
Согласуйте результаты до начала работ. Если внедрение входит в объём, оно следует вашим процессам тестирования и изменений.
Существенные риски и возможности с точки зрения доступности, реализации, стоимости и работы команды.
Факты, вероятное влияние, рекомендуемое действие, зависимости и предлагаемый ответственный для каждого согласованного вывода.
Разделите срочные работы, плановые улучшения и пункты для наблюдения. Включите шаги проверки и изменения, требующие окна обслуживания.
Разберите выводы вместе, чтобы DBA и инженеры понимали логику и могли оспорить предположения.
Отчёт должен стать рабочим списком задач вашей команды.
| Часть вывода | Вопрос, на который он отвечает |
|---|---|
| Фактические данные | Что мы наблюдали и откуда получены данные? |
| Влияние на бизнес | Какой сервис, команду, стоимость или требование к восстановлению это затрагивает? |
| Рекомендуемое действие | Что нужно изменить, кого привлечь и что может быть нарушено? |
| Проверка | Как понять, что изменение сработало, и что отслеживать после этого? |
Вы участвуете в принятии решений и понимаете обоснование рекомендаций.
Выберите экземпляры, бизнес-сервисы, данные и участников, необходимые для полезной проверки.
Используйте существующий мониторинг и согласованные методы диагностики. До запуска проверьте разрешения и накладные расходы сбора.
Свяжите поведение базы данных и эксплуатационные практики с проблемами бизнеса.
Согласуйте приоритеты и ответственность. Внедрение можно оформить отдельно или выполнить силами вашей команды.
Целевой разговор поможет понять, подходит ли эта услуга вашей ситуации.
Проверка опирается на вашу нагрузку, инциденты и эксплуатационные требования. Отличие настройки от значения по умолчанию - повод исследовать, а не автоматически менять её.
Изменения согласуются отдельно. Диагностика начинается с одобренного командой способа доступа и сбора, а любой сбор, способный увеличить нагрузку, предварительно проверяется.
Объём зависит от числа экземпляров, сложности среды, доступных данных и вопросов. Результаты, стоимость и сроки согласуются до начала работ.
Некоторые проблемы затрагивают несколько частей среды. Мы можем объединить соответствующие работы в одном согласованном объёме.
Найдите причину медленной работы приложений.
Сделайте правильные процессы воспроизводимыми.
Медленное приложение, повторяющийся инцидент, предстоящее изменение или процесс, который команда хочет улучшить. Начните с краткого описания.