Настройка механизма восстановления Auto-Recovery`¶
В статье рассмаривается настройка и анализ поведения функции auto-recovery и ее влияние на доступность сети
Требования и ограничания¶
В статье не описываются подробно функции NQA (Network Quality Analysis) – это механизм активного мониторинга, который выполняет контроль достижимости и качества сетевого пути.
Описание функции¶
Error-down auto-recovery – это механизм автоматического восстановления интерфейса после перевода порта в состояние error-down защитными функциями коммутатора (например, BPDU-protection, storm-suppression, port-security).
С точки зрения сети и доступности (availability) auto-recovery позволяет:
- уменьшить время простоя линка без ручного вмешательства инженера;
- автоматически вернуть порт в работу после временной/случайной причины блокировки;
- снизить операционные затраты при массовых ошибках подключения или кратковременных аномалиях.
Важное ограничение: если первопричина не устранена, порт может переходить в циклы error-down → auto-recovery → error-down. Поэтому интервалы восстановления следует выбирать с учётом природы причины.
Параметры механизма восстановления¶
Error-down auto-recovery - должен быть включен для выполнения попытки автовосстановления порта и его линка. Для включения механмзма восстановления для соответвующей причины, укажите интервал попытки восстановления в секунда
interval 0– авто-восстановление отключено для данной причины.interval <30-86400>– попытка восстановлия порта автоматически будет предпринята через <30-86400> секунд- для каждой причины устанавливается индивидуальный интервал попытки восстановления
Состяние по умолчанию и поддерживаемые функции¶
Краткое описание автовосстановления в зависимости от причины¶
auto-defend
Причина error-down, связанная с механизмом Auto-defend (защитная функция). Обычно используется для автоматической реакции на нежелательные/аномальные события безопасности на порту (например, подозрительное поведение трафика). При срабатывании порт может быть отключён в error-down для предотвращения влияния на сеть.
bpdu-protection
Причина error-down, связанная с защитой BPDU (например, BPDU Guard/Protection). Обычно применяется, чтобы предотвратить петли и некорректное участие порта в STP. Если порт, ожидаемый как edge/клиентский, начинает принимать BPDU, защита может отключить порт.
crc-error
Причина error-down при превышении порогов ошибок CRC. Как правило, указывает на проблемы физического уровня: кабель, коннекторы, SFP/трансивер, помехи, несовместимость.
link-flap
Причина error-down при детектировании частых событий up/down (флаппинг линка). В сетевой эксплуатации это обычно признак нестабильного физического подключения, проблемного удалённого устройства или некорректной автосогласования.
mac-address-flapping
Причина error-down при срабатывании защиты от MAC flapping – когда один и тот же MAC-адрес быстро «переезжает» между портами. Типичные причины: L2-петли, неверная агрегация линков, ошибки в топологии, некорректная работа виртуализации/мостов.
nqa
Причина error-down при срабатывании NQA Track (контроль достижимости/проверки). Если NQA-условие не выполняется, порт может переводиться в error-down в рамках политики отказоустойчивости/защиты.
port-security
Причина error-down, связанная с Port-Security (ограничение MAC-адресов, статусы нарушения). При нарушении политики (например, превышено число MAC, обнаружен неразрешённый MAC) порт может быть отключён в error-down.
storm-suppression
Причина error-down при срабатывании защиты Storm Suppression (шторм широковещательный/мультикаст/unknown-unicast). Обычно применяется, чтобы изолировать порт, который генерирует/пропускает шторм и деградирует сегмент сети.
transceiver-power-low
Причина error-down при обнаружении низкого уровня оптической мощности (transceiver power low). Как правило, указывает на деградацию оптической линии: загрязнение, повреждение волокна, несоответствие модулей, превышение длины, проблемы патчкорда/ODF.
Uni-Directional Link Detection (UDLD)¶
Также можно включить восстановление error-down, связанное с фукциональностью UDLD. Настройка по умолчанию приведена ниже
Настройка функции автоматического восстановления¶
Для выполнения настроек перейдите в режим глобального конфигурирования с помощью команды configure.
Введите команду ниже и выберите одну из причин блокировки порта для последующего автоматического восстановления
Пример настройки интервала для причины¶
Пример: включить auto-recovery для bpdu-protection с интервалом 30 секунд и storm-suppression - 60 секунд
Просмотр выполенных настроек¶
Просмотр настроек выполняется командой show running-config,
Просмотр состояни настройки по умолчанию show running-config include-default
Отображение настроек находится в различных местах вывода, ниже приведен сокращенный вывод команды.
Просмотр состояния error-down интерфейсов¶
Команда просмотра текущего состояния error-down, отсутсвие вывода (пустой вывод) означает "нормальную" работу портов и отсутсвие блокировков.
Проверка блокировки/восстановления¶
Проверку выполним на примере блокировки порта функцией STP BPDU Guard при получении кадра BPDU на "восходящий" интерфейс коммутатора (root port)
Включение вывода журнала в активной CLI-сессии¶
Для отображения журнала событий в реальном времени, включите вывод в текущую сессию CLI
Вывод в консоль
или вывод в VTY:
Включение защиты BPDU (глобально) и контекст¶
Порт получает BPDU от вышестоящего коммутатора (STP Root Bridge):
Эмуляция ошибки: случайный перевод root-порта в edge при включённом BPDU guard¶
Анализ событий (начало)¶
Просмотр состояния порта¶
Удаление ошибочно введённой команды¶
Анализ событий (окончание)¶
Note
Обратите внимание на разницу во времени событий:
- Блокировка порта – 02:40:56.291
- Восстановление порта – 02:41:27.205
Просмотр состояния интерфейсов после восстановления¶
Отключение вывода журнала в активной CLI-сессии¶
Для отображения журнала событий в реальном времени, включите вывод в текущую сессию CLI
Вывод в консоль
или вывод в VTY:
Конфигурация для настройки¶
Ниже приведен пример возможной полной настройки.