Евгений Пешков
гость
гость
гость
Финальный выпуск по Continuous Architecture in Practice посвящён надёжности и новым технологиям. Сергей Баранов и Евгений Пешков разделяют термины, которые часто смешивают: availability описывает доступность, reliability — работу без отказов, а resilience и fault tolerance — способы пережить сбой и восстановиться.
Высокая доступность стала ожидаемой далеко за пределами IT, но её нельзя покупать без границ. Зоны и регионы облака, изоляция отказов и резервы помогают только при осознанном дизайне. «Пять девяток» бессмысленны без критичных сценариев, стоимости простоя и решения, какие функции должны работать постоянно.
MTBF и MTTR связывают частоту отказов со временем восстановления, а RPO и RTO задают допустимую потерю данных и срок возврата сервиса. Участники обсуждают постмортемы, предотвращённые сбои и сохранение фактов сразу после инцидента. Метрики насыщения позволяют вмешаться до прогнозируемого отказа.
Практический цикл — распознавание, изоляция, восстановление и проверка: health checks, таймауты, circuit breakers, fallback, репликация, бэкапы и компенсации. Operability и observability проектируют вместе с системой, disaster recovery репетируют. Разговор о blockchain и AI напоминает: не стоит принимать хайп без проверки или блокировать незнакомую технологию.