Тег: Observability
Все статьи с тегом "Observability".
-
Sentry: ловим ошибки в проде раньше пользователей
Логи говорят «что-то упало», Sentry — что именно, у кого и в какой версии. Разбираем группировку ошибок, breadcrumbs, releases и source maps, как приглушить шум и как поднять Sentry у себя.
-
AI SRE-агенты в 2026: что они реально делают и где ломаются
AWS DevOps Agent и Azure SRE Agent вышли в GA в марте 2026. Разбираем рабочую модель AI SRE-агентов: что они реально делают (триаж, корреляция, runbook execution), где ломаются, и как выстроить human-in-the-loop с approval gates, чтобы агент был вторым пилотом, а не источником нового инцидента.
-
Progressive delivery: canary с автоматическим откатом на Flagger
Flagger превращает обычный Deployment в progressive delivery с автоматическим откатом по метрикам: разбираем CR Canary, стратегии canary/blue-green/A-B, анализ error-rate и p95 через MetricTemplate и рабочий манифест с шагами 10/30/50%.
-
OpenTelemetry Collector: минимальный setup, который не стыдно в прод
Зачем нужен OpenTelemetry Collector, как устроен его pipeline из receivers/processors/exporters, чем agent отличается от gateway и как собрать минимальный, но боевой setup на docker-compose с Tempo.