Engenharia de Observabilidade (Portuguese Edition), 2nd Edition
by Charity Majors, Liz Fong-Jones, George Miranda
Capítulo 11. Usando Objetivos de Nível de Serviço para Garantir a Confiabilidade
Este trabalho foi traduzido com recurso a IA. Agradecemos o teu feedback e comentários: translation-feedback@oreilly.com
Nos últimos capítulos, falamos sobre situações que exigem análises iniciadas por engenheiros curiosos sobre um aspecto específico do sistema, além de como os agentes de IA podem fazer esse tipo de análise de forma proativa. Mas uma questão igualmente importante é como conduzimos investigações reativas, mantemos a estabilidade do sistema e analisamos as situações que vêm à tona. Como você deve configurar alertas em sistemas de alta observabilidade para proteger a experiência dos seus usuários?
Neste capítulo, vamos ver por que os alertas baseados em limites costumam esgotar os operadores com alarmes indesejados (fadiga de alertas), por que os sistemas distribuídos agravam esses problemas e como os SLOs oferecem uma alternativa mais confiável e centrada no usuário. Quando você consegue depurar a produção com segurança e eficácia em sistemas de alta observabilidade, os SLOs oferecem várias vantagens em relação aos sistemas de alerta tradicionais. Vamos examinar essas vantagens e incluir um estudo de caso real sobre como acelerar a adoção de SLOs e chegar ao mercado mais rápido, começando com telemetria padronizada e de alta qualidade (contribuição especial de Mat Vine).
Uma das partes mais difíceis da jornada de adoção dos SLOs é simplesmente dar o primeiro passo, definindo um ponto ...
Become an O’Reilly member and get unlimited access to this title plus top books and audiobooks from O’Reilly and nearly 200 top publishers, thousands of courses curated by job role, 150+ live events each month,
and much more.
Read now
Unlock full access