Manual prático de engenharia de confiabilidade de sites · Trechos bilíngues
Este manual apresenta métodos e casos para aplicar SRE. A seleção dos capítulos 2 e 6 relaciona experiência do usuário, orçamento de erros, falhas compartilhadas e custo total da automação.
Capítulo 2. Implementar SLOs · Steven Thurgood e David Ferguson
Problema e método
O capítulo usa objetivos de nível de serviço (SLOs) para orientar decisões de confiabilidade. Parte dos resultados importantes para os usuários, define indicadores, metas e períodos, e estabelece uma política de orçamento de erros entre produto, desenvolvimento e operação. Um jogo exemplifica as medições e suas escolhas. Depois, aborda ajustes contínuos, jornadas de usuários e dependências: ter várias cópias não significa que as falhas sejam independentes.
Capítulo 6. Eliminar o trabalho repetitivo · David Challoner e outros autores
Problema e método
O capítulo começa medindo o trabalho repetitivo e o investimento necessário para reduzi-lo. Examina mudanças no sistema, automação parcial, autosserviço e alterações de processos. Dois casos tratam da automação de reparos de rede em centros de dados e da retirada de antigos diretórios pessoais compartilhados. Diminuir os passos da própria equipe não basta: manutenção, segurança, experiência dos técnicos e carga das outras equipes também importam.
Traduzir seu livro
Tradução e notas preparadas com IA a partir do inglês para esta seleção. Não é uma tradução oficial. Os resumos e comentários não fazem parte das citações.
Traduzir seu livro ↗