Aula 0: Por Que Entender o Sistema e a Rede, Afinal?
Seu site funciona perfeitamente no seu notebook — e então os utilizadores relatam que ele está completamente inacessível. Não há mensagem de erro no código, nenhum stack trace para olhar. Isso não é um bug numa função que você escreveu — é uma falha na camada que fica abaixo do código: como o sistem
Quando algo quebra num servidor, só o código não te diz por quê — você precisa olhar debaixo do capô, para o sistema e para a rede.
- Incidente de produção (Production incident)
- Um evento em que um serviço em produção para de funcionar ou fica lento para utilizadores reais — não apenas uma falha num ambiente de desenvolvimento.
- Causa raiz (Root cause)
- A razão real por trás de uma falha, em contraste com o sintoma externo que você percebe primeiro.
- Funcionamento interno do SO (OS internals)
- Como o kernel gere processos, memória e ficheiros por baixo de cada programa que roda na máquina.
- Alcançabilidade de rede (Network reachability)
- A questão de saber se uma máquina consegue sequer alcançar outra pela rede, antes mesmo de falar sobre o que roda nela.
- Debug em nível de sistema (Systems-level debugging)
- Diagnosticar falhas usando ferramentas que revelam o que realmente acontece no kernel e na rede, não apenas no código da aplicação.