Artigos sobre infra
21 artigos de Felipe Guedes sobre infra: System Design, arquitetura, engenharia full stack, auditoria e IA em produção.
- SLO para um time de cinco pessoasVocê não precisa de time de SRE para ter SLO. Precisa de um número, uma janela e uma regra para quando errar.
- A CDN é a decisão de escala mais barata que você vai tomarAntes de adicionar servidor, pergunte quais respostas nunca precisavam chegar num servidor.
- A infraestrutura é sua, goste você disso ou nãoCada linha de código roda sobre decisões que você tomou ou aceitou por padrão. As duas são suas.
- CI que te diz a verdadeBuild verde que mente é pior do que build nenhum. O que é preciso para o CI virar um sinal em que dá para agir.
- Container não é isolamentoContainer é um processo fantasiado. Trate como fronteira de segurança e uma hora você vai se arrepender.
- Postgres basta, até o dia em que não basta, e como saber que dia é esseA maioria dos times sai do Postgres cedo demais ou tarde demais. Os sinais que dizem qual dos dois são mensuráveis.
- Migrations sem downtime na práticaA mudança de schema nunca é a parte difícil. O lock, o backfill e o código velho ainda rodando são.
- Os três primeiros alertas que todo sistema precisaAntes de dashboard, antes de SLO, antes de tudo: três alertas que pegam a maioria das quedas e quase nunca mentem.
- O que um build verde escondeUm pipeline que passa prova que os testes que você escreveu passam na máquina em que rodaram. O resto é fé. Eis o que conferir.
- Log estruturado ou nadaLinha de log que você não consegue consultar é linha que você vai ler uma vez, no incidente, tarde demais.
- O custo de nuvem que ninguém coloca no orçamentoComputação é a linha que todo mundo olha. A fatura cresce nas linhas que ninguém lê.
- TTL de DNS e outras coisas pequenas que mordem às 3 da manhãAs quedas que mais doem raramente são arquiteturais. São um número que alguém definiu uma vez e esqueceu.
- O deploy faz parte do designSe você não consegue descrever como uma mudança chega em produção com segurança, o design não terminou.
- Load test da coisa certaA maioria dos load tests mede a velocidade de servir uma home cacheada. Produção falha em outro lugar.
- Blue-green, canary e o rollback honestoEstratégia de deploy só vale o rollback que ela realmente permite. A maioria dos times superestima o seu.
- A mentira do ambiente de stagingStaging prova que o código roda. Quase nunca prova que roda em produção, e fingir o contrário sai caro.
- Gestão de secrets para times pequenos que vão crescerO .env é ótimo no dia um e um risco no dia noventa. Este é o caminho que não exige reescrita.
- Um template de post-mortem que produz mudançaA maioria dos post-mortems é bem escrita e não muda nada. O template decide qual tipo você vai escrever.
- Observabilidade é feature de produtoConseguir responder "o que aconteceu com esse usuário" vale mais do que a maioria dos itens do seu roadmap.
- Backup que você nunca restaurou é hipóteseBackup é uma afirmação sobre o futuro. Só o restore transforma ele em fato.
- Ciência aberta precisa de infraestrutura chataCiência aberta não falha nos ideais. Falha em armazenamento, identificadores, uptime e na pessoa não paga que mantém o servidor vivo.