1.0

1.0 Introdução à Parte 1: Fundamentos da Medição

Antes de este livro nomear uma única métrica, tem de responder a uma pergunta mais difícil: para que serve a medição? Toda a equipa que alguma vez construiu um painel de controlo também já viu, mais cedo ou mais tarde, um número melhorar enquanto aquilo que ele devia representar piorava. Isso não é uma falha de ferramentas. É o resultado previsível de saltar os fundamentos que esta parte aborda: porque se mede, de todo; o que acontece a uma métrica assim que as pessoas sabem que está a ser observada; como ponderar os resultados acima da atividade; quem é o responsável por um número e pela sua definição; de onde vêm realmente os dados; e como ler um sinal ruidoso sem se enganar a si próprio.

Para equipas grandes, estes fundamentos deixam de ser opcionais. Uma única equipa pode safar-se com um número ad hoc que um gestor espreita uma vez por semana. Uma organização com centenas de engenheiros, dezenas de painéis de controlo, e uma liderança que reporta para cima, não pode. A essa escala, uma métrica sem dono ou mal definida não induz em erro apenas uma equipa, induz em erro todos a jusante que confiam no número sem verificar como foi construído, e é caro desfazer isso uma vez que o comportamento se adaptou para o manipular.

As organizações empresariais e governamentais sentem isto de forma mais aguda, porque as suas métricas carregam frequentemente consequências para além da equipa que as produz: decisões orçamentais, relatórios públicos de desempenho, conclusões de auditorias, e contratos com fornecedores. Uma métrica que parece uma conveniência interna de engenharia pode tornar-se silenciosamente um elemento crítico e inquestionado nas decisões de pessoas que nunca veem o pipeline que a gerou. Acertar nos fundamentos é o que torna esse peso suportável.

Temas nesta parte

  • 1.1 Porquê medir a engenharia de software: O argumento para medir, de todo, o que isso deve alcançar, e a diferença entre medir para aprender e medir para julgar.
  • 1.2 A lei de Goodhart e a psicologia das métricas: A ideia única que governa todos os outros temas deste livro: uma medida que se torna um alvo deixa de ser uma boa medida, e os mecanismos psicológicos que tornam a manipulação quase inevitável assim que as pessoas sabem que estão a ser observadas.
  • 1.3 Resultados acima do produto: escolher o que medir: Como ponderar um conjunto de métricas em direção aos resultados em vez da atividade, usando a distinção clássica entre entrada/saída/resultado e o padrão da métrica-guia.
  • 1.4 Governação e propriedade das métricas: Quem decide o que é medido, quem é dono de uma definição, e como uma carta de métricas impede que um painel de controlo em crescimento se torne uma expansão descontrolada e sem responsabilização.
  • 1.5 Fontes de dados e instrumentação: De onde vêm realmente as métricas de engenharia, instrumentação versus autorrelato, e os problemas de qualidade de dados que invalidam silenciosamente um painel de controlo antes de alguém se aperceber.
  • 1.6 Literacia estatística para métricas de engenharia: O julgamento estatístico mínimo que uma equipa precisa para ler uma métrica honestamente: percentis versus médias, tamanho da amostra, regressão à média, e variáveis de confusão.

Como estes temas se inter-relacionam

Estes seis temas constroem-se numa ordem estrita. O tema 1.1 pergunta porque medir, de todo, o que importa porque uma equipa que não respondeu a isso recolherá números sobre os quais ninguém age. O tema 1.2 é o eixo em que gira o resto do livro: uma vez aceite que qualquer medida pode tornar-se um alvo e ser manipulada, todas as recomendações dos temas posteriores decorrem de desenhar contra esse risco. O tema 1.3 transforma essa cautela numa regra positiva: ponderar em direção aos resultados, porque estes são a categoria mais difícil de manipular de forma barata. O tema 1.4 torna a governação concreta, o tema 1.5 torna os dados concretos, e o tema 1.6 dá o julgamento estatístico para evitar ser enganado pelo ruído mesmo depois de a governação e a instrumentação estarem sólidas.

Tudo o que se segue depende desta parte. As métricas de fluxo e as métricas DORA da Parte 2, e a estrutura SPACE na Parte 3, são todas, na prática, exemplos trabalhados dos princípios de ponderação de resultados e de emparelhamento de salvaguardas estabelecidos nos temas 1.2 e 1.3. A orientação de desenho de painéis de controlo no tema 8.1 assume o modelo de governação do tema 1.4. E o modelo de maturidade que encerra todos os temas deste livro é, por baixo dos seus cinco níveis, um modelo de maturidade exatamente para a disciplina que esta parte introduz: medir a sério, e verificar o próprio trabalho.