COMO MEDIMOS
Metodologia do AI-Readiness Score
O instrumento inteiro, publicado. Seis dimensões, pesos declarados, quatro níveis com cortes fixos e uma regra explícita para derivar gargalos.
atualizado em
O que o score mede
O AI-Readiness Score mede uma coisa só: o quanto a sua engenharia está legível para uma máquina. Não mede talento do time, qualidade de código nem maturidade de produto. Mede se o contexto, as regras, as decisões e os critérios que um agente precisa ler existem, e onde eles estão.
É um instrumento de triagem, não uma auditoria. Um score alto não garante que a IA vá funcionar; um score baixo garante que ela não vai render de forma estrutural.
As seis perguntas
[1/6]quantos desenvolvedores tem seu time de engenharia?
número · vale 0 ponto — serve de contexto para estimar o impacto do gap
[2/6]suas regras arquiteturais estão versionadas dentro do repositório?
sim = 25 pt · parcialmente = 12 pt · não = 0 pt
[3/6]quanto tempo leva de um dev novo entrar até o primeiro PR em produção?
menos de 1 semana = 20 pt · 1 a 2 semanas = 13 pt · 3 a 4 semanas = 6 pt · mais de 1 mês = 0 pt
[4/6]que porcentagem dos seus PRs passa por revisão automatizada hoje?
número de 0 a 100 · pontuação = arredondar(percentual ÷ 5), teto de 20 pontos
[5/6]suas decisões arquiteturais estão registradas em algum lugar que uma IA consiga ler?
sim = 20 pt · parcialmente = 10 pt · não = 0 pt
[6/6]a documentação técnica vive dentro ou fora do repositório?
dentro do repositório = 15 pt · metade dentro, metade fora = 7 pt · fora do repositório = 0 pt
Pesos por dimensão
| DIMENSÃO | PESO | POR QUE ESSE PESO |
|---|---|---|
| Regras arquiteturais versionadas | 25 | É o contrato que todos os outros artefatos pressupõem. Sem ele, o resto não tem onde se apoiar. |
| Tempo até o primeiro PR | 20 | Mede se o conhecimento do sistema é legível ou transmitido — o melhor proxy de legibilidade que existe. |
| Cobertura de revisão automatizada | 20 | Mede se existe critério executável, e não só intenção. |
| Decisões registradas de forma legível | 20 | Contexto histórico é o que impede a IA de refazer decisões já tomadas. |
| Localização da documentação técnica | 15 | Peso menor porque documentação sem contrato ajuda pouco; com contrato, compõe. |
| Total | 100 | O tamanho do time não pontua: entra apenas como contexto para estimar impacto. |
Os quatro níveis
Como os gargalos são derivados
Uma dimensão vira gargalo quando o aproveitamento fica abaixo de 70% do peso dela. Os gargalos são ordenados do pior aproveitamento para o melhor, e o relatório mostra no máximo 3.
A regra existe para impedir o erro mais comum de diagnóstico automatizado: apontar como problema algo que o próprio respondente acabou de dizer que está resolvido. Se todas as dimensões passam do corte, o relatório diz isso — e sugere o passo seguinte em vez de inventar um gargalo.
Estimativa de impacto
Quando o número de desenvolvedores é informado, o relatório estima o custo do gap em dev-semanas por trimestre:
impacto = arredondar(devs × (100 − score) × 0,012)
É uma ordem de grandeza para conversa executiva, não uma medição. O coeficiente vem da proporção observada entre retrabalho de reconciliação e distância do score máximo, e será revisado quando a base de diagnósticos permitir uma estimativa empírica — o que ainda não é o caso.
Limitações que você precisa saber
- É autodeclarado. Nenhum repositório é lido; o score reflete o que o respondente informou.
- Não substitui auditoria técnica. Um diagnóstico completo lê o repositório e as métricas de CI/CD.
- A estimativa de impacto é ordem de grandeza, não medição.
- O instrumento foi calibrado para times de 20 a 300 desenvolvedores com múltiplas squads.
- Mudanças de peso ou de corte serão registradas nesta página, com a data.
Dados, anonimização e retenção
As respostas ficam no seu navegador enquanto você responde. Nada é gravado até o envio explícito do e-mail. Se você baixar o AI-READINESS.md e fechar a página, nenhum registro é criado.
Quando o e-mail é enviado, gravamos as respostas, o score e o nível. Respostas podem compor análises agregadas e anonimizadas — sem identificador de empresa ou pessoa, e somente com amostra suficiente para que nenhuma organização seja inferível. O tratamento completo está na política de privacidade.
Sobre os números dos cenários
As páginas de cenários são demonstrações do método e dizem isso explicitamente. Elas não representam clientes específicos e os indicadores não constituem medição agregada de base instalada. Quando houver clientes com autorização para publicação, cada indicador virá com baseline, janela de comparação, amostra e fórmula — nesta mesma página.
