Jurimetria
Como cada número é calculado, com que incerteza e quais são os limites declarados.
Princípios
- Nenhum número sem incerteza. Toda taxa vem com intervalo de confiança 95% (Wilson) ou com gate de amostra.
- Denominador honesto. Só entram decisões classificadas; documento sem dispositivo reconhecível é não-classificado e reportado como cobertura.
- Recência declarada. Decisões antigas pesam menos (decaimento exponencial por área) e o n efetivo (Kish) reflete isso.
- Reprodutibilidade. Fórmulas fechadas e testes determinísticos (Monte Carlo com seed).
Pipeline
pipeline
~62M julgados (Elasticsearch)
├─ escopo: fonte / tribunal / turma / relator / período (+ busca textual)
├─ classificação de dispositivo (match_phrase, mutuamente exclusiva)
│ ├─ 2ª instância: PROVIDO | PARCIAL | NÃO PROVIDO | NÃO CONHECIDO
│ ├─ 1ª instância: PROCEDENTE | PARCIAL | IMPROCEDENTE | ACORDO | EXTINTO
│ └─ busca temática (modo mérito): direcional para ~95 temas
├─ taxa = favoráveis ÷ classificados (nunca ÷ total bruto)
└─ IC 95% = Wilson (ponderado por recência quando há série temporal)Métricas por endpoint
| Endpoint | Métrica | Método |
|---|---|---|
/panorama | taxa_geral, por turma, relator e ano | Contagens por categoria de resultado; _meta com n e confiança |
/previsao | taxa + intervalo_confianca | Wilson 95% (z = 1,96) |
/previsao-temporal | taxa_ponderada, n_efetivo, cobertura | Peso 2^(−idade/meia-vida); IC Wilson com n efetivo de Kish |
/predicao | probabilidade + fatores | Logito da taxa-base + desvios de turma/relator + tendência, clamp [0,001; 0,999] |
/divergencia | chi2, p_value, significativo | Qui-quadrado de independência entre turmas (α = 0,05) |
/evolucao | periodos, media_movel | Histograma trimestral; média móvel de 4 trimestres |
/mudanca | mudancas, p_value | CUSUM + Welch t-test entre janelas |
/breakpoints | breakpoints, tendencia_atual | CUSUM ou bayesiano; variação 12 m (limiar ±2 pp) |
/rigor | ranking, indice_rigor | Bayes empírico: shrinkage Beta com 20 pseudo-decisões; z-score vs. pares |
/radar | radar por eixo | (taxa_juiz − média)/σ por eixo temático, clamp ±3; gates n ≥ 5/tema, ≥ 10/eixo |
/taxa-reforma | taxa_reforma, comparativo_instancias | Alinhamento só quando ICs 95% se cruzam (n ≥ 30 em ambos) |
/argumentos, /dna | termos e scores | log2 odds ratio favorável/desfavorável; significant_text do Elasticsearch |
/tempo-tramitacao | média, mediana, p10–p95 | Diferença entre data de julgamento e publicação; agregações por turma/ano |
Intervalo de Wilson e n efetivo
fórmulas
center = (p + z²/2n) / (1 + z²/n)
margin = (z / (1 + z²/n)) · √( p(1−p)/n + z²/4n² ) z = 1,96
Série ponderada por recência:
w_i = exp(−ln2 · idade_i / meia_vida)
p̂ = Σ w_i·favorável_i / Σ w_i
n_efetivo = (Σ w_i)² / Σ w_i² [Kish 1965]Validação: Monte Carlo com 10.000 tentativas × 7 cenários (p de 0,02 a 0,9; n de 5 a 400) — cobertura empírica 93–96% (nominal 95%).
Meias-vidas por área
Área (area=) | Meia-vida |
|---|---|
| trabalhista | 3 anos |
| consumidor | 4 anos |
| tributario, administrativo, familia, padrão | 5 anos |
| penal | 6 anos |
| civil / civel | 7 anos |
| constitucional | 10 anos |
Índice de rigor (Bayes empírico)
fórmula
taxa_bayes = (fav + α₀) / (total + 20), α₀ = 20 · média_tribunal
z = (taxa_bayes_juiz − média_pares) / σ_pares
≤ −2σ muito rigoroso · ≤ −1σ rigoroso · ≥ +1σ leniente · ≥ +2σ muito leniente
gates: < 3 juízes → sem ranking; σ ≈ 0 → todos neutrosQualidade da amostra (_meta)
| n classificados | confianca | Leitura |
|---|---|---|
| ≥ 100 | alta | Amostra robusta |
| 30–99 | media | Adequada para inferência |
| 10–29 | baixa | Interpretar com cautela |
| < 10 | insuficiente | Não conclua tendência |
Limites declarados
- A classificação de dispositivo é lexical (frases no dispositivo/ementa); decisões parciais entram no denominador como convenção conservadora.
- Meias-vidas calibradas na literatura (Black & Spriggs 2013); calibração com dados brasileiros é trabalho futuro.
- Kish assume pesos não correlacionados ao desfecho; o decaimento é uma escolha normativa de recência.
- Um acórdão com dispositivos contraditórios entre recursos é contado como um único documento.
- Cobertura varia por tema/fonte (ex.: ~9% dos docs de “dano moral” no TST têm dispositivo classificável): confira
coberturae_meta.
Estatísticas descrevem decisões passadas. Não constituem aconselhamento jurídico nem garantia de resultado. Referências: Wilson (1927); Kish (1965); Efron & Morris (1975); Black & Spriggs (2013).