O que cai na prova de Black Belt: estatística, projeto e liderança
A fase Melhorar quase dobra de peso por causa do desenho de experimentos, e um bloco de liderança que não existe no Green derruba quem só estuda estatística
A prova de Black Belt cobre o mesmo DMAIC da faixa anterior e pergunta outra coisa. Onde a de Green pede a escolha da ferramenta, a de Black pede a escolha entre modelos.
E acrescenta dois territórios que não existiam: interação entre fatores, que é o desenho de experimentos, e condução de programa, que trata de seleção de projeto, papéis e validação de ganho.
A consequência prática é que estudar mais do mesmo não prepara. Quem revisa teste de hipóteses até dominar continua despreparado para a questão que apresenta três fatores e pergunta qual desenho responde com menos corridas.
Você vai ver o peso de cada bloco, por que o DOE é o que define a faixa, os temas de regressão que mais caem, o problema das comparações múltiplas, o bloco de liderança que quase ninguém estuda, e as três portas da certificação.
Os enunciados de exemplo foram montados para este artigo, no formato das provas de certificação. São ilustrativos: mostram o raciocínio cobrado, não reproduzem questões de nenhum exame.
O que muda em relação à prova de Green Belt
A prova de Black Belt cobre o mesmo DMAIC da faixa anterior e pergunta outra coisa. Onde a de Green pede a escolha da ferramenta, a de Black pede a escolha entre modelos, e acrescenta dois territórios que não existiam: interação entre fatores e condução de programa.
A consequência prática é que estudar mais do mesmo não prepara. Quem revisa teste de hipóteses até dominar continua despreparado para as questões que apresentam três fatores e perguntam qual desenho experimental responde com menos corridas.
| Green Belt | Black Belt | |
|---|---|---|
| Pergunta típica | Qual teste usar? | Qual modelo explica melhor? |
| Número de fatores | Um por vez | Vários, com interação |
| Estatística | Comparar grupos | Modelar e prever |
| Escopo do caso | Um processo | Vários, sem dono claro |
| Tema extra | - | Liderança de projeto e programa |
A última linha é a que mais surpreende quem chega com preparo técnico forte. Uma parte relevante da prova trata de seleção de projeto, papel do patrocinador, orientação de Green Belts e cálculo de ganho validado, e essa parte não se resolve com estatística.
Os blocos e o peso
| Bloco | Peso típico | Concentra |
|---|---|---|
| Definir e seleção de projeto | 10% a 15% | Charter, critério de seleção, papéis |
| Medir | 15% a 20% | Sistema de medição, capabilidade, amostragem |
| Analisar | 30% a 35% | Regressão, ANOVA, testes múltiplos |
| Melhorar | 20% a 25% | Desenho de experimentos, otimização |
| Controlar | 10% a 15% | Controle estatístico, sustentação |
| Liderança e programa | 5% a 10% | Orientação, patrocínio, carteira |
A diferença mais visível em relação ao Green está na fase Melhorar, que quase dobra de peso. O motivo é o desenho de experimentos, que no Green aparece como noção e no Black é conteúdo central com questões de cálculo e interpretação.
A fase Analisar continua a maior, mas muda de natureza: sai da comparação entre grupos e entra em modelagem, com regressão múltipla, diagnóstico de resíduos e o problema das comparações múltiplas.
Desenho de experimentos: o bloco que define a faixa
Se há um conteúdo que separa Black de Green, é o DOE. Ele resolve uma limitação concreta do método um fator de cada vez, e a prova cobra justamente o entendimento dessa limitação.
A limitação é a interação. Quando o efeito de um fator depende do nível de outro, testar cada um isoladamente produz conclusão errada nos dois casos, e a análise parece correta em ambos. Só o experimento com os fatores variando juntos revela isso.
- Fatorial completo: todos os níveis de todos os fatores, e quantas corridas isso exige.
- Fatorial fracionado: reduzir corridas ao custo de confundir efeitos.
- Resolução do desenho: o que fica confundido com o quê em cada resolução.
- Blocagem: isolar fonte de variação que não se quer estudar.
- Replicação e aleatorização: por que as duas existem e o que cada uma protege.
A resolução do desenho é o tema mais cobrado e o menos intuitivo. Em desenho de resolução III, efeitos principais ficam confundidos com interações de dois fatores, o que torna o resultado ambíguo justamente onde o DOE deveria ajudar.
A questão típica apresenta número de fatores, número de corridas disponíveis e pergunta qual desenho cabe. Resolver isso exige conhecer a relação entre fatores, níveis e corridas, e não decorar tabela.
Regressão: modelar, não só correlacionar
O Green aprende correlação e regressão simples. O Black precisa construir modelo com várias variáveis e saber quando ele não presta.
| Tema | O que a prova cobra |
|---|---|
| Regressão múltipla | Interpretar coeficientes com outras variáveis controladas |
| Multicolinearidade | Reconhecer variáveis correlacionadas entre si e o efeito nos coeficientes |
| Análise de resíduos | Detectar violação de pressuposto pelo padrão dos resíduos |
| R² e R² ajustado | Por que acrescentar variável sempre aumenta o R² simples |
| Regressão logística | Quando a resposta é binária, como passa ou falha |
| Sobreajuste | Modelo que explica o passado e erra a previsão |
A linha do R² ajustado é armadilha frequente. Acrescentar qualquer variável, mesmo irrelevante, aumenta o R² simples, e por isso ele não serve para comparar modelos com números diferentes de variáveis.
A análise de resíduos aparece com frequência em formato visual: a questão mostra um padrão nos resíduos e pergunta qual pressuposto foi violado. Funil indica variância não constante, curva indica falta de termo não linear.
Comparações múltiplas e o erro que se acumula
Tema quase ausente no Green e presente no Black, porque ele aparece assim que se comparam mais de dois grupos.
O ponto é aritmético: cada teste tem uma chance de apontar diferença que não existe. Fazendo vinte comparações ao nível de 5%, a chance de pelo menos um falso positivo passa de 60%, e a conclusão do conjunto deixa de ser confiável.
- ANOVA primeiro: verifica se existe alguma diferença antes de procurar onde.
- Testes post hoc: Tukey e congêneres, que controlam o erro do conjunto.
- Correção de Bonferroni: simples, conservadora, e quando ela custa poder demais.
- Taxa de descoberta falsa: alternativa quando há muitas comparações.
A questão típica descreve alguém que comparou todos os pares com testes t separados e pergunta o que está errado. A resposta é a inflação do erro tipo I, e a alternativa correta indica ANOVA seguida de post hoc.
Seleção de projeto e carteira
Bloco que não existe no Green e reflete a mudança de papel: o Black Belt participa da escolha do que a empresa vai atacar, não só da execução.
| Critério | O que a prova cobra |
|---|---|
| Alinhamento estratégico | Projeto que não serve à prioridade da empresa perde patrocínio |
| Tamanho do ganho | Suficiente para justificar o custo do projeto |
| Disponibilidade de dado | Projeto sem dado vira projeto de coleta |
| Dono e alçada | Sem dono nomeado não há onde implantar |
| Duração | Projeto longo demais perde relevância |
Questões desse bloco costumam apresentar quatro projetos candidatos com atributos e pedir a priorização. A resposta raramente é o de maior ganho: é o que combina ganho relevante com viabilidade demonstrável.
Também aparece o inverso: reconhecer o projeto que deveria ser recusado. Problema com solução já decidida, ou sem dono, é caso de recusa, e saber recusar é parte do papel.
Liderança, orientação e papéis
Bloco menor em peso e frequentemente ignorado no estudo, o que o torna fonte fácil de pontos perdidos.
- Papéis: patrocinador, dono do processo, Black Belt, Green Belt, membro de time.
- Orientação: destravar projeto alheio sem assumir a execução.
- Resistência à mudança: reconhecer a causa antes de tratar o sintoma.
- Validação de ganho: quem valida, e por que não é o próprio projeto.
- Comunicação com a direção: traduzir resultado técnico em efeito de negócio.
A quarta linha cai com frequência e tem resposta contraintuitiva para quem vem da técnica: o ganho é validado por quem responde pelo número da empresa, tipicamente a controladoria, e não pelo time que o produziu.
A terceira linha costuma vir em formato de caso: descreve uma área que resiste e pergunta a melhor abordagem. A alternativa correta quase sempre envolve entender o que a área perde com a mudança, e não reforçar a comunicação.
Como distribuir o estudo
| Bloco | % da prova | % do estudo sugerido |
|---|---|---|
| Definir e seleção | 10 a 15 | 10 |
| Medir | 15 a 20 | 10 |
| Analisar | 30 a 35 | 30 |
| Melhorar (DOE) | 20 a 25 | 30 |
| Controlar | 10 a 15 | 10 |
| Liderança | 5 a 10 | 10 |
A recomendação desproporcional em DOE se justifica porque é o bloco com maior distância entre o que se sabe do Green e o que a prova pede. Ele exige prática de montar desenho, não leitura.
A recomendação de estudar liderança acima do peso se justifica por outra razão: é conteúdo de baixo custo de aprendizado, com questões que se acertam por compreensão do papel, e quem ignora perde pontos fáceis.
Medir recebe menos tempo que o peso porque o conteúdo repete o Green, com acréscimo pequeno. Vale revisar sistema de medição, que é o tema que mais volta.
Os erros que mais reprovam
- Estudar DOE só na teoria. As questões pedem escolha de desenho, que exige prática.
- Comparar modelos pelo R² simples. Ele sempre cresce ao acrescentar variável.
- Ignorar multicolinearidade. Coeficiente instável leva à leitura errada do efeito.
- Fazer testes t múltiplos. Infla o erro do conjunto, e a prova cobra isso.
- Pular o bloco de liderança. Pontos fáceis perdidos por não estudar.
- Escolher projeto pelo maior ganho. Viabilidade pesa tanto quanto tamanho.
- Confundir resolução de desenho. Resolução III confunde efeito principal com interação.
O segundo e o terceiro item aparecem juntos com frequência, numa questão que mostra um modelo com R² alto e coeficientes estranhos. A leitura correta é suspeitar de multicolinearidade, e não celebrar o ajuste.
Exemplo ilustrativo de questão por bloco
| Bloco | Enunciado resumido | O que testa |
|---|---|---|
| Analisar | R² sobe de 0,72 para 0,74 ao somar 3 variáveis | R² ajustado e sobreajuste |
| Melhorar | 4 fatores, 16 corridas disponíveis | Fatorial completo cabe; qual resolução |
| Analisar | Resíduos em funil ao longo do previsto | Variância não constante |
| Seleção | 4 projetos: maior ganho não tem dono | Viabilidade sobre tamanho |
| Liderança | Área resiste à mudança implantada | Entender o que ela perde |
A segunda linha merece a conta: quatro fatores em dois níveis exigem dezesseis corridas para o fatorial completo, então ele cabe exatamente. A alternativa que sugere fracionado está tecnicamente errada aqui, porque não há necessidade de reduzir.
A quarta linha é o padrão de questão de seleção. O projeto de maior ganho sem dono nomeado não é o correto, porque não há onde implantar, e a prova testa se o candidato reconhece isso.
Os enunciados foram montados para este artigo, no formato das provas de certificação. São ilustrativos: mostram o tipo de raciocínio cobrado, não reproduzem questões de nenhum exame.
A prova, o projeto e a banca
Na maioria dos programas, a certificação de Black Belt tem três portas, e não duas.
- A prova, que verifica repertório técnico e escolha de modelo.
- O projeto, com ganho validado por quem responde pelo número da empresa.
- A banca, onde se defende o projeto diante de avaliadores.
A banca é a parte que mais surpreende. Ela não repete a prova: pergunta por que você escolheu aquele caminho, o que descartou, e o que faria diferente. Projeto conduzido de verdade responde isso naturalmente.
É também onde o projeto de gaveta cai. Quem escreveu o DMAIC de trás para frente não tem resposta para "qual hipótese você abandonou no meio", porque não abandonou nenhuma.
Quanto tempo de preparação
Para quem conduz o projeto em paralelo ao curso, a preparação específica para a prova costuma pedir de quatro a oito semanas, mais que o dobro do Green.
A diferença está concentrada em DOE e regressão, que exigem prática com software estatístico. Ler sobre desenho fatorial e montar um desenho fatorial são atividades distintas, e só a segunda prepara.
O indicador de prontidão continua o mesmo do Green e vale ainda mais aqui: conseguir explicar por que as alternativas erradas estão erradas. Numa prova que pede escolha entre modelos, saber o que descarta cada um é o próprio conteúdo.
