Como sustentar uma afirmação com dados, sem fórmula matemática e sem ferramenta.
Uma empresa de tecnologia viu o turnover subir de 8 por cento para 22 por cento em doze meses e contratou uma consultoria de ciência de dados por R$ 400 mil. O modelo entregue acertava 95 por cento das saídas com quinze dias de antecedência, e a diretoria montou um painel semanal com os dez colaboradores de maior risco. Seis meses depois a acurácia estava em 94 por cento e o turnover continuava em 22 por cento. Nenhuma demissão foi evitada, o projeto foi descontinuado e a diretoria de RH foi quase toda substituída. O modelo estava certo. A pergunta é que estava errada, porque a empresa encomendou previsão quando precisava de inferência causal, e saber o nome de quem vai sair não muda o motivo pelo qual a pessoa decidiu sair.
O padrão se repete em escalas diferentes. Um órgão público passou oito meses construindo um chatbot com tecnologia impecável para reduzir uma fila, e a fila ficou igual, porque a causa era a linguagem do formulário e não a ausência do chatbot. Uma secretaria comparou 200 gerentes que se voluntariaram para um treinamento com 800 que não se voluntariaram, encontrou 40 por cento mais projetos entregues no prazo e pediu R$ 5 milhões para tornar o programa obrigatório, sem notar que voluntários já eram diferentes antes da primeira aula. Um RH comparou quem baixou um aplicativo de meditação com quem não baixou, mediu produtividade por duas perguntas lado a lado no mesmo formulário e pediu R$ 10 milhões para expandir da sede administrativa para a fábrica e o call center.
Em todos esses casos a execução técnica estava correta e a estrutura da prova não estava. A dor que este curso ataca não é falta de ferramenta nem falta de dado. É a distância entre operar software e sustentar uma afirmação diante de alguém que vai perguntar como você sabe disso. Quem passa por isso costuma descobrir o erro tarde, quando o dinheiro já foi gasto, e descobre por um resultado que não se sustenta, nunca por um erro de conta.
O curso trata análise de dados como raciocínio lógico antes de matemática. São sete aulas, quase todas seguidas de um caso prático e da discussão desse caso, percorrendo uma sequência única: definir o problema com tensão e dor quantificada, descer do conceito abstrato até a coluna da planilha pela pirâmide de Goertz, decidir regra de agregação e origem dos pesos, subir a escada da estatística até o degrau causal, abrir o mecanismo entre causa e resultado, auditar o próprio desenho pelas caixas de Libby e pelas três validades, nomear os vieses que ameaçam a conclusão e ler p-valor, tamanho de efeito e intervalo de confiança. Os casos são reanalisados até o veredito, e o entregável de referência é um memorando de no máximo cinco páginas com cinco pilares, no lugar do relatório de cinquenta.
O que o curso deliberadamente não faz é ensinar ferramenta. Não há Python, R, SQL, Excel avançado nem Power BI. Não se pede que o aluno calcule d de Cohen ou p-valor, apenas que saiba lê-los e decidir com eles. Também ficam de fora a construção de modelos preditivos, a colocação em produção e a gestão do ciclo de vida de modelos, que são etapas posteriores à que o curso trata. A escolha é deliberada e os próprios casos a justificam: todos falharam com ferramenta correta, dado abundante e execução impecável, e nenhuma linha de código teria salvado nenhum deles.
Não é para: Não é para quem procura treinamento em ferramenta, quer aprender Python, SQL ou Power BI, ou precisa construir e colocar modelos em produção, porque o curso não toca em código nem em modelagem.
O peso não é opinião. Ele vem da proporção de famílias de itens que o banco dedica a cada domínio, e a prova é montada por ele.
Separa tema de problema investigável e monta o par o quê e por quê, uma tensão entre o esperado e o observado somada a uma dor quantificada em receita, custo, tempo ou pessoas afetadas. Distingue sintoma de causa raiz pela imagem do iceberg e nomeia o erro tipo 3, que é acertar o centro do alvo errado. Trata os três parágrafos do desenho de pesquisa como condição para o projeto existir.
Ataca: Viés de ação, ilusão da resposta certa e a definição de problema como falta de X, que embute a solução antes de qualquer análise.
Percorre a pirâmide de Gary Goertz, do conceito básico às dimensões, o que é e o que não é, até o indicador, que é a coluna da planilha. A etapa das dimensões nunca pode ser pulada, porque é ela que muda o indicador escolhido. Quem define a dimensão é a área dona do conceito, não quem domina a base nem quem vende a ferramenta.
Ataca: Palavras fantasmas como cultura, inovação e sustentabilidade, o índice Frankenstein e o indicador escolhido antes de o conceito estar definido.
Trata a agregação como a armadilha principal dos índices e separa dimensão necessária de dimensão substituível. Apresenta a regra do valor mínimo e a da multiplicação contra a média, e a separação entre mínimo requerido, esperado e excepcional. Mostra quando deixar a variância estatística definir o peso em vez do comitê.
Ataca: Pesos de cartola, a média como mentira estatística e a Lei de Goodhart, com o drible gerencial que ela produz.
Organiza a estatística em três degraus, o descritivo que é a fotografia, o inferencial que é a colher de arroz e o causal que é a máquina do tempo. Define contrafactual, grupo controle, aleatorização, teste A/B e a lista de espera sorteada como desenho viável quando a demanda excede a capacidade de atendimento. Mostra por que voluntário só se compara com voluntário.
Ataca: O crime causal de pular degraus e ler correlação como causa, e o grupo controle falso formado por quem simplesmente não aderiu.
Insere o mecanismo entre causa e resultado e ensina o rastreamento de processo elo a elo. O mecanismo é o que diz se uma solução alternativa mais barata funcionaria e o que não pode ser destruído ao escalar. Cada elo precisa ser mensurável, inclusive por pesquisa aplicada durante o projeto.
Ataca: Saber que funcionou sem saber como funcionou, e escalar preservando a forma da intervenção enquanto se elimina o elo que produzia o efeito.
Usa as caixas de Libby para ligar mundo conceitual e mundo operacional e separar validade de construto, nas setas verticais, validade interna, na seta horizontal, e validade externa, na extrapolação. Trata o red teaming do próprio projeto como etapa obrigatória antes da execução. A regra é desenhar a análise antes de fazer a análise, porque errar na prancheta custa mil vezes menos.
Ataca: Executar antes de desenhar, e trocar o corte, o período ou a métrica depois de ver o resultado até que a diferença apareça.
Cobre viés de sobrevivência, viés de variável omitida ou fator Z, causalidade reversa e viés de método comum, mais viés de seleção, desejabilidade social e pergunta enviesada. Cada viés vem com o caso que o torna visível, do avião de Abraham Wald ao vale academia e à pesquisa 360 graus. O entregável é a matriz de mitigação, que separa o que se resolve com os dados existentes do que exige nova coleta.
Ataca: Tratar o viés como detalhe técnico e não como ameaça à decisão, e confiar que a leitura automática de um relatório vai apontá-los.
Separa significância estatística de relevância prática, com a hipótese nula como presunção de inocência e o p-valor como nível de surpresa. Apresenta o d de Cohen e a régua 0,2, 0,5 e 0,8, o intervalo de confiança lido pelos extremos e o poder estatístico decidido antes da coleta. Fecha no memorando de cinco páginas como entregável da análise.
Ataca: Comemorar p-valor sem olhar tamanho de efeito, gerenciar pela média do intervalo e decidir o efeito mínimo aceitável depois de ver os dados.
Todas as aulas são gratuitas e abertas no YouTube. A carga horária declarada soma o tempo de vídeo mais o tempo de prática e leitura sugerido por aula.
| Nível | O que a pessoa faz | Cargo típico |
|---|---|---|
| Leitura crítica | Lê um relatório de terceiro e nomeia o degrau da estatística em que ele se apoia, a validade ameaçada e o viés presente, sabendo qual evidência exigir antes de aprovar. | Diretoria, gerência, conselho e comitês, auditoria interna, controladoria |
| Especificação do problema | Converte um tema vago em problema investigável com tensão e dor quantificada, no formato que sustenta pedido de recurso e prioridade. | Business analyst, consultor de gestão, product manager, analista de políticas públicas |
| Construção de medida | Desce do conceito ao indicador sem pular a etapa das dimensões, define pesos por critério defensável e reconhece um índice não auditável. | Analista de BI, People Analytics, ESG e sustentabilidade, risco, compliance, rating e crédito |
| Desenho e auditoria de evidência | Monta contrafactual legítimo, rastreia o mecanismo, aplica red teaming ao próprio desenho e lê o resultado sob incerteza para traduzi-lo em decisão. | Data analyst, avaliação de programas, monitoramento e avaliação, pesquisa de mercado, growth |
A correspondência com cargos é descritiva. Ela ajuda a situar o escopo e não é promessa de emprego nem de promoção.
Este é um curso livre. Não é pós-graduação, não é extensão universitária regulada, não confere título acadêmico nem registro profissional e não substitui formação regulada de nenhum tipo. A carga declarada é de oito horas, somando 4h36 de vídeo em dezenove aulas mais prática e leitura. Para dar ordem de grandeza, o mínimo regulatório de uma especialização lato sensu no Brasil é de 360 horas, e um MBA executivo costuma passar disso. Em tempo, portanto, o que está aqui equivale a um módulo curto dentro de uma formação longa, e não a uma formação.
Em escopo, o mapa mais próximo é o corpo de conhecimento em sete domínios usado pelo exame Certified Analytics Professional, do INFORMS. O Nível 1 cobre integralmente os dois primeiros, enquadramento do problema de negócio e enquadramento do problema analítico, toca parcialmente o domínio de dados, que é desenvolvido no Nível 2 junto com a seleção de metodologia, e deixa inteiramente de fora construção de modelo, colocação em produção e gestão do ciclo de vida de modelos. Isso é um mapeamento descritivo de conteúdo, feito por nós, e não afirma vínculo, endosso, equivalência nem preparação formal para aquele exame. O mapeamento é publicado justamente para que a lacuna fique visível. Do mesmo modo, a matriz de capacidade acima descreve competências exigidas nas funções citadas e não promete colocação nem progressão.
O desenho vem da metodologia de pesquisa social aplicada, não da estatística computacional. A espinha é a escada conceitual de Gary Goertz, que separa conceito básico, dimensões e indicadores e trata o trabalho conceitual como anterior à medida, com a regra de que a etapa das dimensões nunca se pula. Sobre ela entram as caixas de Libby, o diagrama proposto em 2002 por Robert Libby, Robert Bloomfield e Mark Nelson para ensinar doutorandos a desenhar experimentos, que separa mundo conceitual de mundo operacional e organiza as três validades, construto nas setas verticais, interna na horizontal e externa na extrapolação. O terceiro pilar é a tradição do contrafactual e da avaliação de impacto, com grupo controle, aleatorização e lista de espera, somada ao rastreamento de processo, que abre o mecanismo entre causa e resultado em vez de tratar a intervenção como caixa preta.
A leitura final do número segue Jacob Cohen, de quem vêm o tamanho de efeito, a régua 0,2, 0,5 e 0,8 e a exigência de calcular poder estatístico antes da coleta, e não depois de o resultado sair não significante. A crítica do indicador que vira meta é a Lei de Goodhart, e o drible gerencial é a sua consequência prática. O viés de sobrevivência é ensinado pelo trabalho de Abraham Wald sobre onde blindar aviões na Segunda Guerra, feito a partir dos que voltavam. O curso não pede que o aluno derive nenhum desses resultados. Pede que reconheça quando cada um se aplica e o que muda na decisão, e é por isso que as aulas vêm em trio, exposição, caso e discussão do caso.
20 questões · 75 minutos · proficiência a partir de 0,60, excelência a partir de 0,80
A prova tem 20 itens de múltipla escolha e 60 minutos, sorteados de um banco com 82 famílias de itens e 246 variantes. Cada família tem três variantes isomórficas ambientadas em setores diferentes, de modo que duas pessoas recebem a mesma exigência cognitiva em contextos distintos. Dez famílias funcionam como âncoras e se repetem entre as formas para permitir comparação psicométrica, e o restante rotaciona. Toda alternativa errada carrega um equívoco nomeado, o mesmo que aparece na coluna de equívocos de cada domínio, e o peso de cada domínio na prova segue a proporção de famílias rotativas do banco, que vai de 8,3 por cento em Leitura do número a 15,3 por cento em Arquitetura do problema.
O certificado é gratuito, registra a carga horária de oito horas e a banda alcançada, e traz código de validação verificável.
As notas de corte estão padronizadas em 0,60 para proficiência e 0,80 para excelência, iguais nos três exames. Elas são provisórias, e a página de validação sempre diz qual método produziu o número em vigor.
As condições de leitura são escolha do candidato e não pedem justificativa. Qualquer pessoa pode fazer a prova com 60, 75, 90 ou 120 minutos, aumentar a letra, abrir o espaço entre linhas, esconder o relógio, ler qualquer artefato como texto em vez de imagem, e pausar por até sete minutos com o relógio parado. Não perguntamos o motivo e não registramos nenhum.
Metodologia completa, notas de corte e desempenho de modelos de linguagem
| Se você é | Ordem | Por quê |
|---|---|---|
| Quem precisa aprovar ou vetar um projeto nesta semana | Vídeos 1 a 5, depois 15, 16 e 17, depois 18 | Entrega primeiro a definição do problema e o roteiro de crítica de relatório, que são as duas peças usadas na reunião de aprovação. |
| Quem vai construir ou revisar um indicador ou índice | Vídeos 3 a 9, depois 14 e 15 | Concentra a descida do conceito ao dado e a decisão de pesos e agregação antes de passar à auditoria do desenho. |
| Quem vai avaliar um piloto ou um programa | Vídeos 3, 4 e 5, depois 10 a 13, depois 18 | Junta a definição do problema com contrafactual, mecanismo e leitura do resultado, que é a cadeia inteira de uma avaliação. |
| Quem quer a formação completa | Vídeos 1 a 19, na ordem | As aulas são cumulativas e cada caso prático reaproveita o vocabulário construído nas anteriores. |
O seguinte é o Nível 2, A Engenharia de Evidências. O Nível 1 ensina a desenhar e auditar a prova quando ainda dá para sortear ou quando dá para recusar o projeto. O Nível 2 pega o caso em que não dá: entra em governança semântica, engenharia de proxies, arqueologia do dado faltante, PCA e análise fatorial para validar construto, e nos métodos de identificação que constroem o contrafactual sem sorteio, descontinuidade, pareamento, diferenças em diferenças, controle sintético e imputação estrutural, terminando na governança contratual da evidência, que é como escrever um termo de referência que o fornecedor não consegue driblar. Seis das dez âncoras do Nível 1 aparecem no Nível 2 sem pontuar, justamente porque muita gente chega lá sem ter feito este curso.
O Estúdio 68 tem duas frentes. Esta página é do programa gravado, assíncrono, de acesso aberto e gratuito, que você faz no seu ritmo e cuja avaliação é online.
O programa ao vivo é síncrono, em turmas, e cobre o mesmo terreno com mais tempo e mais profundidade: discussão de caso com a turma, revisão do trabalho de cada participante e adaptação ao contexto de quem está na sala, coisas que a gravação não faz. Ele tem vagas reservadas a grupos minorizados. O certificado das duas frentes é distinto, e cada um diz o que foi feito.
A Micah 6 AI é a consultoria que mantém o Estúdio 68. Ela atende empresas em projetos de evidência e de IA, e não participa da avaliação nem da emissão de certificado. micah6ai.com