Ameaça do estereótipo: o que as provas mostram realmente
A ameaça do estereótipo é a ideia de que alguém rende abaixo do próprio nível num teste difícil quando tem em mente um estereótipo negativo sobre o seu grupo — e as provas que a sustentam são reais, contestadas e muito mais magras do que a notoriedade do conceito. Em condições próximas de um exame real, o efeito agregado ronda um sétimo de desvio-padrão, as meta-análises encontram sinais claros de enviesamento de publicação e uma ampla replicação pré-registada não encontrou nada.
De onde vem a ideia
Em 1995, Claude Steele e Joshua Aronson publicaram uma série de experiências no Journal of Personality and Social Psychology. A proposta: onde um estereótipo negativo sobre o seu grupo possa ser aplicado a si, sabê-lo torna-se uma carga adicional — e é a carga, não a capacidade, que puxa o desempenho para baixo num teste difícil. A explicação é situacional, isto é, aponta para algo modificável em vez de apontar para quem é avaliado, e não exige acreditar no estereótipo: basta saber que existe.
A afirmação que o estudo original nunca fez
Em 2004, Paul Sackett, Chaitra Hardison e Michael Cullen registaram na American Psychologist que o trabalho de 1995 é amplamente mal interpretado, em publicações de divulgação e académicas, como se eliminar a ameaça do estereótipo eliminasse a diferença de desempenho entre estudantes afro-americanos e brancos. Não era isso que mostrava. As pontuações tinham sido ajustadas estatisticamente pelo desempenho anterior no SAT, pelo que o achado real foi: sem a ameaça, os dois grupos diferiam na medida que as pontuações anteriores faziam prever. Os autores advertiram explicitamente contra ler a experiência como prova de que a ameaça do estereótipo seja a causa principal dessas diferenças.
O que encontram as meta-análises
Nguyen e Ryan chegaram em 2008 a um efeito médio de 0,26, com moderadores tão fortes que as condições pesam tanto como o fenómeno. Stoet e Geary reviram em 2012 as tentativas de replicação da conhecida experiência sobre mulheres e matemática: dos trabalhos que poderiam ter replicado, 55 % fizeram-no, metade deles confundidos por ajuste estatístico de notas anteriores de matemática — entre as experiências não confundidas replicaram 30 %.
Flore e Wicherts agregaram em 2015 quarenta e sete dimensões de efeito em estudos com alunas: média de −0,22, significativamente diferente de zero, mas com vários sinais de enviesamento de publicação que, no seu entender, poderia distorcer seriamente a literatura. Pediram uma grande replicação; três anos depois, Flore, Mulder e Wicherts realizaram-na como registered report, com desenho e análise fixados e avaliados antes de os dados existirem. Entre 2064 alunos neerlandeses de 13 e 14 anos não surgiu nem efeito geral nem qualquer dos efeitos moderados previstos pela teoria.
Para exames reais, a referência é Shewach, Sackett e Quint (2019), que isolaram os estudos com condições semelhantes às de uma situação de exame e aí encontraram d = −0,14 em 45 amostras e 3532 pessoas; em contextos selectivos efectivos, os valores iam de zero a −0,14. A conclusão para provas de acesso e selecção: o efeito vai de desprezável a pequeno.
O que daqui não decorre
Não decorre que o fenómeno seja inventado. O efeito de laboratório foi produzido muitas vezes, e a ansiedade de exame é real; uma média fraca numa meta-análise nada diz sobre o que vive uma pessoa concreta.
E nada decorre quanto às razões por que os grupos diferem em média nos testes. Convém dizê-lo com clareza, porque o estado das replicações é por vezes citado como se resolvesse aquela pergunta noutra direcção. Não resolve: que uma explicação proposta seja mais frágil do que se anunciou não é prova a favor de nenhuma explicação concorrente. Esta página não toma posição a esse respeito, e nada nela deve ser lido nesse sentido.
O que muda para a sua pontuação
A lição prática é mais estreita do que a teoria e mais útil. Um teste de raciocínio mede como rendeu num momento e nas condições desse momento: cansaço, um quarto ruidoso, um telefone a tocar, um formato desconhecido e a simples tensão deslocam o resultado. Por isso um número isolado é uma estimativa com margem, explicada em quão precisos são os testes de QI, enquanto o alvo da medida está em como funcionam os testes de QI.
O padrão repete-se na psicologia: um resultado marcante ganha um nome memorável, o nome viaja muito para além das provas e a versão cautelosa chega anos depois com bem menos atenção. Vale também para a mentalidade de crescimento, e os hábitos de pensamento que fazem uma afirmação parecer mais certa do que é estão em viés cognitivo.
Âmbito desta página
Esta página é informativa. Resume investigação publicada, incluindo os pontos em que se contradiz, e não constitui aconselhamento psicológico, médico ou educativo.
O nosso teste de QI mede desempenho em raciocínio nas condições em que é realizado. Não mede a ameaça do estereótipo, não é um instrumento de diagnóstico e de nenhum resultado se pode deduzir por que razão uma pessoa ou um grupo pontuou como pontuou.
A IQ Revealed não está afiliada nem é apoiada pela American Psychological Association, pela Society for the Study of School Psychology, pela Elsevier, pela Taylor & Francis, pelo College Board, pela Google nem por qualquer das revistas, editoras, instituições ou investigadoras e investigadores citados nesta página. São nomeados para que cada afirmação possa ser seguida até ao trabalho de onde vem.
Perguntas frequentes sobre a ameaça do estereótipo
O que é a ameaça do estereótipo?
É a ideia de que alguém pode render abaixo do seu nível habitual numa tarefa difícil quando conhece um estereótipo negativo sobre um grupo a que pertence e receia que o seu desempenho o confirme. Claude Steele e Joshua Aronson introduziram o termo em 1995. Descreve uma situação e não um traço: a mesma pessoa está exposta num contexto e não noutro.
A ameaça do estereótipo foi refutada?
Nem refutada nem consolidada. O efeito de laboratório foi reproduzido muitas vezes e, ao mesmo tempo, as provas são bastante mais frágeis do que a notoriedade do conceito sugere: as meta-análises encontram sinais sérios de enviesamento de publicação, uma ampla replicação pré-registada não encontrou qualquer efeito e, em condições próximas de um exame real, o efeito agregado desce para cerca de um sétimo de desvio-padrão.
Steele e Aronson mostraram que explica diferenças entre grupos?
Não, e é o equívoco mais difundido sobre o estudo. Sackett, Hardison e Cullen documentaram em 2004 na American Psychologist que os resultados de 1995 são amplamente apresentados, tanto na divulgação como na literatura académica, como se eliminar a ameaça eliminasse a diferença de desempenho. No estudo, as pontuações tinham sido ajustadas estatisticamente pelos resultados anteriores do SAT: sem a ameaça, portanto, os grupos diferiam exactamente na medida que esses resultados anteriores faziam prever.
Significa que a minha pontuação de QI está errada?
É uma das razões pelas quais uma pontuação isolada é uma estimativa e não um veredicto, e não a principal. Qualquer teste de raciocínio mede um desempenho num momento, e circunstâncias comuns deslocam-no: cansaço, doença, tensão, interrupções, um formato desconhecido. Não decorre que as pontuações nada signifiquem, mas que têm margem de erro.
Nas suas próprias condições
O nosso teste de QI é gratuito e demora cerca de 25 minutos. O relatório completo — pontuação, percentil e resultado por área de raciocínio — faz parte da subscrição.
Começar o teste de QI