Ciência ou Bruxaria?
Disciplina 03 de 14 · 8 tópicos · 62 afirmações

Psicometria

Aula em tópicos, na ordem dos capítulos de livros-texto de psicologia, e as afirmações da disciplina. Para responder e ver as explicações, jogue esta disciplina: as primeiras afirmações de cada dia são grátis.

01

Medida em psicologia e escalas

Medir é atribuir números a atributos segundo regras, e em psicologia os atributos são construtos latentes, como ansiedade ou inteligência, acessados por indicadores observáveis. As escalas de medida de Stevens definem o que os números permitem: a nominal só classifica, a ordinal ordena sem intervalos iguais, a intervalar tem intervalos iguais mas zero arbitrário, e a de razão tem zero verdadeiro. A maioria dos escores psicológicos fica entre ordinal e intervalar, o que condiciona as análises adequadas. Formatos de resposta comuns incluem escalas Likert, em que a pessoa indica o grau de concordância com afirmações, e escalas de frequência. O erro comum é tratar qualquer número como se tivesse as propriedades de uma régua.

Afirmações deste tópico

02

Construção de testes e normas

Construir um teste começa pela definição do construto e de uma tabela de especificações, seguida da redação de itens, revisão por juízes, estudo piloto e seleção dos itens que funcionam. Padronizar significa fixar instruções, materiais, tempo e correção para que todos sejam avaliados nas mesmas condições. Como um escore bruto nada diz sozinho, ele é interpretado comparando-o com um grupo de referência, a amostra normativa, que deve ser representativa da população de uso; daí surgem percentis, escores padrão e escores T. Normas envelhecem e precisam ser atualizadas. O erro comum é ler um número bruto como se tivesse significado absoluto, ou comparar alguém com normas de outra população.

Afirmações deste tópico

03

Fidedignidade e erro de medida

Fidedignidade é a consistência dos escores: quanto do resultado reflete o atributo e quanto é erro aleatório. Na teoria clássica, o escore observado é a soma do escore verdadeiro com o erro, e a fidedignidade é a proporção de variância verdadeira. Estima-se por teste-reteste, aplicando o mesmo instrumento duas vezes e correlacionando; por formas paralelas; por consistência interna, como alfa de Cronbach, que tende a subir ao acrescentar itens que medem o mesmo construto; e por concordância entre avaliadores. O erro padrão de medida traduz a fidedignidade em intervalo ao redor do escore. Duas consequências pouco intuitivas: escores extremos tendem a regredir à média na reaplicação, e a correlação entre dois testes é limitada pela precisão de cada um. Um teste fidedigno pode, ainda assim, não ser válido.

Afirmações deste tópico

04

Validade: conteúdo, critério e construto

Validade é o grau em que as evidências sustentam a interpretação pretendida dos escores; não é propriedade do teste em si, mas do uso. Evidência de conteúdo mostra que os itens cobrem o domínio de forma representativa, avaliada por juízes. Evidência de critério relaciona o teste a um desfecho externo, concorrente ou preditivo, como escores de inteligência prevendo desempenho no trabalho; correlações em torno de 0,30 são comuns e têm utilidade prática real quando as decisões envolvem muitas pessoas. Evidência de construto reúne convergência com medidas do mesmo atributo e divergência de medidas de atributos diferentes, além da estrutura interna. O erro comum é perguntar se um teste é válido sem perguntar válido para quê.

Afirmações deste tópico

05

Análise de itens, TCT e TRI

A análise de itens verifica como cada pergunta funciona. Na teoria clássica dos testes, olha-se a dificuldade, a proporção de acertos, e a discriminação, a correlação do item com o total: itens que quase todos acertam não separam as pessoas mais capazes das demais. A análise fatorial revela quantas dimensões um conjunto de itens mede e quais itens carregam em cada uma; alfa de Cronbach alto indica itens correlacionados, não unidimensionalidade, que é questão de estrutura. A teoria de resposta ao item modela a probabilidade de resposta em função do traço latente e de parâmetros do item, como dificuldade e discriminação, e permite comparar pessoas que responderam a itens diferentes. O erro comum é usar um único coeficiente como prova de qualidade.

Afirmações deste tópico

06

Testes de inteligência

Testes de inteligência nasceram com Binet para identificar crianças que precisavam de apoio escolar e evoluíram para escalas como Stanford-Binet e Wechsler, com escores padronizados de média 100 e desvio 15. Spearman observou que desempenhos em tarefas diversas se correlacionam e propôs um fator geral, g, ao lado de habilidades específicas; modelos atuais distinguem inteligência fluida e cristalizada. Os escores são bastante estáveis da adolescência à vida adulta, mas não são fixos: educação, nutrição e ambiente os alteram, e as médias populacionais subiram ao longo do século XX em muitos países, o efeito Flynn. Escores de QI preveem desempenho escolar e profissional de forma moderada. O erro comum é tratar o QI como quantidade inata e imutável.

Afirmações deste tópico

07

Testes de personalidade, projetivos e pseudotestes

Inventários de personalidade por autorrelato, como os baseados no modelo dos cinco grandes fatores, derivam de análise fatorial de descrições de pessoas em várias línguas e apresentam boa fidedignidade e validade preditiva moderada. Técnicas projetivas, como as manchas de tinta de Rorschach e o desenho da figura humana, supõem que respostas a estímulos ambíguos revelem o inconsciente; as evidências de validade para diagnóstico são fracas ou inconsistentes, salvo alguns índices específicos. Tipologias populares como o MBTI têm fidedignidade teste-reteste baixa, categorias artificiais e pouco valor para prever desempenho no trabalho. Grafologia e astrologia não têm apoio empírico. O erro comum é confundir a sensação de que o resultado descreve bem a pessoa, o efeito Barnum, com validade.

Afirmações deste tópico

08

Adaptação cultural e uso responsável

Um teste criado em outro país não pode ser apenas traduzido: adaptar exige tradução e retrotradução, revisão por especialistas, ajuste de itens que não fazem sentido na cultura de destino, estudo piloto e nova coleta de evidências de fidedignidade, validade e normas locais, porque equivalência linguística não garante equivalência de medida. Viés de item e funcionamento diferencial podem favorecer um grupo sem relação com o atributo. No Brasil, o uso profissional de testes é regulado pelo Conselho Federal de Psicologia por meio do SATEPSI, que lista os instrumentos com parecer favorável. Uso responsável inclui qualificação do aplicador, sigilo, devolutiva compreensível e decisões nunca baseadas num único escore. O erro comum é supor que uma boa tradução basta.

Afirmações deste tópico

Jogar Psicometria