Escala Likert: a régua de 90 anos que quase todo mundo usa errado

Tempo de Leitura: 5 minutos

"Concordo totalmente" que você já respondeu uma escala Likert, mas montar uma boa é outra história.

Nas Lojas Andorinha

O RH das Lojas Andorinha, rede de moda com trinta lojas, lançou sua primeira pesquisa de clima com orgulho e uma escala desenhada em casa: quatro pontos, "para forçar posição", com os rótulos "ruim", "bom", "muito bom" e "excepcional". O resultado saiu cor-de-rosa: 91% do time entre "bom" e "excepcional", slide comemorativo pronto.

A analista de dados da rede leu a escala antes de ler o resultado, e pediu para segurarem o slide. Três opções positivas contra uma negativa; nenhum meio honesto para quem estava "nem bem, nem mal"; e o degrau entre "ruim" e "bom" engolindo, num salto só, todo mundo que estava apenas insatisfeito, sem estar revoltado. A pesquisa não tinha medido o clima da rede. Tinha medido o clima da régua, e a régua nascera sorridente.

A escala Likert: o problema que um psicólogo resolveu em 1932

Como se mede uma opinião? Um termômetro mede temperatura, uma balança mede peso, mas não existe aparelho que se aponte para uma pessoa e leia "satisfação: 7,3".

Em 1932, o psicólogo americano Rensis Likert propôs, em sua tese de doutorado, uma solução tão simples que parece óbvia hoje: apresentar uma afirmação e pedir que a pessoa marque seu grau de concordância numa régua simétrica:

"O atendimento da loja resolve meus problemas rapidamente."
( ) Discordo totalmente ( ) Discordo ( ) Neutro ( ) Concordo ( ) Concordo totalmente

Noventa anos depois, a escala Likert é o instrumento mais usado da pesquisa de opinião mundial, e um dos mais maltratados. Este artigo ensina a montar uma corretamente e a ler os resultados sem se enganar.

A anatomia de uma Likert bem-feita

1. É uma afirmação, não uma pergunta.
A escala mede reação a uma frase. "Como você avalia o atendimento?" com opções de "péssimo" a "ótimo" é uma escala de avaliação (rating): legítima, mas não é Likert. A distinção importa menos pelo nome e mais pela disciplina: a afirmação precisa ser clara, única e afirmável, e todas as regras de uma boa pergunta valem em dobro aqui. Afirmação dupla ("o atendimento é rápido e cordial") quebra a escala inteira.

2. Simetria: o mesmo número de degraus para cada lado.
Duas opções positivas e duas negativas, com o neutro no centro. A pesquisa metodológica (resumida por Jon Krosnick, de Stanford, um dos maiores estudiosos de questionários) mostra que escalas desequilibradas empurram a resposta, e produzem aquele resultado suspeito de "94% de aprovação".

3. Todos os pontos rotulados.
Krosnick e Fabrigar também documentaram que escalas com rótulos verbais em todos os pontos (e não só nas pontas) são mais confiáveis: as pessoas interpretam os degraus de forma mais parecida entre si. Números soltos (1 a 5, sem palavras) deixam cada respondente inventar sua própria régua.

4. Cinco ou sete pontos, e pronto.
Décadas de estudos convergem: abaixo de 5 pontos perde-se sensibilidade; acima de 7, as pessoas não distinguem os degraus ("concordo moderadamente" vs. "concordo consideravelmente"?) e a qualidade não melhora. No contexto de coleta no ponto de venda (respondente em pé, no totem, com segundos de atenção), 5 pontos é o padrão sensato.

5. O dilema do ponto neutro.
Com neutro, quem não tem opinião tem saída honesta. Sem neutro (escala de 4 ou 6), força-se a escolha de um lado. Não há resposta única: escalas pares evitam a "preguiça do meio" (marcar neutro para não pensar), mas fabricam opiniões de quem realmente não tem uma; e fabricar dado é pior que perder dado. A recomendação mais segura é manter o neutro, e quando a taxa de neutros for alta, tratar isso como informação ("os clientes não notaram esse aspecto") em vez de estorvo.

Os três pecados na hora de analisar

Montar bem é metade; a outra metade é ler direito.

Pecado 1: tirar média como se fossem números de verdade.
Os degraus da Likert são ordenados, mas não necessariamente equidistantes: a distância psicológica entre "concordo" e "concordo totalmente" pode não ser igual à distância entre "neutro" e "concordo". Tecnicamente, é uma escala ordinal, e há um debate metodológico honesto, com décadas de idas e vindas, sobre quando é aceitável tratá-la como numérica. A regra prática mais segura: média de um único item Likert é atalho arriscado; distribuição é sempre verdade. Reportar "72% concordam ou concordam totalmente; 11% discordam" comunica mais e engana menos do que "média 3,9" (a média esconde os extremos).

Pecado 2: ignorar o estilo de resposta.
Escalas de concordância sofrem de um viés conhecido: a aquiescência: a tendência humana de concordar com afirmações, qualquer afirmação. Parte dos "concordo" é pura gentileza. Antídotos: afirmações formuladas com neutralidade e, em questionários mais longos, alternar afirmações positivas e negativas para detectar quem concorda com tudo em linha reta (straightlining).

Pecado 3: comparar escalas diferentes como se fossem iguais.
A nota 4 numa escala de 5 não equivale a 8 numa escala de 10, nem o "concordo" de uma escala rotulada equivale ao "4" de uma escala numérica. Conversões de escala existem, mas são aproximações com perda. Regra de ouro para quem muda de questionário: mudou a escala, quebrou a série histórica: anote a data da mudança e compare com cuidado dali em diante.

Likert no ponto de venda

No ponto de venda, a escala Likert costuma aparecer em forma de perguntas de múltipla escolha, ou traduzida em linguagem visual: carinhas, estrelas, botões coloridos. A ciência é a mesma; os cuidados também:

  • Simetria visual: duas carinhas negativas, uma neutra, duas positivas, com o mesmo tamanho e o mesmo destaque. Uma carinha feliz gigante ao lado de carinhas tristes miúdas é escala desequilibrada em versão gráfica.
  • Ordem consistente: negativa → positiva, sempre no mesmo sentido, em todas as perguntas. Inverter no meio do fluxo colhe toques errados, não opiniões.
  • Um item por tela: a versão física do "uma afirmação por vez" — atenção de segundos não processa matriz de perguntas.

E um lembrete de humildade metodológica: a carinha mede a reação global daquele momento com altíssima taxa de resposta — essa é sua força. Para diagnóstico fino ("o problema é limpeza ou espera?"), ela precisa das perguntas específicas que vêm depois. Instrumento certo para cada trabalho.

De volta à Andorinha

Na Andorinha, a pesquisa de clima voltou a campo com uma régua honesta: cinco pontos simétricos, dois negativos, um meio de verdade, dois positivos, todos com rótulo. O retrato mudou: os 91% de céu azul viraram 63% de satisfeitos, 23% em cima do muro e 14% de insatisfeitos concentrados nas lojas de shopping, onde a escala de domingo apertava, informação que a régua sorridente havia dissolvido.

O RH não gostou do número novo e agradeceu assim mesmo: pela primeira vez havia algo para gerenciar. E a lição atravessou para o lado do cliente: toda escala nova da rede passa pelo teste da simetria antes de estrear. Régua torta não força posição; força resultado.

O resumo de uma frase (teste Feynman)

"A escala Likert é uma régua de opinião: simétrica, com degraus nomeados e um meio honesto, e que se lê olhando a distribuição, não a média."

Fontes e leituras recomendadas

LIKERT, Rensis. "A Technique for the Measurement of Attitudes". Archives of Psychology, n. 140, 1932.

KROSNICK, Jon A.; FABRIGAR, Leandre R. "Designing Rating Scales for Effective Measurement in Surveys". In: LYBERG, L. et al. (org.). Survey Measurement and Process Quality. Wiley, 1997.

KROSNICK, Jon A. "Survey Research". Annual Review of Psychology, v. 50, 1999.

CARIFIO, James; PERLA, Rocco. "Ten Common Misunderstandings, Misconceptions, Persistent Myths and Urban Legends about Likert Scales and Likert Response Formats". Journal of Social Sciences, v. 3, 2007. (Um bom retrato do debate ordinal × intervalar.)

BRADBURN, Norman; SUDMAN, Seymour; WANSINK, Brian. Asking Questions: The Definitive Guide to Questionnaire Design. Jossey-Bass, 2004.

Gostou do Conteúdo?

Últimos artigos