InícioFerramentasCalculadora SUS
Calculadora SUS: pontuação System Usability Scale
Cole as respostas de todos os participantes a partir de uma planilha ou preencha um único questionário. A calculadora pontua cada resposta na escala SUS de 0 a 100, calcula a média com intervalo de confiança, converte o resultado em percentil e nota com curva, acrescenta a avaliação por adjetivo, separa usabilidade e aprendizado e mostra quais itens puxam a pontuação para baixo.
—
Análise por item
| Item | Afirmação | Média 1–5 | Contribuição 0–4 |
|---|
Fórmula. Itens ímpares: resposta − 1; itens pares: 5 − resposta; SUS = soma × 2,5. Intervalo: média ± tn−1 · s / √n. Notas e percentis: escala com curva de Sauro e Lewis, em que 68 é o percentil 50.
Tudo é calculado no seu navegador — nada do que você digita é enviado para lugar nenhum.
Como usar
- Aplique o questionário padrãoMostre as dez afirmações do SUS na ordem original, com escala de concordância de 1 a 5, logo depois que os participantes concluírem tarefas no seu produto.
- Cole as respostasCopie as colunas de respostas da ferramenta de pesquisa ou da planilha, um participante por linha. Cabeçalho e coluna de ID são detectados automaticamente; linhas inválidas são listadas, não descartadas em silêncio.
- Veja pontuação, intervalo e notaA pontuação SUS média vem com intervalo de confiança, percentil em relação a centenas de estudos, nota com curva e avaliação por adjetivo.
- Encontre os itens fracosA tabela por item mostra a resposta média e a contribuição de cada afirmação, para você ver se o problema é complexidade, consistência, aprendizado ou confiança.
O que é a System Usability Scale e como pontuar
A System Usability Scale (SUS) é um questionário de dez itens criado por John Brooke na Digital Equipment Corporation em 1986 e publicado em 1996 como uma escala de usabilidade “rápida e simples”. Tornou-se o questionário padronizado de usabilidade mais usado: é gratuito, independe de tecnologia, leva um minuto para responder e funciona com amostras pequenas.
Os participantes avaliam cada afirmação de 1 (discordo totalmente) a 5 (concordo totalmente). As afirmações ímpares são positivas (“Achei o sistema fácil de usar”) e as pares, negativas (“Achei o sistema desnecessariamente complexo”) — por isso são pontuadas em sentidos opostos:
SUS não é porcentagem. Uma pontuação de 75 não quer dizer “75 % usável”. Para interpretá-la é preciso comparar com outros produtos, e é para isso que servem percentis e notas.
Vários participantes
Cada participante recebe uma pontuação e depois calcula-se a média. O intervalo de confiança usa a distribuição t de Student, porque as amostras de SUS costumam ser pequenas:
Tullis e Stetson (2004) mostraram que o SUS chega a conclusões estáveis com 12–14 participantes, antes de outros questionários comparados. Mesmo com 5 participantes a pontuação é informativa, mas o intervalo é largo — a calculadora mostra isso para você não tirar conclusões de diferenças pequenas.
Sobre a tradução. O questionário original é em inglês. As afirmações da calculadora são uma tradução fiel; qualquer que seja a versão escolhida, use sempre a mesma em todas as medições para que as rodadas sejam comparáveis.
Como interpretar a pontuação SUS: percentil, nota e adjetivos
Jeff Sauro e James Lewis reuniram dados de SUS de centenas de estudos. A pontuação média é 68, que corresponde ao percentil 50. A escala de notas com curva deles, baseada em 241 estudos industriais, associa faixas de pontuação a notas e percentis:
A calculadora mostra a nota da média e um percentil interpolado linearmente dentro dessas faixas. Assim, um SUS de 72,5 é C+ e fica perto do percentil 65: um pouco acima da média, e não “72,5 % bom”.
Avaliação por adjetivo. Bangor, Kortum e Miller (2009) acrescentaram uma sétima pergunta pedindo que as pessoas descrevessem o produto com um adjetivo e calcularam o SUS médio de cada um: o pior imaginável 12,5, péssimo 20,3, ruim 35,7, razoável 50,9, bom 71,4, excelente 85,5, o melhor imaginável 90,9. A calculadora mostra o adjetivo cuja média está mais próxima. Os mesmos autores propuseram faixas de aceitabilidade: abaixo de 50, não aceitável; de 50 a 70, marginal; acima de 70, aceitável.
Usabilidade e aprendizado
Lewis e Sauro (2009) descobriram que os itens 4 e 10 — precisar de ajuda técnica e precisar aprender muita coisa antes — formam um fator próprio de aprendizado. A calculadora os converte para uma escala de 0 a 100 (soma das duas contribuições × 12,5) e os outros oito itens para uma pontuação de usabilidade (soma × 3,125). Um produto com boa usabilidade e baixo aprendizado geralmente precisa de um onboarding melhor, não de um redesign.
Como aplicar bem o SUS
- Pergunte depois das tarefas, não depois de uma demo. O SUS mede a usabilidade percebida de uma experiência; os participantes precisam ter usado o produto.
- Mantenha a redação e a ordem originais. Alterar afirmações, remover itens ou usar outra escala quebra a comparabilidade com a base. Trocar “sistema” por “site” ou pelo nome do produto é prática aceita.
- Não tire os itens negativos. A alternância de tom faz parte do método. Existe uma versão totalmente positiva (Sauro e Lewis, 2011) com resultados parecidos, mas não misture versões num mesmo estudo.
- Trate respostas em branco de forma explícita. Uma convenção comum é substituir um único item em branco pelo neutro 3 e excluir linhas com mais lacunas. A calculadora lista as linhas ignoradas para você decidir.
- Compare, não só reporte. O SUS é mais útil para comparar versões, concorrentes ou lançamentos. Se os intervalos de confiança se sobrepõem muito, a diferença não está comprovada — revise o tamanho da amostra.
- Combine a pontuação com comportamento. Aprendizado baixo e itens 3, 7 e 10 fracos costumam indicar problema na primeira experiência. As métricas de ativação depois de melhorar o onboarding mostram se a mudança funcionou.
O SUS mede o quanto as pessoas acham o produto usável; o NPS mede se elas o recomendariam. As métricas se relacionam, mas um produto pode ser fácil de usar e ainda assim não valer uma recomendação.
Fontes
- Brooke J. SUS: A "quick and dirty" usability scale. In: Jordan P. W. et al. (eds.) Usability Evaluation in Industry. Taylor & Francis, 1996.
- Sauro J., Lewis J. R. Quantifying the User Experience: Practical Statistics for User Research, 2ª ed. Morgan Kaufmann, 2016 — escala de notas com curva, média de referência 68.
- Bangor A., Kortum P., Miller J. Determining What Individual SUS Scores Mean: Adding an Adjective Rating Scale. Journal of Usability Studies, 4(3), 2009.
- Bangor A., Kortum P. T., Miller J. T. An Empirical Evaluation of the System Usability Scale. International Journal of Human–Computer Interaction, 24(6), 2008 — faixas de aceitabilidade.
- Lewis J. R., Sauro J. The Factor Structure of the System Usability Scale. HCD 2009, LNCS 5619 — subescalas de usabilidade e aprendizado.
- Tullis T. S., Stetson J. N. A Comparison of Questionnaires for Assessing Website Usability. UPA Conference, 2004 — tamanho de amostra.
Perguntas frequentes
Como calcular a pontuação SUS?
Nos itens ímpares (1, 3, 5, 7, 9), subtraia 1 da resposta; nos pares (2, 4, 6, 8, 10), subtraia a resposta de 5. Some as dez contribuições e multiplique por 2,5. O resultado é uma pontuação de 0 a 100 por participante; para um grupo, tire a média.
Qual é uma boa pontuação SUS?
A média de referência é 68, o percentil 50. Acima de 80,8 a nota é A na escala com curva de Sauro e Lewis, entre os 10 % melhores. Abaixo de 51,7 é F, entre os 15 % piores. A partir de 70 costuma ser considerado aceitável.
A pontuação SUS é uma porcentagem?
Não. O SUS vai de 0 a 100, mas 68 é a média, não “68 % usável”. Para interpretar, converta em percentil ou nota: 68 é o percentil 50 e 80,3 fica perto do percentil 89.
Quantos participantes são necessários para o SUS?
O SUS dá resultados úteis com amostras pequenas: Tullis e Stetson viram conclusões estáveis a partir de uns 12–14 participantes. Com 5 ainda dá para calcular, mas o intervalo de confiança fica largo, então evite comparar designs que diferem por poucos pontos.
Posso mudar a redação das perguntas do SUS?
Trocar “sistema” por “site”, “aplicativo” ou o nome do produto é comum e não afeta os resultados de forma perceptível. Reescrever afirmações, remover itens ou mudar a escala de 5 pontos quebra a comparabilidade com os dados publicados.
O que significam as pontuações de usabilidade e aprendizado?
Os itens 4 e 10 (precisar de ajuda técnica, precisar aprender muito) medem o aprendizado; os outros oito, a usabilidade. Ambas são convertidas para 0–100. Aprendizado baixo com usabilidade razoável indica que as pessoas têm dificuldade para começar — um problema de onboarding.
O que fazer com respostas em branco?
Uma convenção comum é substituir um único item em branco pela resposta neutra 3 e excluir quem tiver mais lacunas. Marque a opção na calculadora; todas as linhas excluídas aparecem listadas.
Mais em Design de produto
- Verificador de contraste de cores
Este par de cores de texto e fundo passa no WCAG AA ou AAA?
- Gerador de paletas acessíveis
Como ter uma paleta acessível com o contraste verificado em cada tom?
- Gerador de escala tipográfica
Quais tamanhos de fonte formam uma escala tipográfica consistente e fluida?
- Tempo de leitura de tooltips e tours
O usuário tem tempo de ler um tooltip ou uma etapa do tour?
- Verificador de textos de tooltips
Este tooltip está curto, claro e leva à ação?