InícioFerramentasCalculadora SUS
Calculadora SUS: pontuação System Usability Scale
Cole as respostas de todos os participantes a partir de uma folha de cálculo ou preencha um único questionário. A calculadora pontua cada resposta na escala SUS de 0 a 100, calcula a média com intervalo de confiança, converte o resultado em percentil e nota com curva, junta a avaliação por adjetivo, separa usabilidade e aprendizagem e mostra que itens puxam a pontuação para baixo.
—
Análise por item
| Item | Afirmação | Média 1–5 | Contributo 0–4 |
|---|
Fórmula. Itens ímpares: resposta − 1; itens pares: 5 − resposta; SUS = soma × 2,5. Intervalo: média ± tn−1 · s / √n. Notas e percentis: escala com curva de Sauro e Lewis, em que 68 é o percentil 50.
Tudo é calculado no seu navegador — nada do que introduz é enviado para lado nenhum.
Como utilizar
- Aplique o questionário padrãoMostre as dez afirmações SUS pela ordem original, com uma escala de concordância de 1 a 5, logo depois de os participantes concluírem tarefas no seu produto.
- Cole as respostasCopie as colunas de respostas da ferramenta de inquéritos ou da folha de cálculo, um participante por linha. Cabeçalho e coluna de ID são detetados automaticamente; as linhas inválidas são listadas, não descartadas em silêncio.
- Veja pontuação, intervalo e notaA pontuação SUS média vem com intervalo de confiança, percentil face a centenas de estudos, nota com curva e avaliação por adjetivo.
- Encontre os itens fracosA tabela por item mostra a resposta média e o contributo de cada afirmação, para perceber se o problema é complexidade, consistência, aprendizagem ou confiança.
O que é a System Usability Scale e como se pontua
A System Usability Scale (SUS) é um questionário de dez itens criado por John Brooke na Digital Equipment Corporation em 1986 e publicado em 1996 como uma escala de usabilidade «rápida e simples». Tornou-se o questionário normalizado de usabilidade mais usado: é gratuito, independente da tecnologia, responde-se num minuto e funciona com amostras pequenas.
Os participantes avaliam cada afirmação de 1 (discordo totalmente) a 5 (concordo totalmente). As afirmações ímpares são positivas («Achei o sistema fácil de usar») e as pares negativas («Achei o sistema desnecessariamente complexo») — por isso pontuam em sentidos opostos:
O SUS não é uma percentagem. Uma pontuação de 75 não significa «75 % usável». Para a interpretar é preciso compará-la com outros produtos, e é para isso que servem os percentis e as notas.
Vários participantes
Cada participante tem a sua pontuação e depois calcula-se a média. O intervalo de confiança usa a distribuição t de Student, porque as amostras SUS costumam ser pequenas:
Tullis e Stetson (2004) mostraram que o SUS chega a conclusões estáveis com 12–14 participantes, antes de outros questionários comparados. Mesmo com 5 participantes a pontuação é informativa, mas o intervalo é largo — a calculadora mostra-o para não tirar conclusões de diferenças pequenas.
Sobre a tradução. O questionário original é em inglês. As afirmações da calculadora são uma tradução fiel; seja qual for a versão escolhida, use sempre a mesma em todas as medições para que as rondas sejam comparáveis.
Como interpretar a pontuação SUS: percentil, nota e adjetivos
Jeff Sauro e James Lewis reuniram dados SUS de centenas de estudos. A pontuação média é 68, que corresponde ao percentil 50. A sua escala de notas com curva, baseada em 241 estudos industriais, associa intervalos de pontuação a notas e percentis:
A calculadora mostra a nota da média e um percentil interpolado linearmente dentro destes intervalos. Assim, um SUS de 72,5 é C+ e fica perto do percentil 65: ligeiramente acima da média, e não «72,5 % bom».
Avaliação por adjetivo. Bangor, Kortum e Miller (2009) acrescentaram uma sétima pergunta a pedir que as pessoas descrevessem o produto com um adjetivo e calcularam o SUS médio de cada um: o pior imaginável 12,5, péssimo 20,3, fraco 35,7, razoável 50,9, bom 71,4, excelente 85,5, o melhor imaginável 90,9. A calculadora mostra o adjetivo cuja média está mais próxima. Os mesmos autores propuseram faixas de aceitabilidade: abaixo de 50, não aceitável; de 50 a 70, marginal; acima de 70, aceitável.
Usabilidade e aprendizagem
Lewis e Sauro (2009) verificaram que os itens 4 e 10 — precisar de ajuda técnica e ter de aprender muito antes — formam um fator próprio de aprendizagem. A calculadora converte-os para 0–100 (soma dos dois contributos × 12,5) e os restantes oito itens para uma pontuação de usabilidade (soma × 3,125). Um produto com boa usabilidade e baixa aprendizagem precisa normalmente de melhor onboarding, não de um redesign.
Como aplicar bem o SUS
- Pergunte depois das tarefas, não depois de uma demonstração. O SUS mede a usabilidade percebida de uma experiência; os participantes têm de ter usado o produto.
- Mantenha a redação e a ordem originais. Alterar afirmações, retirar itens ou usar outra escala quebra a comparabilidade com a base. Trocar «sistema» por «site» ou pelo nome do produto é prática aceite.
- Não retire os itens negativos. A alternância de tom faz parte do método. Existe uma versão totalmente positiva (Sauro e Lewis, 2011) com resultados semelhantes, mas não misture versões no mesmo estudo.
- Trate as respostas em branco de forma explícita. Uma convenção comum é substituir um único item em branco pelo neutro 3 e excluir linhas com mais falhas. A calculadora lista as linhas ignoradas para decidir.
- Compare, não se limite a reportar. O SUS é mais útil para comparar versões, concorrentes ou lançamentos. Se os intervalos de confiança se sobrepõem muito, a diferença não está provada — reveja o tamanho da amostra.
- Junte a pontuação ao comportamento. Aprendizagem baixa e itens 3, 7 e 10 fracos apontam muitas vezes para um problema na primeira experiência. As métricas de ativação depois de melhorar o onboarding mostram se a alteração resultou.
O SUS mede quão usável as pessoas acham o produto; o NPS mede se o recomendariam. Estão relacionados, mas um produto pode ser fácil de usar e ainda assim não merecer recomendação.
Fontes
- Brooke J. SUS: A "quick and dirty" usability scale. In: Jordan P. W. et al. (eds.) Usability Evaluation in Industry. Taylor & Francis, 1996.
- Sauro J., Lewis J. R. Quantifying the User Experience: Practical Statistics for User Research, 2.ª ed. Morgan Kaufmann, 2016 — escala de notas com curva, média de referência 68.
- Bangor A., Kortum P., Miller J. Determining What Individual SUS Scores Mean: Adding an Adjective Rating Scale. Journal of Usability Studies, 4(3), 2009.
- Bangor A., Kortum P. T., Miller J. T. An Empirical Evaluation of the System Usability Scale. International Journal of Human–Computer Interaction, 24(6), 2008 — faixas de aceitabilidade.
- Lewis J. R., Sauro J. The Factor Structure of the System Usability Scale. HCD 2009, LNCS 5619 — subescalas de usabilidade e aprendizagem.
- Tullis T. S., Stetson J. N. A Comparison of Questionnaires for Assessing Website Usability. UPA Conference, 2004 — tamanho da amostra.
Perguntas frequentes
Como se calcula a pontuação SUS?
Nos itens ímpares (1, 3, 5, 7, 9) subtraia 1 à resposta; nos pares (2, 4, 6, 8, 10) subtraia a resposta a 5. Some os dez contributos e multiplique por 2,5. O resultado é uma pontuação de 0 a 100 por participante; para um grupo, calcule a média.
O que é uma boa pontuação SUS?
A média de referência é 68, o percentil 50. Acima de 80,8 a nota é A na escala com curva de Sauro e Lewis, entre os 10 % melhores. Abaixo de 51,7 é F, entre os 15 % piores. A partir de 70 costuma considerar-se aceitável.
A pontuação SUS é uma percentagem?
Não. O SUS vai de 0 a 100, mas 68 é a média, não «68 % usável». Para interpretar, converta em percentil ou nota: 68 é o percentil 50 e 80,3 fica perto do percentil 89.
Quantos participantes são precisos para o SUS?
O SUS dá resultados úteis com amostras pequenas: Tullis e Stetson observaram conclusões estáveis a partir de cerca de 12–14 participantes. Com 5 continua a ser possível calcular, mas o intervalo de confiança fica largo, por isso evite comparar designs que diferem poucos pontos.
Posso alterar a redação das perguntas SUS?
Trocar «sistema» por «site», «aplicação» ou o nome do produto é habitual e não afeta os resultados de forma percetível. Reescrever afirmações, retirar itens ou mudar a escala de 5 pontos quebra a comparabilidade com os dados publicados.
O que significam as pontuações de usabilidade e aprendizagem?
Os itens 4 e 10 (precisar de ajuda técnica, ter de aprender muito) medem a aprendizagem; os outros oito, a usabilidade. Ambas são convertidas para 0–100. Aprendizagem baixa com usabilidade razoável indica que as pessoas têm dificuldade em começar — um problema de onboarding.
O que fazer com respostas em branco?
Uma convenção comum é substituir um único item em branco pela resposta neutra 3 e excluir quem tiver mais falhas. Assinale a opção na calculadora; todas as linhas excluídas aparecem listadas.
Mais em Design de produto
- Verificador de contraste de cores
Este par de cores de texto e fundo cumpre o WCAG AA ou AAA?
- Gerador de paletas acessíveis
Como obter uma paleta acessível com o contraste verificado em cada tom?
- Gerador de escala tipográfica
Que tamanhos de letra formam uma escala tipográfica coerente e fluida?
- Tempo de leitura de tooltips e tours
Os utilizadores têm tempo para ler um tooltip ou um passo do tour?
- Verificador de textos de tooltips
Este tooltip é curto, claro e leva à ação?