Clew

InícioFerramentasCalculadora SUS

Calculadora SUS: pontuação System Usability Scale

Cole as respostas de todos os participantes a partir de uma folha de cálculo ou preencha um único questionário. A calculadora pontua cada resposta na escala SUS de 0 a 100, calcula a média com intervalo de confiança, converte o resultado em percentil e nota com curva, junta a avaliação por adjetivo, separa usabilidade e aprendizagem e mostra que itens puxam a pontuação para baixo.

● Grátis, sem registoAtualizado:

10 respostas de 1 a 5 pela ordem do questionário, separadas por vírgula, ponto e vírgula, tabulação ou espaço. Uma linha de cabeçalho e uma primeira coluna com ID não fazem mal — copie diretamente do Google Sheets ou do Excel.
Nível de confiança

—

 

Pontuação SUS— 
Intervalo de confiança— 
Percentil— 
Nota— 
Usabilidade— 
Aprendizagem— 
Pontuações na escala de notas com curva
Pontuações na escala de notas com curva
participantesmédia e intervalomédia 68

Análise por item

 

Resposta média e contributo para a pontuação de cada item SUS
ItemAfirmaçãoMédia 1–5Contributo 0–4

Fórmula. Itens ímpares: resposta − 1; itens pares: 5 − resposta; SUS = soma × 2,5. Intervalo: média ± tn−1 · s / √n. Notas e percentis: escala com curva de Sauro e Lewis, em que 68 é o percentil 50.

Tudo é calculado no seu navegador — nada do que introduz é enviado para lado nenhum.

Como utilizar

  1. Aplique o questionário padrãoMostre as dez afirmações SUS pela ordem original, com uma escala de concordância de 1 a 5, logo depois de os participantes concluírem tarefas no seu produto.
  2. Cole as respostasCopie as colunas de respostas da ferramenta de inquéritos ou da folha de cálculo, um participante por linha. Cabeçalho e coluna de ID são detetados automaticamente; as linhas inválidas são listadas, não descartadas em silêncio.
  3. Veja pontuação, intervalo e notaA pontuação SUS média vem com intervalo de confiança, percentil face a centenas de estudos, nota com curva e avaliação por adjetivo.
  4. Encontre os itens fracosA tabela por item mostra a resposta média e o contributo de cada afirmação, para perceber se o problema é complexidade, consistência, aprendizagem ou confiança.

O que é a System Usability Scale e como se pontua

A System Usability Scale (SUS) é um questionário de dez itens criado por John Brooke na Digital Equipment Corporation em 1986 e publicado em 1996 como uma escala de usabilidade «rápida e simples». Tornou-se o questionário normalizado de usabilidade mais usado: é gratuito, independente da tecnologia, responde-se num minuto e funciona com amostras pequenas.

Os participantes avaliam cada afirmação de 1 (discordo totalmente) a 5 (concordo totalmente). As afirmações ímpares são positivas («Achei o sistema fácil de usar») e as pares negativas («Achei o sistema desnecessariamente complexo») — por isso pontuam em sentidos opostos:

itens ímpares 1, 3, 5, 7, 9: contributo = resposta − 1 itens pares 2, 4, 6, 8, 10: contributo = 5 − resposta SUS = (soma dos 10 contributos) × 2,5 intervalo 0–100 Exemplo: respostas 4 2 3 1 4 2 4 1 3 2 ímpares: 3 + 2 + 3 + 3 + 2 = 13 pares: 3 + 4 + 3 + 4 + 3 = 17 SUS = 30 × 2,5 = 75

O SUS não é uma percentagem. Uma pontuação de 75 não significa «75 % usável». Para a interpretar é preciso compará-la com outros produtos, e é para isso que servem os percentis e as notas.

Vários participantes

Cada participante tem a sua pontuação e depois calcula-se a média. O intervalo de confiança usa a distribuição t de Student, porque as amostras SUS costumam ser pequenas:

média = Σ SUS_i / n s = √( Σ (SUS_i − média)² / (n − 1) ) intervalo = média ± t(1 − α/2, n − 1) × s / √n

Tullis e Stetson (2004) mostraram que o SUS chega a conclusões estáveis com 12–14 participantes, antes de outros questionários comparados. Mesmo com 5 participantes a pontuação é informativa, mas o intervalo é largo — a calculadora mostra-o para não tirar conclusões de diferenças pequenas.

Sobre a tradução. O questionário original é em inglês. As afirmações da calculadora são uma tradução fiel; seja qual for a versão escolhida, use sempre a mesma em todas as medições para que as rondas sejam comparáveis.

Como interpretar a pontuação SUS: percentil, nota e adjetivos

Jeff Sauro e James Lewis reuniram dados SUS de centenas de estudos. A pontuação média é 68, que corresponde ao percentil 50. A sua escala de notas com curva, baseada em 241 estudos industriais, associa intervalos de pontuação a notas e percentis:

Nota Intervalo SUS Percentil A+ 84,1–100 96–100 A 80,8–84,0 90–95 A− 78,9–80,7 85–89 B+ 77,2–78,8 80–84 B 74,1–77,1 70–79 B− 72,6–74,0 65–69 C+ 71,1–72,5 60–64 C 65,0–71,0 41–59 C− 62,7–64,9 35–40 D 51,7–62,6 15–34 F 0–51,6 0–14

A calculadora mostra a nota da média e um percentil interpolado linearmente dentro destes intervalos. Assim, um SUS de 72,5 é C+ e fica perto do percentil 65: ligeiramente acima da média, e não «72,5 % bom».

Avaliação por adjetivo. Bangor, Kortum e Miller (2009) acrescentaram uma sétima pergunta a pedir que as pessoas descrevessem o produto com um adjetivo e calcularam o SUS médio de cada um: o pior imaginável 12,5, péssimo 20,3, fraco 35,7, razoável 50,9, bom 71,4, excelente 85,5, o melhor imaginável 90,9. A calculadora mostra o adjetivo cuja média está mais próxima. Os mesmos autores propuseram faixas de aceitabilidade: abaixo de 50, não aceitável; de 50 a 70, marginal; acima de 70, aceitável.

Usabilidade e aprendizagem

Lewis e Sauro (2009) verificaram que os itens 4 e 10 — precisar de ajuda técnica e ter de aprender muito antes — formam um fator próprio de aprendizagem. A calculadora converte-os para 0–100 (soma dos dois contributos × 12,5) e os restantes oito itens para uma pontuação de usabilidade (soma × 3,125). Um produto com boa usabilidade e baixa aprendizagem precisa normalmente de melhor onboarding, não de um redesign.

Como aplicar bem o SUS

  • Pergunte depois das tarefas, não depois de uma demonstração. O SUS mede a usabilidade percebida de uma experiência; os participantes têm de ter usado o produto.
  • Mantenha a redação e a ordem originais. Alterar afirmações, retirar itens ou usar outra escala quebra a comparabilidade com a base. Trocar «sistema» por «site» ou pelo nome do produto é prática aceite.
  • Não retire os itens negativos. A alternância de tom faz parte do método. Existe uma versão totalmente positiva (Sauro e Lewis, 2011) com resultados semelhantes, mas não misture versões no mesmo estudo.
  • Trate as respostas em branco de forma explícita. Uma convenção comum é substituir um único item em branco pelo neutro 3 e excluir linhas com mais falhas. A calculadora lista as linhas ignoradas para decidir.
  • Compare, não se limite a reportar. O SUS é mais útil para comparar versões, concorrentes ou lançamentos. Se os intervalos de confiança se sobrepõem muito, a diferença não está provada — reveja o tamanho da amostra.
  • Junte a pontuação ao comportamento. Aprendizagem baixa e itens 3, 7 e 10 fracos apontam muitas vezes para um problema na primeira experiência. As métricas de ativação depois de melhorar o onboarding mostram se a alteração resultou.

O SUS mede quão usável as pessoas acham o produto; o NPS mede se o recomendariam. Estão relacionados, mas um produto pode ser fácil de usar e ainda assim não merecer recomendação.

Fontes

  1. Brooke J. SUS: A "quick and dirty" usability scale. In: Jordan P. W. et al. (eds.) Usability Evaluation in Industry. Taylor & Francis, 1996.
  2. Sauro J., Lewis J. R. Quantifying the User Experience: Practical Statistics for User Research, 2.ª ed. Morgan Kaufmann, 2016 — escala de notas com curva, média de referência 68.
  3. Bangor A., Kortum P., Miller J. Determining What Individual SUS Scores Mean: Adding an Adjective Rating Scale. Journal of Usability Studies, 4(3), 2009.
  4. Bangor A., Kortum P. T., Miller J. T. An Empirical Evaluation of the System Usability Scale. International Journal of Human–Computer Interaction, 24(6), 2008 — faixas de aceitabilidade.
  5. Lewis J. R., Sauro J. The Factor Structure of the System Usability Scale. HCD 2009, LNCS 5619 — subescalas de usabilidade e aprendizagem.
  6. Tullis T. S., Stetson J. N. A Comparison of Questionnaires for Assessing Website Usability. UPA Conference, 2004 — tamanho da amostra.

Perguntas frequentes

Como se calcula a pontuação SUS?

Nos itens ímpares (1, 3, 5, 7, 9) subtraia 1 à resposta; nos pares (2, 4, 6, 8, 10) subtraia a resposta a 5. Some os dez contributos e multiplique por 2,5. O resultado é uma pontuação de 0 a 100 por participante; para um grupo, calcule a média.

O que é uma boa pontuação SUS?

A média de referência é 68, o percentil 50. Acima de 80,8 a nota é A na escala com curva de Sauro e Lewis, entre os 10 % melhores. Abaixo de 51,7 é F, entre os 15 % piores. A partir de 70 costuma considerar-se aceitável.

A pontuação SUS é uma percentagem?

Não. O SUS vai de 0 a 100, mas 68 é a média, não «68 % usável». Para interpretar, converta em percentil ou nota: 68 é o percentil 50 e 80,3 fica perto do percentil 89.

Quantos participantes são precisos para o SUS?

O SUS dá resultados úteis com amostras pequenas: Tullis e Stetson observaram conclusões estáveis a partir de cerca de 12–14 participantes. Com 5 continua a ser possível calcular, mas o intervalo de confiança fica largo, por isso evite comparar designs que diferem poucos pontos.

Posso alterar a redação das perguntas SUS?

Trocar «sistema» por «site», «aplicação» ou o nome do produto é habitual e não afeta os resultados de forma percetível. Reescrever afirmações, retirar itens ou mudar a escala de 5 pontos quebra a comparabilidade com os dados publicados.

O que significam as pontuações de usabilidade e aprendizagem?

Os itens 4 e 10 (precisar de ajuda técnica, ter de aprender muito) medem a aprendizagem; os outros oito, a usabilidade. Ambas são convertidas para 0–100. Aprendizagem baixa com usabilidade razoável indica que as pessoas têm dificuldade em começar — um problema de onboarding.

O que fazer com respostas em branco?

Uma convenção comum é substituir um único item em branco pela resposta neutra 3 e excluir quem tiver mais falhas. Assinale a opção na calculadora; todas as linhas excluídas aparecem listadas.

Mais em Design de produto

Tours, tooltips e checklists cujo efeito se vê nas métricas.

Experimentar o Clew grátisComo funcionaPlano gratuito para sempre · sem cartão de crédito

Tours de produto, pop-ups e onboarding na era da IA

7 padrões com número de passos, regras de texto e métricas, o que a IA muda e uma lista antes de publicar. PDF, 2 páginas. O que inclui →

O guia está em inglês.