Clew

InicioHerramientasCalculadora SUS

Calculadora SUS: puntuación System Usability Scale

Pega las respuestas de todos los participantes desde una hoja de cálculo o rellena un único cuestionario. La calculadora puntúa cada respuesta en la escala SUS de 0 a 100, calcula la media con su intervalo de confianza, convierte el resultado en percentil y nota con curva, añade la valoración adjetiva, separa usabilidad y aprendizaje y muestra qué ítems bajan la puntuación.

● Gratis, sin registroActualizado:

10 respuestas de 1 a 5 en el orden del cuestionario, separadas por comas, punto y coma, tabuladores o espacios. Puedes incluir una fila de encabezado y una primera columna con ID: copia directamente desde Google Sheets o Excel.
Nivel de confianza

—

 

Puntuación SUS— 
Intervalo de confianza— 
Percentil— 
Nota— 
Usabilidad— 
Aprendizaje— 
Puntuaciones en la escala de notas con curva
Puntuaciones en la escala de notas con curva
participantesmedia e intervalopromedio 68

Desglose por ítem

 

Respuesta media y contribución a la puntuación de cada ítem SUS
ÍtemAfirmaciónMedia 1–5Contribución 0–4

Fórmula. Ítems impares: respuesta − 1; ítems pares: 5 − respuesta; SUS = suma × 2,5. Intervalo: media ± tn−1 · s / √n. Notas y percentiles: escala con curva de Sauro y Lewis, donde 68 es el percentil 50.

Todo se calcula en tu navegador: nada de lo que escribes se envía a ningún sitio.

Cómo usarla

  1. Aplica el cuestionario estándarMuestra las diez afirmaciones SUS en su orden original con una escala de acuerdo de 1 a 5, justo después de que los participantes completen tareas en tu producto.
  2. Pega las respuestasCopia las columnas de respuestas desde tu herramienta de encuestas u hoja de cálculo, un participante por fila. El encabezado y la columna de ID se detectan solos; las filas no válidas se listan, no se descartan en silencio.
  3. Lee puntuación, intervalo y notaLa puntuación SUS media llega con intervalo de confianza, percentil frente a cientos de estudios, nota con curva y valoración adjetiva.
  4. Encuentra los ítems débilesLa tabla por ítem muestra la respuesta media y la contribución de cada afirmación, para ver si el problema es la complejidad, la coherencia, el aprendizaje o la confianza.

Qué es la System Usability Scale y cómo se puntúa

La System Usability Scale (SUS) es un cuestionario de diez ítems que John Brooke creó en Digital Equipment Corporation en 1986 y publicó en 1996 como una escala de usabilidad «rápida y sencilla». Se convirtió en el cuestionario estandarizado de usabilidad más utilizado: es gratuito, independiente de la tecnología, se completa en un minuto y funciona con muestras pequeñas.

Los participantes valoran cada afirmación de 1 (totalmente en desacuerdo) a 5 (totalmente de acuerdo). Las afirmaciones impares son positivas («Me pareció que el sistema era fácil de usar») y las pares, negativas («El sistema me pareció innecesariamente complejo»); por eso se puntúan en sentidos opuestos:

ítems impares 1, 3, 5, 7, 9: contribución = respuesta − 1 ítems pares 2, 4, 6, 8, 10: contribución = 5 − respuesta SUS = (suma de las 10 contribuciones) × 2,5 rango 0–100 Ejemplo: respuestas 4 2 3 1 4 2 4 1 3 2 impares: 3 + 2 + 3 + 3 + 2 = 13 pares: 3 + 4 + 3 + 4 + 3 = 17 SUS = 30 × 2,5 = 75

SUS no es un porcentaje. Una puntuación de 75 no significa «75 % usable». Para interpretarla hay que compararla con otros productos, y para eso sirven los percentiles y las notas.

Varios participantes

Cada participante obtiene su puntuación y después se calcula la media. El intervalo de confianza usa la distribución t de Student porque las muestras SUS suelen ser pequeñas:

media = Σ SUS_i / n s = √( Σ (SUS_i − media)² / (n − 1) ) intervalo = media ± t(1 − α/2, n − 1) × s / √n

Tullis y Stetson (2004) observaron que SUS llega a conclusiones estables con 12–14 participantes, antes que otros cuestionarios que compararon. Incluso con 5 participantes la puntuación es informativa, pero el intervalo es amplio; la calculadora lo muestra para que no sobreinterpretes diferencias pequeñas.

Sobre la traducción. El cuestionario original está en inglés. Las afirmaciones de la calculadora son una traducción fiel; sea cual sea la versión que uses, mantén la misma en todas las mediciones para que las rondas sean comparables.

Cómo interpretar una puntuación SUS: percentil, nota y adjetivos

Jeff Sauro y James Lewis reunieron datos SUS de cientos de estudios. La puntuación media es 68, que corresponde al percentil 50. Su escala de notas con curva, basada en 241 estudios industriales, asigna rangos de puntuación a notas y percentiles:

Nota Rango SUS Percentil A+ 84,1–100 96–100 A 80,8–84,0 90–95 A− 78,9–80,7 85–89 B+ 77,2–78,8 80–84 B 74,1–77,1 70–79 B− 72,6–74,0 65–69 C+ 71,1–72,5 60–64 C 65,0–71,0 41–59 C− 62,7–64,9 35–40 D 51,7–62,6 15–34 F 0–51,6 0–14

La calculadora muestra la nota de la media y un percentil interpolado de forma lineal dentro de estos rangos. Así, un SUS de 72,5 es una C+ en torno al percentil 65: algo por encima de la media, no «un 72,5 % bueno».

Valoración adjetiva. Bangor, Kortum y Miller (2009) añadieron una séptima pregunta en la que se pedía describir el producto con un adjetivo y calcularon el SUS medio de cada uno: lo peor imaginable 12,5, horrible 20,3, pobre 35,7, aceptable 50,9, bueno 71,4, excelente 85,5, lo mejor imaginable 90,9. La calculadora muestra el adjetivo cuya media está más cerca. Bangor y sus colegas también propusieron rangos de aceptabilidad: por debajo de 50, no aceptable; de 50 a 70, marginal; por encima de 70, aceptable.

Usabilidad y aprendizaje

Lewis y Sauro (2009) descubrieron que los ítems 4 y 10 —necesitar ayuda técnica y tener que aprender mucho antes de empezar— forman un factor propio de aprendizaje. La calculadora los lleva a una escala de 0 a 100 (suma de ambas contribuciones × 12,5) y los ocho ítems restantes a una puntuación de usabilidad (suma × 3,125). Un producto con buena usabilidad y poco aprendizaje suele necesitar un mejor onboarding, no un rediseño.

Cómo aplicar bien el SUS

  • Pregunta después de las tareas, no después de una demo. SUS mide la usabilidad percibida de una experiencia; los participantes deben haber usado el producto antes.
  • Mantén la redacción y el orden originales. Cambiar afirmaciones, quitar ítems o usar otra escala rompe la comparabilidad con la referencia. Sustituir «sistema» por «sitio web» o el nombre de tu producto es una práctica aceptada.
  • No elimines los ítems negativos. La alternancia de tono forma parte del método. Existe una versión totalmente positiva (Sauro y Lewis, 2011) con resultados similares, pero no mezcles versiones en un mismo estudio.
  • Trata las respuestas vacías de forma explícita. Una convención habitual es sustituir un único ítem vacío por el neutral 3 y excluir las filas con más huecos. La calculadora lista las líneas omitidas para que tú decidas.
  • Compara, no te limites a informar. SUS es más útil para comparar versiones, competidores o lanzamientos. Si los intervalos de confianza se solapan mucho, la diferencia no está demostrada; revisa el tamaño de la muestra.
  • Acompaña la puntuación con comportamiento. Un aprendizaje bajo y los ítems 3, 7 y 10 débiles suelen apuntar a un problema en la primera experiencia. Las métricas de activación tras mejorar el onboarding te dirán si el cambio funcionó.

SUS mide lo usable que la gente percibe el producto; NPS mide si lo recomendaría. Están relacionados, pero un producto puede ser fácil de usar y aun así no merecer una recomendación.

Fuentes

  1. Brooke J. SUS: A "quick and dirty" usability scale. En: Jordan P. W. et al. (eds.) Usability Evaluation in Industry. Taylor & Francis, 1996.
  2. Sauro J., Lewis J. R. Quantifying the User Experience: Practical Statistics for User Research, 2.ª ed. Morgan Kaufmann, 2016 — escala de notas con curva, media de referencia 68.
  3. Bangor A., Kortum P., Miller J. Determining What Individual SUS Scores Mean: Adding an Adjective Rating Scale. Journal of Usability Studies, 4(3), 2009.
  4. Bangor A., Kortum P. T., Miller J. T. An Empirical Evaluation of the System Usability Scale. International Journal of Human–Computer Interaction, 24(6), 2008 — rangos de aceptabilidad.
  5. Lewis J. R., Sauro J. The Factor Structure of the System Usability Scale. HCD 2009, LNCS 5619 — subescalas de usabilidad y aprendizaje.
  6. Tullis T. S., Stetson J. N. A Comparison of Questionnaires for Assessing Website Usability. UPA Conference, 2004 — tamaño de muestra.

Preguntas frecuentes

¿Cómo se calcula la puntuación SUS?

En los ítems impares (1, 3, 5, 7, 9) resta 1 a la respuesta; en los pares (2, 4, 6, 8, 10) resta la respuesta a 5. Suma las diez contribuciones y multiplica por 2,5. El resultado es una puntuación de 0 a 100 por participante; para un grupo, calcula la media.

¿Qué es una buena puntuación SUS?

La media de referencia es 68, el percentil 50. Por encima de 80,8 se obtiene una A en la escala con curva de Sauro y Lewis, dentro del 10 % superior. Por debajo de 51,7 es una F, en el 15 % inferior. A partir de 70 se suele considerar aceptable.

¿La puntuación SUS es un porcentaje?

No. SUS va de 0 a 100, pero 68 es la media, no un «68 % usable». Para interpretarla, conviértela en percentil o en nota: 68 es el percentil 50 y 80,3, aproximadamente el 89.

¿Cuántos participantes necesito para SUS?

SUS da resultados útiles con muestras pequeñas: Tullis y Stetson observaron conclusiones estables a partir de unos 12–14 participantes. Con 5 sigues obteniendo una puntuación, pero el intervalo de confianza será amplio, así que evita comparar diseños que se diferencian en pocos puntos.

¿Puedo cambiar la redacción de las preguntas SUS?

Sustituir «sistema» por «sitio web», «aplicación» o el nombre de tu producto es habitual y no afecta de forma apreciable. Reescribir afirmaciones, quitar ítems o cambiar la escala de 5 puntos rompe la comparabilidad con los datos publicados.

¿Qué significan las subpuntuaciones de usabilidad y aprendizaje?

Los ítems 4 y 10 (necesitar ayuda técnica, tener que aprender mucho) miden el aprendizaje; los otros ocho, la usabilidad. Ambas se llevan a una escala de 0 a 100. Un aprendizaje bajo con una usabilidad correcta indica que a la gente le cuesta empezar: un problema de onboarding.

¿Qué hago con las respuestas vacías?

Una convención habitual es sustituir un único ítem vacío por la respuesta neutral 3 y excluir a quienes tengan más huecos. Marca la opción correspondiente en la calculadora; todas las filas excluidas aparecen listadas.

Más en Diseño de producto

Tours, tooltips y checklists cuyo efecto se ve en las métricas.

Prueba Clew gratisCómo funcionaPlan gratuito para siempre · sin tarjeta

Tours de producto, popups y onboarding en la era de la IA

7 patrones con número de pasos, reglas de texto y métricas, lo que cambia la IA y una lista antes de publicar. PDF, 2 páginas. Qué incluye →

La guía está en inglés.