SUS calculator: System Usability Scale score
I-paste ang mga sagot ng lahat ng respondent mula sa spreadsheet o sagutan ang isang questionnaire. Kinakalkula ang bawat sagot sa 0–100 SUS scale, ang average na may confidence interval, ang percentile at curved letter grade, ang adjective rating, hiwalay na usability at learnability, at kung aling item ang nagpapababa sa score.
—
Breakdown bawat item
| Item | Pahayag | Mean 1–5 | Contribution 0–4 |
|---|
Formula. Odd item: sagot − 1; even item: 5 − sagot; SUS = sum × 2.5. Interval: mean ± tn−1 · s / √n. Grade at percentile: Sauro–Lewis curved scale, kung saan ang 68 ay 50th percentile.
Kinakalkula ang lahat sa inyong browser — hindi ipinapadala kahit saan ang inyong inilagay.
Paano gamitin
- Patakbuhin ang standard na questionnaireIpakita ang sampung pahayag ng SUS sa orihinal na order na may 1–5 agreement scale, kaagad matapos kumpletuhin ng mga kalahok ang mga task sa inyong produkto.
- I-paste ang mga sagotKopyahin ang mga answer column mula sa survey tool o spreadsheet, isang respondent bawat row. Awtomatikong nade-detect ang header at ID column; ang mga invalid na row ay inililista, hindi palihim na inaalis.
- Basahin ang score, interval at gradeAng mean SUS score ay may confidence interval, percentile laban sa daan-daang study, curved letter grade at adjective rating.
- Hanapin ang mga weak itemIpinapakita ng item table ang mean na sagot at contribution ng bawat pahayag, para makita kung ang problema ay complexity, consistency, learnability o confidence.
Ano ang System Usability Scale at paano ito ini-score
Ang System Usability Scale (SUS) ay sampung-item na questionnaire na ginawa ni John Brooke sa Digital Equipment Corporation noong 1986 at inilathala noong 1996 bilang “quick and dirty” na usability scale. Naging pinakagamit na standardized usability questionnaire: libre, hindi nakadepende sa teknolohiya, sinasagutan sa isang minuto at gumagana sa maliit na sample.
Ini-rate ng mga kalahok ang bawat pahayag mula 1 (lubos na hindi sang-ayon) hanggang 5 (lubos na sang-ayon). Ang odd na pahayag ay positibo (“Sa palagay ko, ang system ay madaling gamitin”), ang even ay negatibo (“Nakita kong ang system ay komplikado nang hindi kinakailangan”), kaya ini-score sa magkasalungat na direksyon:
Ang SUS ay hindi porsyento. Ang score na 75 ay hindi nangangahulugang “75 % usable”. Para ipakahulugan, ikumpara sa iba pang produkto — para dito ang percentile at grade.
Maraming respondent
Ang bawat respondent ay may score, at kinukuha ang average. Ang confidence interval ay gumagamit ng Student t distribution dahil karaniwang maliit ang SUS sample:
Natuklasan ng Tullis at Stetson (2004) na ang SUS ay umaabot sa stable na konklusyon sa 12–14 kalahok, mas maaga kaysa iba pang questionnaire. Maski sa 5 kalahok ay informative ang score, pero malawak ang interval — ipinapakita ito para hindi labis na basahin ang maliit na pagkakaiba.
Tungkol sa salin. Ang orihinal na questionnaire ay sa English. Ang mga pahayag dito ay maingat na salin; anumang bersyon na gagamitin, gamitin ang parehong bersyon sa bawat round para maikumpara ang mga resulta.
Paano ipakahulugan ang SUS score: percentile, grade at adjective
Nangalap ang Jeff Sauro at James Lewis ng SUS data mula daan-daang study. Ang average na score ay 68, na tumutugma sa 50th percentile. Ang kanilang curved grading scale, batay sa 241 industrial study, ay nagmamapa ng score range sa letter grade at percentile:
Ipinapakita ng calculator ang grade ng mean at percentile na linear na ininterpolate sa loob ng mga range. Kaya ang SUS 72.5 ay C+ sa mga 65th percentile: kaunti sa itaas ng average, hindi “72.5 % mahusay”.
Adjective rating. Nagdagdag ang Bangor, Kortum at Miller (2009) ng ikapitong tanong na humihiling na ilarawan ang produkto sa isang adjective, at kinalkula ang mean SUS bawat isa: pinakamalala 12.5, napakasama 20.3, mahina 35.7, OK 50.9, mahusay 71.4, napakahusay 85.5, pinakamahusay 90.9. Ipinapakita ng calculator ang adjective na may pinakamalapit na mean. Iminungkahi rin nila ang acceptability range: mas mababa sa 50 ay not acceptable, 50–70 marginal, higit 70 acceptable.
Usability at learnability
Natuklasan ng Lewis at Sauro (2009) na ang item 4 at 10 — pangangailangan ng technical na tulong at maraming kailangang matuto — ay hiwalay na learnability factor. Isinasalin ng calculator ang mga ito sa 0–100 (sum ng dalawang contribution × 12.5) at ang natitirang walong item sa usability score (sum × 3.125). Ang produktong may mahusay na usability pero mababang learnability ay karaniwang nangangailangan ng mas mahusay na onboarding, hindi redesign.
Paano patakbuhin nang mahusay ang SUS
- Magtanong matapos ang mga task, hindi matapos ang demo. Sinusukat ng SUS ang perceived usability ng experience; dapat ay talagang ginamit ng kalahok ang produkto.
- Panatilihin ang orihinal na wording at order. Ang pagbabago ng pahayag, pag-alis ng item o paggamit ng ibang scale ay sinisira ang pagkakumpara sa benchmark. Ang pagpalit ng “system” sa “website” o pangalan ng produkto ay katanggap-tanggap.
- Huwag alisin ang negatibong item. Ang alternating na tono ay bahagi ng method. May all-positive na bersyon (Sauro at Lewis, 2011) na may magkatulad na resulta, pero huwag paghaluin ang mga bersyon sa isang study.
- Pangasiwaan nang malinaw ang mga blangkong sagot. Karaniwang palitan ng neutral 3 ang isang blangkong item at alisin ang row na may higit na blangko. Inililista ng calculator ang mga nilaktawang linya para kayo ang magpasya.
- Magkumpara, hindi only mag-report. Pinakauseful ang SUS sa pagkumpara ng mga bersyon, competitor o release. Kung lubhang nag-o-overlap ang confidence interval, hindi napatunayan ang pagkakaiba — suriin ang sample size.
- Pagsamahin ang score sa behavior. Mababang learnability at weak na item 3, 7 at 10 ay kadalasang tumutukoy sa problema sa first-run experience. Ipinapakita ng activation metrics matapos pagbutihin ang onboarding kung gumana ang pagbabago.
Sinusukat ng SUS kung gaano usable ang produkto para mga tao; sinusukat ng NPS kung irerekomenda ba nila. Magkaugnay, pero ang produkto ay maaaring madaling gamitin at hindi pa karapat-dapat irekomenda.
Mga sanggunian
- Brooke J. SUS: A "quick and dirty" usability scale. In: Jordan P. W. et al. (eds.) Usability Evaluation in Industry. Taylor & Francis, 1996.
- Sauro J., Lewis J. R. Quantifying the User Experience: Practical Statistics for User Research, 2nd ed. Morgan Kaufmann, 2016 — curved grading scale, benchmark mean 68.
- Bangor A., Kortum P., Miller J. Determining What Individual SUS Scores Mean: Adding an Adjective Rating Scale. Journal of Usability Studies, 4(3), 2009.
- Bangor A., Kortum P. T., Miller J. T. An Empirical Evaluation of the System Usability Scale. International Journal of Human–Computer Interaction, 24(6), 2008 — acceptability range.
- Lewis J. R., Sauro J. The Factor Structure of the System Usability Scale. HCD 2009, LNCS 5619 — usability at learnability subscale.
- Tullis T. S., Stetson J. N. A Comparison of Questionnaires for Assessing Website Usability. UPA Conference, 2004 — sample size.
Mga madalas na tanong
Paano kinakalkula ang SUS score?
Para odd item (1, 3, 5, 7, 9), bawasan ng 1 ang sagot; para even item (2, 4, 6, 8, 10), bawasan ang 5 ng sagot. Idagdag ang sampung contribution at i-multiply sa 2.5. Ang resulta ay score mula 0 hanggang 100 para isang respondent; para grupo, kunin ang average.
Ano ang mahusay na SUS score?
Ang benchmark average ay 68, ang 50th percentile. Ang score na higit 80.8 ay A sa Sauro–Lewis curved scale, top 10 %. Mas mababa sa 51.7 ay F, bottom 15 %. Higit 70 ay karaniwang itinuturing acceptable.
Ang SUS score ba ay porsyento?
Hindi. Ang SUS ay mula 0 hanggang 100, pero ang 68 ay average, hindi “68 % usable”. I-convert sa percentile o grade para ipakahulugan: ang 68 ay 50th percentile, ang 80.3 ay mga 89th.
Ilan na kalahok ang kailangan para SUS?
Nagbibigay ang SUS ng useful na resulta sa maliit na sample: natuklasan ng Tullis at Stetson ang stable na konklusyon mula mga 12–14 kalahok. Sa 5, maaari pa na kalkulahin, pero malawak ang confidence interval, kaya huwag ikumpara ang mga design na magkaiba ng ilang punto only.
Maaari bang baguhin ang wording ng mga tanong sa SUS?
Ang pagpalit ng “system” sa “website”, “app” o pangalan ng produkto ay karaniwan at hindi kapansin-pansing nakakaapekto. Ang muling pagsulat ng pahayag, pag-alis ng item o pagbabago ng 5-point scale ay sinisira ang pagkakumpara sa published data.
Ano ang kahulugan ng usability at learnability subscore?
Ang item 4 at 10 (pangangailangan ng technical na tulong, maraming kailangang matuto) ay sumusukat sa learnability; ang natitirang walo ay sa usability. Ang dalawa ay isinasalin sa 0–100. Mababang learnability na may maayong usability ay nagpapahiwatig na nahihirapang magsimula ang mga tao — problema ng onboarding.
Paano pangasiwaan ang mga blangkong sagot?
Karaniwang palitan ng neutral na sagot 3 ang isang blangkong item at alisin ang mga respondent na may higit na blangko. I-check ang opsyon sa calculator; inililista ang lahat ng inalis na row.
Higit pa sa Product design
- Color contrast checker
Pumapasa ba sa WCAG AA o AAA ang pares ng kulay ng text at background?
- Accessible palette generator
Paano kumuha ng accessible na color palette na may contrast na sinuri sa bawat shade?
- Type scale generator
Aling mga font size ang bumubuo ng magkakatugma at fluid na type scale?
- Tooltip at tour reading time
May sapat bang oras ang user para basahin ang tooltip o tour step?
- Tooltip copy checker
Maikli, malinaw at nag-uudyok ba ng aksiyon ang tooltip na ito?