TakéTestování použitelnosti, User testing, UX testováníZákladní
Definice
Uživatelské testování je výzkumná metoda, při které skuteční lidé z cílové skupiny plní na produktu předem připravené úkoly a moderátor sleduje, kde narazí na potíže. Cílem není zjistit názor uživatele, ale pozorovat jeho chování: kde zaváhá, co si špatně vyloží a kde úkol vzdá. Výstupem je seznam konkrétních problémů použitelnosti.
Proč pozorování poráží dotazování
Uživatelské testování stojí na jednoduchém rozporu: lidé neumí spolehlivě popsat, jak software používají. Když se jich zeptáte, zda je formulář srozumitelný, odpovědí zdvořile ano. Když jim zadáte úkol „objednejte tuhle bundu ve velikosti M s doručením na výdejní místo“, uvidíte, že třikrát minou výběr velikosti, protože vypadá jako popisek. Právě proto se v testu zadávají úkoly a nikoli otázky, a proto moderátor mlčí i ve chvíli, kdy je pokušení napovědět největší.
Průběh jedné relace
Typická relace trvá 45 až 60 minut a má pevnou kostru. Úvodní rozhovor ověří, že účastník odpovídá cílové skupině. Následuje sada tří až pěti úkolů formulovaných jako situace, ne jako návod: „potřebujete zjistit, kolik vás bude stát doprava do Brna“ místo „klikněte na Doprava a platba“. Účastníka požádáme, aby myslel nahlas (think-aloud), takže slyšíme jeho očekávání dřív, než klikne. Na závěr přijde krátký debrief, kde se doptáme na to, co jsme viděli.
Moderované a nemoderované testování
Moderovaná relace umožňuje ptát se do hloubky „co jste teď čekal, že se stane“, ale je drahá na čas výzkumníka. Nemoderované testování přes nahrávací nástroj sesbírá desítky relací přes noc za cenu toho, že se nedozvíte důvod chování. V praxi se obojí kombinuje: nemoderovaně se měří dokončení úkolu na větším vzorku, moderovaně se zjišťuje proč.
Kolik lidí stačí
Uživatelské testování je kvalitativní metoda, takže nehledá statistickou významnost. Pět účastníků na jeden segment odhalí většinu závažných problémů použitelnosti a další účastníci pak převážně opakují už nalezené nálezy. Pokud máte dvě velmi odlišné skupiny (například nakupující a administrátory e-shopu), testujte každou zvlášť. Když potřebujete čísla, sáhněte po A/B testování nebo po analytice, ne po zvětšování vzorku v moderovaném testu.
Co se z testu opravdu vyhodnocuje
Zápis z relace není přepis toho, co účastník řekl. Sledují se dokončené úkoly, čas do dokončení, počet chybných cest a místa, kde uživatel potřeboval nápovědu. Nálezy se pak třídí podle závažnosti: blokující problém brání dokončení objednávky, kosmetický jen zdržuje. Bez tohoto tříděni skončí výstup jako nepoužitelný seznam padesáti drobností, který produktový tým odloží.
Uživatelské testování se často plete s kontrolou kvality. Test odhaluje problémy v použitelnosti a v porozumění, ne chyby v kódu; ty patří do unit testů a QA. Stejně tak nenahrazuje audit přístupnosti, i když testování s uživateli asistivních technologií je jeho cenným doplňkem.
Kdy testovat
Nejlevnější nálezy vznikají na papírovém nebo klikacím prototypu, kdy ještě nic není naprogramováno. Test před vydáním pak potvrzuje, že se nic zásadního nerozbilo, a test na produkci s reálnými daty ukazuje problémy, které se v prototypu neprojeví: prázdné stavy, dlouhé názvy produktů, pomalé odpovědi.
Příklady z praxe
Pět lidí odhalí zamčené pole ve výdejním místě
E-shop s outdoorovým vybavením spustil nový checkout a konverze v posledním kroku klesla. Pět moderovaných relací ukázalo, že čtyři z pěti účastníků hledali výběr výdejního místa dřív, než vyplnili adresu, ale mapa se aktivovala až po zadání PSČ. Úprava pořadí polí trvala vývojáři půl dne a vyřešila problém, který analytika ukazovala jen jako anonymní propad.
Zadání úkolu, které test nezkazí
Formulace úkolu rozhoduje o kvalitě dat. Špatné zadání obsahuje názvy tlačítek z rozhraní, takže účastník jen hledá slovo a netestuje se orientace. Dobré zadání popisuje situaci a cíl a nechává cestu na uživateli.
ŠPATNĚ: "Klikněte na Nastavení, pak na Fakturace a změňte tarif na Pro." DOBŘE: "Firma vám zaplatila lepší tarif. Zjistěte, jestli si ho můžete přepnout sám a kolik vás to bude měsíčně stát." MĚŘÍME: - dokončeno bez nápovědy: ano/ne - počet slepých cest - výrok, kde účastník poprvé zaváhal
Časté omyly
- MýtusPět lidí je málo, z toho se nedá nic vyvodit.
- Ve skutečnostiUživatelské testování nehledá procenta, ale existenci problému. Pokud tři z pěti lidí nenajdou tlačítko, problém je prokázaný bez ohledu na velikost vzorku. Statistiku dodá analytika nebo A/B test, ne moderovaná relace.
- MýtusTestovat můžeme až na hotové aplikaci.
- Ve skutečnostiNejvíc peněz ušetří test na prototypu, kdy je změna otázkou přesunutí obrazovky v návrhovém nástroji. Na hotové aplikaci stojí stejný nález refaktoring a novou QA smyčku.
- MýtusKolegové z firmy jsou dobrý testovací vzorek.
- Ve skutečnostiKolegové znají terminologii produktu, tuší, kde co je, a nechtějí kritizovat práci sousedního týmu. Interní testování odhalí jen hrubé chyby; zbytek vyžaduje lidi z cílové skupiny mimo firmu.
Časté dotazy
- Kolik stojí uživatelské testování a jak dlouho trvá?
- Uživatelské testování malého rozsahu se dá zvládnout za jeden až dva týdny: příprava scénáře a rekrutace zaberou většinu času, samotné relace jeden až dva dny a vyhodnocení další den. Náklady tvoří hlavně čas výzkumníka a odměna pro účastníky, která se běžně pohybuje v řádu stokorun až nižších tisíců za relaci podle náročnosti cílové skupiny. Odborné segmenty, například lékaři nebo účetní, rekrutaci prodraží nejvíc. Nemoderovaný test přes nahrávací nástroj je levnější, ale vyžaduje pečlivější přípravu zadání, protože nikdo nemůže na místě upřesnit nejasnost.
- Jak vybrat účastníky uživatelského testování?
- Účastníci uživatelského testování se vybírají podle chování, ne podle demografie. Klíčové je, aby řešili stejnou úlohu jako reální uživatelé: nakupovali online, spravovali sklad, vyřizovali reklamace. Screener proto obsahuje otázky na frekvenci činnosti a na zkušenost s konkurenčními nástroji. Vyřaďte lidi z oboru UX a marketingu, kteří komentují rozhraní místo toho, aby ho používali, i zaměstnance a jejich rodiny. Pokud má produkt dvě odlišné role, testujte každou samostatně s vlastním scénářem; smíchání rolí do jednoho vzorku vede k nálezům, které neplatí pro nikoho.
- Co dělat, když se účastník během testu zasekne?
- Zaseknutí je při uživatelském testování cenný nález, ne nehoda. Moderátor nechá účastníka zkoušet dál a mlčí, dokud je patrné, že hledá; pomůže až ve chvíli, kdy je zjevně frustrovaný nebo by zbytek relace přišel vniveč. Nápověda se dává po stupních: nejdřív otázka „co byste zkusil teď“, pak obecné nasměrování a teprve nakonec konkrétní krok. Do zápisu se poznamená, na jaké úrovni nápovědy úkol pokračoval. Moderátor zároveň připomene, že se netestuje účastník, ale produkt.
- Nahradí nahrávání relací a heatmapy uživatelské testování?
- Nahrávání relací a heatmapy ukazují, kde uživatelé klikali a kde odešli, ale neřeknou proč. Uživatelské testování dodává právě chybějící vysvětlení: slyšíte, co člověk čekal, jak si vyložil popisek a co ho odradilo. V praxi obojí funguje jako dvojice. Analytika najde místo s propadem, uživatelské testování na stejném místě odhalí příčinu a po nasazení opravy analytika ověří, že se čísla zlepšila. Spoléhat jen na kvantitativní data vede k hádání příčin, spoléhat jen na testování vede k opravování problémů, které se v provozu skoro nevyskytují.
Zdroje
- Usability testing(otevře se v novém okně)
- ISO 9241-11:2018 Ergonomics of human-system interaction: Usability(otevře se v novém okně)
- Web Content Accessibility Guidelines (WCAG)(otevře se v novém okně)
- Involving Users in Web Projects for Better, Easier Accessibility(otevře se v novém okně)