# Estudos com utilizadores

Recrutamento, questionários e entrevistas, e o cálculo do SUS com exemplo.

Página: https://resumos.rgo.pt/cadeiras/ipc/estudos-utilizadores/

Os testes de usabilidade mostram o que acontece; os **estudos com utilizadores** explicam porquê e quanto. Servem para levantar necessidades no início (entrevistas, observação), medir satisfação no fim (questionários) e comparar alternativas (estudos controlados simples). O método tem três partes: recrutar bem, perguntar bem e analisar com honestidade.

## Recrutar e conduzir

Recruta quem corresponde às personas, com variedade relevante (novatos e experientes, por exemplo). Cinco a oito participantes chegam para entrevistas; questionários pedem dezenas para os números estabilizarem. Pede sempre consentimento informado: explica o objetivo, que os dados são anónimos e que podem desistir a qualquer momento. Sem isto, nada do resto é utilizável.

Em entrevistas, pergunta aberto e concreto: “conta-me a última vez que combinaste uma sessão de estudo” rende mais do que “achas a app útil”. Ouve mais do que falas; o silêncio depois de uma resposta curta costuma trazer o detalhe que interessa. Em questionários, cada pergunta mede uma coisa, sem duplas (“a app é rápida e bonita” não se responde) e sem conduzir (“não achas a app ótima”).

Usa para descobrir necessidades e razões. Típico: 5 a 8 participantes, conversa de 30 minutos com guião aberto. Exemplo de pergunta: “conta-me a última vez que combinaste uma sessão de estudo”. Saiem citações e temas, não números.

Usa para medir satisfação e comparar versões. Típico: dezenas de respostas, perguntas fechadas em escala. Exemplo de pergunta: “consigo combinar uma sessão sem ajuda”, de 1 a 5. Saiem médias e distribuições, não razões.

## O SUS: medir satisfação em dez perguntas

O **SUS** (_System Usability Scale_) é o questionário padrão para uma pontuação única de usabilidade.[1](https://resumos.rgo.pt/cadeiras/ipc/estudos-utilizadores/#user-content-fn-brooke) Tem dez afirmações em escala de 1 (discordo totalmente) a 5 (concordo totalmente), alternando tom positivo (ímpares) e negativo (pares):

1.  Gostaria de usar isto com frequência.
2.  Achei o sistema desnecessariamente complexo.
3.  Achei o sistema fácil de usar.
4.  Precisaria de ajuda técnica para usar isto.
5.  As funções estão bem integradas.
6.  Há demasiada inconsistência.
7.  A maioria aprende depressa.
8.  Achei o sistema incómodo de usar.
9.  Senti-me confiante a usar.
10.  Precisei de aprender muito antes de usar.

O cálculo: ímpares valem resposta menos 1, pares valem 5 menos a resposta, soma-se tudo e multiplica-se por 2,5. O resultado vai de 0 a 100. A referência prática é 68: acima disso, acima da média.

```javascript
const respostas = [4, 2, 5, 1, 4, 2, 5, 1, 3, 2];
let soma = 0;
for (let i = 0; i < respostas.length; i++) {
  soma += i % 2 === 0 ? respostas[i] - 1 : 5 - respostas[i];
}
console.log("SUS: " + soma * 2.5);
```

Isto imprime `SUS: 82.5`. Confere com a conta feita à mão no exemplo abaixo, por isso podes reutilizar este trecho com as respostas dos teus participantes.

Para ver o questionário explicado pergunta a pergunta:

[Vídeo: The System Usability Scale (SUS)](https://www.youtube.com/watch?v=UMv_OW9__qY)

A miniatura vem do YouTube. O vídeo só carrega quando clicas. [Abrir no YouTube](https://www.youtube.com/watch?v=UMv_OW9__qY)

## Exemplo: calcular um SUS

Uma resposta à app de estudo em grupo: $[4, 2, 5, 1, 4, 2, 5, 1, 3, 2]$.

Ímpares (menos 1): $(4-1) + (5-1) + (4-1) + (5-1) + (3-1) = 3 + 4 + 3 + 4 + 2 = 16$. Pares (5 menos a resposta): $(5-2) + (5-1) + (5-2) + (5-1) + (5-2) = 3 + 4 + 3 + 4 + 3 = 17$. Soma $16 + 17 = 33$; vezes 2,5 dá **82,5**.

Interpretação: 82,5 está bem acima de 68, por isso este participante avalia a app como claramente acima da média. Repara que a alternância positivo/negativo apanha respostas automáticas: quem responde 5 a tudo soma pouco nos pares. Se dez respostas derem média 76 com mínimo 60, concluis que a app está bem recebida mas há pelo menos um utilizador com dificuldades a investigar nas entrevistas.

Como relatar números pequenos

Com poucos participantes, apresenta cada valor e a média, nunca só a média. “Média 76 (60 a 90, n igual a 10)” diz muito mais do que “76”. E junta sempre uma citação ou observação que explique os extremos.

## Analisar respostas abertas: codificação temática

Três respostas à pergunta “o que correu mal na sessão” raramente dão três problemas diferentes. A **codificação temática** agrupa citações em 2 ou 3 temas e conta quantas caem em cada um. Exemplo com respostas reais:

1.  “Não percebi se a sessão ficou marcada.”
2.  “A notificação chegou mas não diz a sala.”
3.  “Tive de perguntar ao grupo se estava tudo bem.”

Primeira passagem: sublinha o essencial de cada uma (confirmação invisível, notificação incompleta, verificação com o grupo). Segunda passagem: junta em temas. “Confirmação invisível” fica com as respostas 1 e 3; “notificação incompleta” fica com a 2. Resultado: 2 temas, com contagens 2 e 1. O relatório diz então “2 de 3 participantes não viram confirmação”, que prioriza a correção, em vez de listar três frases soltas. Com mais respostas, os temas estabilizam e os que aparecem uma vez viram notas de rodapé, não prioridades.

## Para saber mais

*   MeasuringU, [System Usability Scale (SUS)](https://measuringu.com/sus/): guia do SUS com o cálculo e o valor de referência 68.

## Para levar para a próxima página

Estudos dão-te necessidades, pontuações e citações. Mas há utilizadores que os testes médios esquecem: quem não vê bem, não usa rato ou não ouve. Desenhar para eles é a [acessibilidade](https://resumos.rgo.pt/cadeiras/ipc/estudos-utilizadores/acessibilidade-multimodal/).

## Notas de rodapé

1.  Brooke, J., SUS: A quick and dirty usability scale, 1986. [Voltar](https://resumos.rgo.pt/cadeiras/ipc/estudos-utilizadores/#user-content-fnref-brooke)
