Ebook Salll · Nº 34 · Método
Pare de perguntar se a pessoa entendeu. Peça para encontrar, lembrar, distinguir e explicar. Um protocolo de pesquisa que cabe numa tela, num roteiro e numa planilha.


Depois de explicar um caminho, perguntar se a pessoa entendeu é confortável. Pedir que ela repita o caminho mostra o que realmente ficou. A mesma diferença separa uma reunião de aprovação de uma pesquisa.
Uma PDP não precisa de câmera ocular, espelho falso ou laboratório para ser testada. Precisa de uma tarefa que possa dar certo ou errado, de uma medida compatível com a pergunta e de uma comparação que não mude tudo ao mesmo tempo.

ISO 9241-11 trata usabilidade como eficácia, eficiência e satisfação dentro de um contexto de uso. Essa separação é a defesa contra a conclusão preguiçosa. Uma página pode ser rápida e errada. Pode ser lembrada e desagradável. Pode parecer fácil e não permitir concluir a tarefa.
O que apareceu primeiro? Teste de exposição curta. Não mede interação.
A tarefa terminou certa? Variante, preço, condição e prova precisam fechar.
Quanto custou? Só vale junto com o critério de sucesso.
O que ficou sem pista? Produção espontânea depois que a tela some.
O que foi distinguido? Alvos e distratores, incluindo falsos alarmes.
Quanto trabalho pareceu exigir? NASA-TLX depois de tarefa concreta.
Como a pessoa se sentiu? Valência, ativação e controle, separadamente.
Quando a dúvida aparece? Registros próximos de episódios reais.
Lindgaard e colegas mostraram que pessoas formam avaliações de apelo visual em 50 milissegundos. Isso é evidência de primeira impressão rápida, não de entendimento rápido. Em 2016, Gronier comparou 68 participantes expostos por cinco segundos a 78 com tempo livre. O grupo de cinco segundos não capturou todos os objetivos da página e avaliou pior dimensões pragmáticas.
Produto, formato, quantidade, benefício dominante e elemento mais saliente.
Mostre uma captura estática, cubra a tela e comece com recall livre. Perguntas específicas entram depois para não contaminar o que veio espontaneamente.
PDP densa, público mais heterogêneo ou hipótese de complexidade.
Kuric e colegas, com 120 participantes, mostraram que memória de trabalho, velocidade perceptual e complexidade visual alteram o feedback em exposições de 2, 5 e 10 segundos.
Encontrar preço, escolher variante, verificar compatibilidade, comparar opções ou localizar prova.
Quando há interação, cronometre acerto, erro e abandono. Uma captura de cinco segundos não substitui a página em uso.
No estudo de Gronier, identificação do objetivo principal, AttrakDiff total e avaliação de design não apresentaram diferença significativa. O efeito apareceu em dimensões pragmáticas e qualidade da informação. A conclusão útil não é "cinco segundos funcionam" nem "não funcionam". É que o método mede outra camada.
Uma pessoa pode responder em nove segundos porque escolheu o pacote errado. Outra pode levar quarenta porque conferiu a condição de assinatura. Sem definir o final correto, o cronômetro premia atalho, erro e abandono.
Você precisa de café para prensa francesa, sem acidez alta. Descubra se este produto serve e qual é o preço final da opção de 250 g.
Sucesso, sucesso parcial, erro crítico, abandono, início e fim do relógio.
Think-aloud pode alterar duração. Se a fala for necessária, use o mesmo protocolo em todas as versões e trate o tempo como dado daquele protocolo.
Cliques, voltas, mudança de variante, consulta à galeria, expansão do A+ e ponto da hesitação.
Quem errou ou abandonou não entra na mesma mediana de quem concluiu corretamente.
Mediana, dispersão e trajetórias individuais. Uma média sozinha esconde dois modos de falha.
O primeiro pede produção sem pista. O segundo apresenta alternativas. Koriat e Goldsmith mostraram que formato do teste, quantidade recuperada e precisão precisam ser separados. Em PDP, isso impede chamar familiaridade de memória espontânea.
"Conte tudo o que você lembra da oferta, na ordem que vier."
Codifique produto, formato, quantidade, benefício, condição, preço, review e prova como correto, aproximado, ausente ou falso.
Risco: ausência não prova que a informação nunca foi vista.
"Quais destas informações apareceram na página?"
Misture alvos e distratores plausíveis. Registre acertos, rejeições corretas e falsos alarmes.
Risco: contar apenas acertos premia quem marca tudo.
| Ordem correta | Por quê | Exemplo em PDP |
|---|---|---|
| 1. Recall livre | Preserva o que veio sem pista. | "O que você lembra do café?" |
| 2. Pergunta específica | Testa uma unidade que pode ter sido omitida no relato. | "Qual era a quantidade?" |
| 3. Reconhecimento | Mede discriminação diante de alternativas. | 250 g / 500 g; baixa acidez / cítrica. |
| 4. Confiança | Mostra se certeza e acerto caminham juntos. | Escala de 1 a 5. |
Mede carga de trabalho subjetiva depois de uma tarefa. A média pode esconder fontes diferentes de dificuldade, por isso as subescalas precisam continuar visíveis.
Mede reação afetiva por figuras. Valência agradável não é confiança. Ativação alta pode ser entusiasmo ou tensão. Dominância representa sensação de controle e merece leitura cautelosa.
NASA-TLX nasceu de 16 experimentos de fatores humanos. SAM foi comparado a um diferencial semântico de 18 itens e mostrou alta convergência para prazer e ativação. Ambos são instrumentos subjetivos. Nenhum substitui acerto, tempo ou observação.
Uma revisão de 2025 sobre NASA-TLX em HCI encontrou problemas de definição, aplicação, validade convergente e sensibilidade. Em 2026, uma revisão de 522 artigos CHI encontrou grande variação de uso e menor distinção entre subescalas do que no desenvolvimento original. Use para comparar tarefas dentro do estudo, não como nota universal.
Experience sampling e ecological momentary assessment pedem registros curtos perto do evento real. Em vez de "como você compra café online?", a pessoa registra a PDP que abriu, a dúvida que apareceu, o dispositivo, o canal e o que fez depois.
Abrir uma PDP, abandonar, salvar ou adicionar ao carrinho.
O registro precisa acontecer logo depois, sem depender da reconstrução de uma semana inteira.
Categoria, canal, dispositivo, objetivo, dúvida, informação faltante, confiança e desfecho.
Formulário longo reduz adesão e pode mudar o próprio comportamento que se deseja observar.
Vários eventos pertencem à mesma pessoa.
Cem registros de dez pessoas não equivalem a cem participantes independentes. Analise variação dentro e entre pessoas.
Uma pessoa que compra a categoria toda semana enxerga diferenças que o iniciante nem sabe nomear. Uma pessoa com baixa visão expõe dependência de cor. Quem já devolveu o SKU errado reconstrói o incidente que uma pergunta genérica não alcança.
Compara atributos finos, ignora explicações básicas e cria atalhos próprios.
Expõe vocabulário interno, hierarquia presumida e falta de contexto.
Mostra o que some quando a página degrada, empilha ou carrega tarde.
Testa se estado, relação e sequência sobrevivem fora do arranjo visual.
Revela quais atributos permitem voltar e distinguir uma oferta da outra.
Reconstrói um incidente real de tamanho, sabor, compatibilidade ou quantidade.
Conte a última vez em que você quase comprou a variante errada. O que apareceu primeiro, o que você esperava e onde percebeu o erro?
Defina a dimensão extrema antes do recrutamento. Entreviste também pessoas do mainstream. O extremo amplia a falha; o centro mostra se a correção cria outro custo.
"Estamos testando a página, não você. Eu não criei esta versão. Algumas tarefas podem ser impossíveis."
Exposição de cinco segundos, recall livre e três perguntas específicas escritas antes.
Escolher variante, fechar preço e condição, localizar prova e responder com base na página.
NASA-TLX, SAM e uma pergunta neutra sobre o que contribuiu para a avaliação.
Alvos e distratores, depois um episódio recente de compra ou abandono da categoria.
| Moderador pode dizer | Moderador não pode dizer durante a tarefa |
|---|---|
| "O que você faria agora?" | "Você viu o preço ali?" |
| "O que você esperava que acontecesse?" | "Tente a galeria." |
| "O que fez você pensar isso?" | "Acho que você entendeu errado." |
| "Continue como faria sozinho." | "Essa versão está mais clara?" |
Cinco segundos + recall. Acerto de produto, formato e quantidade.
Recall + reconhecimento. Atributos necessários e falsos alarmes.
Tarefa cronometrada. SKU correto, estado selecionado, erro crítico e tempo.
Recall. Benefício e condição precisam sobreviver como par correto.
Tarefa + caminho. Encontrar a prova necessária, não apenas navegar.
Tarefa + reconhecimento. Localizar detalhe e interpretar corretamente.
Resposta final + confiança. Valor, variante e condição no mesmo escopo.
SAM + incidente. Sensação de controle e causa narrada, sem chamar valência de compra.
Faulkner testou 60 pessoas e reamostrou grupos menores. Alguns conjuntos de cinco encontraram 99% dos problemas; outros, apenas 55%. Cinco pessoas podem abrir uma rodada. Não podem fechar qualquer decisão.
Por segmento. Localiza falhas, melhora roteiro e gera hipótese. Não estima porcentagem de mercado nem declara uma versão vencedora.
Por segmento no teste de exposição; ou pessoas por 5-7 dias no diário. Serve para padrões qualitativos e teste do instrumento.
Mostra direção, variabilidade e trajetórias individuais. Não garante significância nem prova equivalência.
Dimensione pelo menor efeito relevante, métrica primária e desenho. Binário, tempo, escala e dados repetidos pedem cálculos diferentes.
Os intervalos acima são recomendações operacionais Salll para pesquisa formativa, não thresholds científicos universais.
| Resultado | Decisão permitida | Decisão proibida |
|---|---|---|
| 4 de 5 erraram a variante | Tratar como sinal grave e corrigir antes da próxima rodada. | Publicar que 80% do mercado erra. |
| Tempo caiu em 6 de 8 pessoas | Manter a hipótese viva e estimar variabilidade. | Declarar ganho universal de eficiência. |
| Diferença não significativa | Reportar incerteza e intervalo. | Concluir que A e B são equivalentes. |
| NASA-TLX total igual | Examinar subescalas e desempenho. | Concluir que o esforço foi idêntico. |
Uma planilha simples preserva o protocolo, separa estados e deixa o resultado auditável. Dado ausente, erro de captura, tarefa impossível e resposta errada não podem compartilhar a mesma célula vazia.
| Aba | Campos mínimos | Regra defensiva |
|---|---|---|
| participantes | ID, segmento, extremo, dispositivo, familiaridade, ordem | Sem nome no arquivo de análise. |
| tarefas | versão, tarefa, início, fim, tempo, status, resposta, erro crítico | Falha separada de tempo válido. |
| memória | modo, item, alvo, resposta, classificação, confiança | Preservar resposta original. |
| escalas | instrumento, dimensão, valor, escala, variante | Raw TLX declarado; SAM sem soma global. |
| esm | evento, horário, canal, dispositivo, dúvida, confiança, desfecho | Eventos continuam ligados à pessoa. |
| dicionário | definição, valores permitidos, unidade, código de ausência | Nada fica implícito. |
Café Salll Manaus é uma marca-demo fictícia. O exercício abaixo mostra como uma equipe sai de "parece clara" para uma decisão rastreável sem inventar conversão.
A Salll transforma o achado em regra de cadastro, correção por canal e monitoramento. O teste não termina na apresentação. Termina quando a versão correta foi publicada, confirmada e passou pela próxima rodada.
Hipótese, versão, tarefa, critérios, conteúdo, adaptação por canal e correção da PDP.
Confirmação do publicado, regressão, mudança de varejo e recorrência da falha.
Ex-sócio de operação Amazon na Europa, hoje à frente da metodologia Salll de execução em digital shelf. Este ebook é parte da série que documenta o método, capítulo a capítulo.
Nota metodológica: estudos de HCI, psicologia, fatores humanos e pesquisa de campo sustentam instrumentos e limites. A aplicação a imagem principal, título, variantes, bullets, galeria, A+, preço e confiança é uma tradução operacional Salll para teste. Nenhuma medida isolada prova conversão.