Guía para el/la docente · respuestas cifradas
CÁPSULA 08 · APRENDIZAJE ACTIVO
Evaluación de sistemas interactivos
GUÍA PARA EL/LA DOCENTE · CON RESPUESTAS

Usability Speed-Test

Cómo se organiza

Reparto minuto a minuto — los 10 pasos de la hoja

Métodos canónicos por contexto

La hoja pide uno de cada familia, no una combinación libre: los Pasos 4 y 6 son de opción única. Cuando un grupo dude, la pregunta que desatasca no es «¿cuál es mejor?» sino «¿cuál de estos puede responder la pregunta que escribieron en el Paso 3?».

  1. Think-aloud: gran cualidad de insight, mal en cuantificación. Úsenlo cuando quieran entender interpretaciones erróneas del estado del sistema o modelos mentales del usuario.
  2. Observación: para detectar lo que el usuario NO dice: vacilaciones, gestos abortados, expresiones de sorpresa o frustración. Imprescindible cuando el think-aloud romperá el flow.
  3. Entrevista post-tarea: para entender el porqué detrás de una acción concreta. 3-4 preguntas abiertas, no más.
  4. Co-discovery: dos testers juntos; la conversación entre ellos es el dato. Cuesta el doble de voluntarios, así que solo tiene sentido si el prototipo es de uso compartido.
  5. Conteo de intentos / tiempo a primera acción: baratos y comparables, pero solo si el grupo fija antes qué cuenta como logro y quién lleva la cuenta. Eso es exactamente lo que piden los recuadros `def_conteo` y `def_tiempo`.
  6. Cuestionario Likert breve: para tendencias gruesas con poca muestra. Tres ítems bien redactados valen más que diez mediocres.
  7. Ranking de funcionalidades: el único método que produce un dato ordinal. La lista se escribe antes de la sesión (grid `ranking_items`) y el orden de cada tester entra en la columna *Métrica* del Paso 8, con el formato «orden T1: B > A > C».
  8. SUS: estandarizado y comparable entre prototipos. Útil si esperan iterar y querrán medir mejora.

Plantilla SUS — ya está dentro de la hoja del estudiante

Los 7 ítems adaptados al contexto ubicuo aparecen en el Paso 7 de la hoja, en el recuadro que se despliega al marcar SUS: no hay que dictarlos, proyectarlos ni repartirlos. Se reproducen aquí solo para que puedan responder de memoria cuando un grupo pregunte si puede cambiar el ítem 3.

  1. 1. El sistema reaccionó cuando esperaba que lo hiciera.
  2. 2. Pude saber qué estaba haciendo el sistema en cada momento.
  3. 3. El sistema entendió mis intenciones sin que tuviera que repetir.
  4. 4. Las acciones que tomé se sintieron naturales para el contexto.
  5. 5. Cuando el sistema se equivocó, pude entender por qué y corregirlo.
  6. 6. Me sentí en control durante la interacción (no al revés).
  7. 7. Usaría este sistema en mi vida cotidiana si estuviera disponible.

La respuesta a esa pregunta es no: si cada grupo redacta su propia versión, se pierde lo único que el SUS aporta, que es la comparabilidad. Y una precisión que suele hacer falta: esta es una adaptación de 7 ítems, así que no aplica la fórmula clásica de 0-100 del SUS original de 10 ítems. Lo que se reporta en la columna *Métrica* es el valor 1-5 de cada ítem por tester; para la puesta en común basta el promedio por ítem, y el ítem más bajo suele ser el que vale discutir.

Respuestas esperadas — criterios de síntesis cuali-cuanti

P1 · ¿Cuándo un descubrimiento cuali invalida el cuanti?

Respuesta cifrada — ingresa la contraseña en la barra superior para verla.

P2 · ¿Tamaño mínimo de muestra para un test rápido?

Respuesta cifrada — ingresa la contraseña en la barra superior para verla.

P3 · Trampa típica: medir tiempo cuando el problema es la confusión

Respuesta cifrada — ingresa la contraseña en la barra superior para verla.

P4 · ¿Cuándo una pregunta Likert está mal redactada?

Respuesta cifrada — ingresa la contraseña en la barra superior para verla.

P5 · La diferencia entre 'usable' y 'útil'

Respuesta cifrada — ingresa la contraseña en la barra superior para verla.

P6 · Cómo leer el plano impacto / esfuerzo del Paso 10

Respuesta cifrada — ingresa la contraseña en la barra superior para verla.