Convarca · Duelo de escenarios · Cómo revisar
Protocolo de la sesión (Rolo + Gyilkos)
Esto elige TERRITORIO y candidato a testear — jamás "el diseño que convierte" (n=2, cero clientes). El actor (copy, calculadora, IA) es idéntico por construcción en las 4: se juzga SOLO el escenario. La preferencia estética se anota aparte y NO suma al total.
Regla de decisión (pre-registrada, antes de mirar): el score ponderado decide. Override de Rolo permitido — POR ESCRITO y con razón nombrada (queda como decisión loggeada). Diferencia ≤0.3 entre los dos primeros = empate: ambos avanzan a finalistas. Máximo 2 finalistas → ronda cualitativa con compradores CR reales → el A/B post-launch decide, incondicional.
Orden de la sesión (el orden ES el anti-sesgo)
- 5 segundos naive, DESKTOP primero (en 390 el card tapa el escenario). Cada uno anota sin hablar: ¿qué ofrece la página? ¿primera acción? ¿el total parece completo o estimado? Orden de variantes distinto para cada evaluador. ANTES de ver strips, grises o incumbentes.
- Diagnósticos: squint (¿el card gana la masa? — jerarquía, no a11y) · escala de grises · caminar la tarea (editar peso → leer total) · strips de estados.
- Lineup de incumbentes (recién ahora — antes primea): variantes junto a Jetbox/Aeropost. "¿Cuál te cobra lo que cotizó?" con UNA razón escrita que cite algo visible. "Me gusta" invalida el score (vuelve a 3).
- Pasada mobile (390 en marco webview + crop 360): lectura de integridad, NO comprensión naive (ya conocés el contenido). Gate: nadie gana sin su 390 aprobado.
- Scoring criterio-por-criterio (un criterio a través de las 4, no variante por variante), hojas independientes — Gyilkos puntúa primero y sella. Discusión solo en divergencias ≥2. El control se confirma al final.
- D se evalúa APARTE (anexo): solo distintividad y fit de marca. No comparable causalmente con B/C.
Rubric (1-5 por criterio; evidencia escrita para todo 4-5)
| Criterio (definiciones NO solapadas) | Peso | Se mide con |
| Jerarquía de la calculadora — óptica: el card domina la masa visual | 25% | Squint + grises |
| Comprensión 5s — semántica: qué es esto + primera acción nombrada | 20% | Exposición naive |
| Registro de confianza — "me cobra lo que cotizó" | 15% | Lineup + razón |
| Integridad mobile/webview — sobrevive 390/360 con chrome y teclado | 15% | Pasada mobile |
| Distintividad — ¿confundible con incumbente o template? | 10% | Lineup |
| Proxy perf/complejidad — efectos con costo de paint; shell HTML semántico | 15% | Conteo de efectos |
Gates ANTES de puntuar (descalifican, no restan): contraste por estado bajo AA · card subordinado · textura del escenario dentro de inputs · no construible como HTML semántico liviano. Fallo de gate reparable = UNA corrección axis-neutral (que el ruido de ejecución no mate un territorio). Resiliencia de paleta-swap e INP: chequeos técnicos post-selección, no criterios. Lecturas pareadas A-B y A-C antes de cualquier ranking.
Las 3 trampas que van a aparecer:
1. Frankenstein ("el gradiente de A con el fondo de C"): bloqueado — son ecosistemas; primero se aprende POR QUÉ ganó lo que ganó.
2. Conversión fantasma ("creo que C convierte mejor"): nadie en la sala lo sabe; eso lo decide tráfico real.
3. La ventaja del control: Rolo lo reconoce y le gusta — por eso el scoring es criterion-major con evidencia escrita, Gyilkos primero, y el override queda loggeado.
Advertencia de backdrop: el lienzo del canvas no es gris medio — al comparar, abrí cada artboard en vista expandida (el mat gris propio de cada placa iguala el entorno). Excluidos a propósito del duelo: variante con foto (esperando tomas reales), variante estilo-incumbente (strawman). Estrategia completa y razones: artifact "Duelo de Escenarios".