Una presentación de resultados de una prueba piloto debe ayudar a decidir si conviene ampliarla, ajustarla, prolongarla o detenerla. Muestra los criterios de éxito originales junto a los resultados observados y explica las ventajas y los inconvenientes. Un indicador principal prometedor no anula un objetivo incumplido de calidad o de carga de trabajo.
Organiza el relato en torno a una decisión: qué se probó, qué ocurrió, qué no permiten concluir las pruebas y cuál debería ser el siguiente paso. Después de revisar las notas, puedes convertir el resumen de la prueba en un borrador de diapositivas con Presenti. El ejemplo siguiente transforma unos resultados mixtos en una revisión de siete diapositivas, sin dar por hecho que la prueba fue un éxito.

Empieza por la decisión que debía orientar la prueba
«Actualización de la prueba piloto» describe una reunión, no su propósito. Una pregunta útil es más concreta: «¿Introducimos el nuevo formulario de solicitudes en otro departamento, repetimos la prueba después de un cambio o mantenemos el proceso actual?».
Junto a la pregunta, indica el alcance: quién participó, qué parte del flujo de trabajo cambió, cuánto duró la prueba y qué quedó fuera. El resultado de un departamento puede respaldar una decisión sobre la siguiente prueba sin justificar una implantación en toda la empresa.
La guía del GOV.UK Service Manual sobre la medición de beneficios recomienda acordar las métricas al principio de la fase beta y comparar los beneficios observados con las previsiones para decidir si continuar. En la presentación de una prueba piloto, eso significa llevar los criterios originales a la reunión, en vez de escoger las medidas más atractivas después de conocer el resultado.
Si los criterios no se acordaron de antemano, dilo. Aun así, puedes describir lo ocurrido y proponer cómo evaluar la siguiente prueba. No presentes retrospectivamente un umbral conveniente como si hubiera sido el objetivo original.
Ejemplo desarrollado: solicitudes más completas, con una carga de apoyo
Supongamos que un equipo de servicios internos prueba un formulario de solicitudes revisado. El periodo de referencia abarca cuatro semanas con el proceso anterior; la prueba dura dos semanas en un departamento. Las siguientes cifras y umbrales son datos ficticios con fines didácticos, no un caso de cliente ni un resultado obtenido con Presenti.
| Medida | Proceso anterior: cuatro semanas | Nuevo formulario: dos semanas |
|---|---|---|
| Solicitudes distintas enviadas | 100 | 50 |
| Solicitudes con información completa en el primer envío, sin necesidad de aclaraciones | 76 | 46 |
| Solicitudes resueltas en la fecha de corte de la observación | 80 | 45 |
| Solicitudes resueltas que necesitaron corregir un error de introducción de datos registrado | 4 | 3 |
| Trabajo de apoyo adicional registrado para el nuevo formulario | No medido con este criterio | 120 minutos |
«Información completa en el primer envío» se determina a partir de los campos enviados y del registro de aclaraciones. No equivale a «resuelta»: una solicitud completa puede seguir esperando revisión y una incompleta puede resolverse después de una aclaración. Cada solicitud se cuenta una sola vez, aunque genere varios mensajes.
Las cinco solicitudes pendientes de la prueba siguen dentro del total de envíos. Tres esperan una respuesta de la persona solicitante y dos, de una persona revisora. Excluirlas cambiaría la población analizada y dificultaría la interpretación.
Mantén cada denominador junto a su resultado
La proporción de solicitudes con información completa en el primer envío pasa de 76 ÷ 100 = 76 % a 46 ÷ 50 = 92 %: un aumento de 16 puntos porcentuales. «Sube un 16 %» no significa lo mismo. Muestra los recuentos además de los porcentajes para que se vea el tamaño de cada grupo.
La tasa de corrección de errores de introducción de datos responde a otra pregunta: de las solicitudes resueltas en la fecha de corte, ¿cuántas necesitaron una corrección? Es 4 ÷ 80 = 5 % con el proceso anterior y 3 ÷ 45 ≈ 6,7 % durante la prueba. No uses 3 ÷ 50 para una medida definida expresamente sobre las solicitudes resueltas.
En la prueba solo hay tres correcciones registradas. Su naturaleza y gravedad importan, y las cinco solicitudes pendientes todavía podrían cambiar el panorama posterior. Las cifras actuales describen la fecha de corte; no establecen una tasa estable de errores a largo plazo.
El dato de apoyo es 120 ÷ 50 = 2,4 minutos adicionales de trabajo del personal por solicitud enviada. Es tiempo dedicado a ayudar a utilizar el nuevo formulario, no tiempo de espera del cliente, tiempo de tramitación ni tiempo ahorrado. Como el periodo de referencia no midió la misma actividad de apoyo, esta tabla no permite demostrar un ahorro neto de trabajo ni un cambio de carga entre el antes y el después.
Muestra los resultados mixtos en lugar de ocultarlos en una media
En este ejemplo, el equipo acordó tres criterios antes de la prueba. Son umbrales de esta decisión ficticia, no referencias del sector.
| Criterio acordado | Observación durante la prueba | Resultado en la fecha de corte |
|---|---|---|
| Al menos el 90 % con información completa en el primer envío | 46/50 = 92 % | Cumplido |
| Como máximo, el 5 % de las solicitudes resueltas necesita corregir un error de introducción de datos | 3/45 ≈ 6,7 % | No cumplido |
| Como máximo, 2 minutos adicionales de apoyo por solicitud enviada | 120/50 = 2,4 minutos | No cumplido |
Un titular como «El nuevo formulario supera la prueba con un 92 % de éxito» ocultaría dos criterios incumplidos y convertiría la integridad de la información en una puntuación de éxito global. Mejor: «Llegan más solicitudes completas; los objetivos de corrección y apoyo siguen sin cumplirse».
No promedies las tres medidas para obtener un único semáforo. Describen cosas diferentes, tienen unidades distintas y se eligieron para proteger frente a problemas distintos. Si la dirección decide continuar a pesar de un criterio incumplido, registra la decisión y sus condiciones, en vez de reescribir el resultado como si se hubiera superado la prueba.
Separa la mejora observada de su explicación
El formulario cambió, pero también lo hizo el periodo de observación y, quizá, las personas o los tipos de solicitudes. Fue una prueba con una muestra de conveniencia, sin asignación aleatoria ni grupo de comparación paralelo. La diferencia de 16 puntos no demuestra por sí sola que el formulario causara la mejora.
Busca explicaciones que puedan cambiar la siguiente medida. ¿Hubo una proporción mayor de solicitudes sencillas? ¿Prestó el personal más ayuda? ¿Quedó fuera una época de gran actividad? ¿Se usaron las mismas reglas para decidir si la información estaba completa en ambos grupos? Estas preguntas deben aparecer junto al resultado, no en un aviso genérico al final.
En la prueba ficticia, el equipo sospecha que un campo ambiguo contribuye al trabajo de corrección. Es una hipótesis. Examina los tres registros corregidos y las notas de apoyo antes de afirmar que hay una causa común. Si los registros muestran problemas distintos, reformular un único campo quizá no resuelva todos.
Mantén separadas las observaciones cualitativas y los recuentos. Un comentario puede explicar una confusión, pero no demuestra con qué frecuencia ocurre. Si dispones de una cita, utiliza un texto autorizado y atribuible; no inventes testimonios para que la diapositiva parezca más humana.
Recomienda un siguiente paso de alcance limitado
Aquí, una propuesta razonable es revisar los casos de corrección, aclarar el campo cuestionado cuando las pruebas respalden ese cambio y repetir una prueba de alcance similar antes de ampliarla. Es una propuesta, no una aprobación ni una previsión de que se cumplirán los objetivos.
El siguiente resumen debe indicar la versión revisada del formulario, el departamento participante, el periodo de observación, el apoyo previsto, las definiciones de las métricas y los criterios de decisión. Conserva las mismas medidas si siguen respondiendo a la pregunta. Si cambia una definición, explica por qué y evita comparar la cifra nueva con la antigua como si nada hubiera cambiado.
Acuerda con la persona responsable del análisis o del servicio un periodo de observación y un plan de participación adecuados para la decisión. «La última vez bastaron cincuenta solicitudes» no justifica una afirmación estadística. Este ejemplo no incluye un cálculo del tamaño de la muestra ni una prueba de significación.
Si quien patrocina la prueba quiere ampliarla de inmediato, concreta qué se aceptaría: qué departamentos, con qué apoyo, con qué riesgos pendientes y ante qué observación se interrumpiría. Una implantación completa supone un compromiso distinto de incorporar a un equipo adicional.
Un esquema de siete diapositivas para presentar los resultados
- Recomendación. Repetir una prueba de alcance limitado después de revisar los problemas de corrección y apoyo; todavía se solicita aprobación.
- Alcance de la prueba. Mostrar el proceso anterior y el nuevo, participantes, periodos, fecha de corte y límites de la comparación.
- Criterios originales. Presentar los tres umbrales acordados antes de los resultados.
- Resultados observados. Mostrar 76/100 frente a 46/50, 4/80 frente a 3/45 y 120/50 minutos de trabajo del personal. Mantener las medidas separadas.
- Qué sigue sin explicación. Mostrar las solicitudes pendientes, los casos de corrección, las notas de apoyo y el posible problema del campo, sin declarar una causa.
- Siguiente prueba o alternativa. Concretar qué cambiaría, qué seguiría siendo comparable y qué decisión debería orientar la siguiente observación.
- Decisión y condiciones. Registrar lo que realmente acuerde quien patrocina la prueba, con responsable y fecha de seguimiento una vez confirmados.
Conserva los datos de cada solicitud y los cálculos en el material de apoyo. La presentación principal debe explicar la recomendación con suficiente detalle, sin obligar a reconstruir todos los denominadores durante la reunión.
Prepara un texto de entrada que conserve los resultados mixtos
Cuando la persona responsable del servicio haya revisado las cifras, utiliza la entrada Paste Text de Presenti —para pegar texto— y organiza las notas en un borrador de diapositivas. Introduce las definiciones y los límites junto a los números. No pidas a la herramienta que decida si la prueba tuvo éxito.

Crea una presentación de siete diapositivas sobre esta prueba ficticia de un formulario interno. Referencia: cuatro semanas, 100 solicitudes distintas, 76 con información completa en el primer envío, 80 resueltas y 4 solicitudes resueltas que necesitaron corregir un error de introducción de datos. Prueba: dos semanas en un departamento, 50 solicitudes, 46 con información completa en el primer envío, 45 resueltas, 3 solicitudes resueltas que necesitaron corrección y 120 minutos adicionales de apoyo del personal. Quedan cinco solicitudes pendientes: tres esperan a la persona solicitante y dos, a una persona revisora. Muestra el 76 % frente al 92 %, una diferencia de 16 puntos porcentuales; el 5 % frente a aproximadamente el 6,7 % de correcciones entre las solicitudes resueltas; y 2,4 minutos de apoyo por solicitud de la prueba. Los criterios previos de este ejemplo son al menos un 90 % de información completa, como máximo un 5 % de correcciones y como máximo 2 minutos de apoyo. Solo se cumple el criterio de información completa. No fue una prueba aleatorizada. Recomienda revisar los problemas de corrección y apoyo antes de repetir con un alcance similar; mantén la decisión pendiente de aprobación. No inventes causalidad, ahorros, significación estadística ni una implantación exitosa.
En el borrador, comprueba que cada porcentaje conserve su recuento, que no desaparezcan las solicitudes pendientes y que el tiempo de apoyo no se convierta en «tiempo ahorrado». Una revisión útil puede recomendar continuar y, a la vez, dejar claro que la prueba actual no ha cumplido todas las condiciones para ampliarla.