Ir al contenido

Comparación de ejecuciones

En esta página

Compare ejecuciones completadas con la misma versión de carga, modelo de evaluación y perfil. El porcentaje de cambio describe la diferencia de los números, pero por sí solo no demuestra el efecto de un ajuste.

Antes de comparar los números, verifique la compatibilidad del par de ejecuciones por los archivos de resultados: en cada uno de ellos están fijados la versión de carga —un identificador constante de su composición— y el modelo de puntuación, así como la versión de la estadística. Compare estos campos por pares: si la carga o el modelo de puntuación no coinciden, las ejecuciones pertenecen a protocolos distintos y sus puntuaciones son directamente incomparables. Cómo están construidas estas identidades se describe en la metodología.

  1. Anote el modelo del procesador y de la tarjeta gráfica, las versiones de Windows y del controlador. Entre las pruebas no cambie el modo de energía ni la refrigeración. Utilice el mismo conjunto de programas en segundo plano.
  2. Primero realice al menos tres pruebas sin cambiar los ajustes. Así verá la dispersión habitual de los resultados. Para concluir sobre diferencias pequeñas puede que se necesiten más repeticiones.
  3. Cambie un ajuste y repita las pruebas. Si se necesita un reinicio, realícelo también antes de la serie con los ajustes iniciales. Antes de cada ejecución espere el mismo tiempo.
  4. Si es posible, compruebe los ajustes iniciales, luego los modificados y después de nuevo los iniciales: A → B → A. Esta secuencia ayuda a separar el efecto del ajuste del calentamiento y de la carga en segundo plano.
  5. Guarde todos los resultados. Determine de antemano qué fallos hacen que una prueba no sea apta para la comparación, por ejemplo una interrupción de la ejecución. Si excluye una prueba, indique el motivo. Una puntuación baja por sí sola no es motivo para eliminarla.

Mantén la misma resolución de pantalla y el mismo modo de ventana o pantalla completa. Si vas a comprobar el efecto de la resolución, repite la prueba varias veces con cada resolución elegida.

Δ score, % = 100 × (mean_after / mean_before − 1)
CV, % = 100 × sample_standard_deviation / mean

Compara los valores medios y la dispersión entre ejecuciones. Comprueba no solo la puntuación final, sino también las puntuaciones individuales, las latencias en milisegundos y la velocidad de ejecución de las cargas (throughput). Para las latencias, una diferencia negativa suele significar una mejora; para las puntuaciones, una diferencia positiva significa un aumento de la puntuación.

Para comprobar la repetibilidad, cuenta ejecuciones completas. Miles de fotogramas dentro de una misma prueba no sustituyen a pruebas repetidas: todos ellos se obtienen en una sola sesión y dependen de condiciones comunes.

Un cambio pequeño respecto a la dispersión habitual requiere repeticiones adicionales. No se puede establecer un umbral universal como «todo lo que supere el 1% es significativo» a partir de una sola serie. Incluso una diferencia estadísticamente distinguible puede ser demasiado pequeña para tener un efecto práctico.

El diagnóstico por bloques ya está integrado en los resultados: para cada carga se guardan la dispersión de la velocidad de ejecución por bloques, el desplazamiento «primero-último» y la tendencia por pasos. Esto permite juzgar si la diferencia entre dos ejecuciones supera el ruido observado dentro de ellas, incluso antes de nuevas repeticiones. Las fórmulas con las que los bloques se agregan en puntuaciones están abiertas en el cálculo de puntuaciones.

En la serie de ocho ejecuciones se compararon repeticiones y resoluciones en un sistema optimizado. No contiene un estado sin optimizar y, por tanto, no demuestra la ganancia de BoosterX.

La prueba sintética ayuda a investigar cambios en el funcionamiento del sistema. Para comprobar el beneficio para un juego concreto, repita la comparación en su escenario de juego reproducible.

Verificado: 2026-09-20.