Screen Test Pro

Mil ejecuciones del benchmark 2.5: lo que el hardware puntúa de verdad

Por Screen Test ProPublicado el

El benchmark 2.5.0 salió el 20 de septiembre. En las dos semanas siguientes, 1.065 personas lo ejecutaron y dejaron que el resultado se contara. Es la primera vez que una versión de este benchmark se queda quieta el tiempo suficiente para reunir una cifra de cuatro dígitos de ejecuciones, así que es la primera vez que podemos decir cómo se ven las puntuaciones ahí fuera, y no solo en las máquinas de nuestras propias mesas.

Todo lo de abajo sale de esas ejecuciones, del 20 de septiembre al 3 de octubre. Los gráficos están vivos: cambia el corte, cambia la agrupación, pasa cualquiera de ellos a una tabla. Si has ejecutado el benchmark en este navegador, el primer gráfico ya conoce tu puntuación.

La mitad de las máquinas queda por debajo de 3.334

De las 1.065 ejecuciones, 665 terminaron limpias, y esas son las que usan los gráficos de puntuación. Su mediana es 3.334. Una décima parte queda por debajo de 636, una décima por encima de 13.583, y la mejor ejecución de la quincena fue 31.468.

Ejecuciones completas por puntuación, en escala logarítmica: cada barra es aproximadamente un tercio más ancha en puntuación que la anterior. Escribe una puntuación para ver dónde cae en el corte que elegiste.

Los nombres de nivel parten esa población de forma más pareja de lo que esperábamos al cortarlos: 19 % Básico, 28 % Equilibrado, 32 % Rápido, 22 % Extremo. Pasados los 20.000 se queda solo. Solo 21 ejecuciones llegaron, alrededor del 3 %.

La forma importa más que la mediana. Hay una joroba entre 400 y 1.300, un hueco justo encima, y luego una meseta larga desde unos 1.800 hasta más allá de 13.000. Eso no es una sola población de ordenadores. Son dos: máquinas con gráficos integrados, y todo lo demás.

La GPU decide casi todo

Agrupa las ejecuciones por familia de GPU y las dos poblaciones se separan.

La marca es la mediana, la barra es la mitad central de las ejecuciones, la línea fina va del percentil 10 al 90. Los grupos con menos de 15 ejecuciones se omiten.
Familia de GPU Ejecuciones completas Mediana Mitad central
GeForce 207 9.204 6.116 – 13.156
Radeon 81 3.270 1.194 – 12.841
Apple silicon 134 3.128 2.132 – 4.257
Adreno 42 2.564 1.322 – 4.537
Intel integrado 130 973 632 – 1.796
Mali 31 785 533 – 1.307

Una máquina GeForce típica puntúa unas nueve veces y media una típica con Intel integrado. La dirección no sorprenderá a nadie. El tamaño merece saberse si estás decidiendo si un portátil necesita la tarjeta dedicada.

Radeon es la fila rara. Su mitad central va de 1.194 a 12.841, una extensión de diez veces, porque el nombre cubre tanto los gráficos integrados en un chip de portátil Ryzen como una tarjeta de sobremesa que se mide con GeForce. Una mediana Radeon no describe a ninguna de las dos. Estrecha el gráfico a Radeon y agrupa por memoria, y las mitades se separan: 12.614 para máquinas con 17 GB o más, 2.496 para las de 9 a 16.

Apple silicon es lo contrario: ajustado. La mitad central de las ejecuciones Apple se sitúa entre 2.132 y 4.257, teléfonos, tabletas y Mac juntos. Estrecha a Apple y agrupa por sistema operativo, y el orden es el que adivinarías: Mac 3.961, iPad 3.451, iPhone 2.412. Un iPhone en la mediana supera al teléfono Android mediano en otra mitad, y gana al portátil Intel mediano por dos veces y media.

Ninguna máquina gana todas las escenas

El total esconde la parte más interesante. El benchmark son seis escenas, cada una apoyada en una parte distinta de la máquina, y las familias no conservan su orden de una escena a la siguiente.

Cada celda es la mediana de ese grupo en una escena, como múltiplo de la mediana de todas las ejecuciones. El azul está por encima del conjunto, el ámbar por debajo.

GeForce se queda con las escenas que son GPU pura. En Deriva nebular, un millón de partículas actualizadas en la tarjeta gráfica, su mediana es cinco veces el conjunto y siete veces la de Apple.

Luego mira Cascada estelar. Esa escena es física calculada en la CPU, en JavaScript, y Apple se la lleva: una mediana de 12.196 frente a 9.394 de GeForce. Separado por sistema operativo, es más nítido. El Mac mediano marca 17.390 en Cascada estelar y el PC Windows mediano 7.729. El iPhone mediano, en 11.593, gana al PC Windows mediano en física de CPU.

Canvas 2D va por el mismo camino. Los Mac dejan una mediana de 10.085 en la escena de círculos sencillos y las máquinas GeForce 4.448. Agrupado por navegador, la mediana de Safari ahí es dos veces y media la de Chrome. No es solo el chip. Es el chip más un navegador cuyo canvas 2D es muy rápido, que es lo que encontramos el mes pasado en un Mac con cinco navegadores y que ahora se ve en unos cientos de máquinas de desconocidos.

Así que una sola puntuación es un resumen justo y una descripción pobre. Un Mac y un PC de juegos de gama media pueden caer en el mismo total sin haberse puesto de acuerdo en nada por el camino.

Lo que una batería cuesta de verdad

Toma cada ejecución de sobremesa y de portátil y sepárala por fuente de alimentación. Enchufado, la mediana es 4.697. Con batería, 1.700. Parece que desenchufar te cuesta casi dos tercios del rendimiento.

No es así. Estrecha el gráfico de arriba a GeForce y agrupa por fuente de alimentación: con batería la mediana es 11.830, enchufado 9.207. Diecisiete ejecuciones con batería son una muestra fina, así que no diríamos que la batería es más rápida, solo que no se ve penalización. El Intel integrado dice lo mismo con más ejecuciones detrás: 1.061 con batería, 964 enchufado.

La brecha grande trata de quién está desenchufado. Una máquina con batería es un portátil, y la mayoría de los portátiles de esta muestra tienen gráficos integrados. Compara lo igual con lo igual y la brecha se cierra. Si tu propio portátil puntúa mucho más bajo desenchufado, eso es su plan de energía, y merece una mirada, pero no es la regla general que sugiere el número del titular.

La misma trampa está en el corte por tasa de refresco. Las ejecuciones en pantallas de 165 Hz o más tienen una mediana de 10.399, y las de pantallas a 60 Hz, 1.971. Un panel rápido no hace más rápida la GPU. Quien compra un monitor de 165 Hz también compra la tarjeta para moverlo. Solo dentro de GeForce la brecha se reduce a 10.506 contra 6.609, y lo que queda son sobre todo tarjetas más nuevas detrás de monitores más nuevos.

Una más, porque sale a menudo. Entre las ejecuciones GeForce, la mediana de Chrome es 10.583 y la de Edge 8.683. Los dos son el mismo motor. Lo leemos como quién usa qué navegador, y nada más.

Qué máquinas terminan limpias

Una ejecución es completa cuando cada escena encontró una carga que la máquina podía sostener y demostrar. Es limitada por calor cuando la máquina midió bien pero se ralentizó al calentarse. Es degradada cuando al menos una escena no se pudo medir bien. En las 1.065 ejecuciones: 62 % completas, 25 % limitadas por calor, 13 % degradadas.

Todas las ejecuciones enviadas, no solo las completas. La cifra de la derecha es la parte que terminó completa.

Las máquinas GeForce casi nunca fallan al medir: una ejecución degradada de 269. Los iPhone son el grupo más estable de todos, con un 78 % completas y una sola ejecución degradada en 64. Los teléfonos Mali lo pasan peor, con un 39 % degradadas, y las tabletas como clase terminan completas menos de la mitad de las veces. Fino, sin ventilador y caliente es un sitio difícil para sostener una carga estable durante tres minutos.

Que una cuarta parte de las ejecuciones quede limitada por calor es más de lo que querríamos. Parte de eso es calor de verdad, y comunicarlo es el sentido de la marca. Parte sigue siendo que el benchmark se descoloca con demasiada facilidad, y eso es lo siguiente en lo que estamos trabajando.

Las pantallas

El sesenta por ciento de las ejecuciones vino de pantallas a 60 Hz. El siguiente grupo no es 120 ni 144 Hz, sino 165 Hz o más, con un 21 %, más que 120 y 144 juntos. La pantalla suelta más común sigue siendo 1920 × 1080 al 100 % de escala, en el 18 % de las ejecuciones.

Cómo leer todo esto

Estas son ejecuciones de gente que encontró un sitio de prueba de pantallas y eligió pulsar el botón. No es una encuesta de los ordenadores del mundo. Los PC de juegos están sobrerrepresentados, y también la gente que acaba de comprar algo y quiere ver qué hace.

Las puntuaciones salen solo de ejecuciones completas, 665 de ellas. Un grupo necesita 15 ejecuciones antes de aparecer en cualquier gráfico, por eso faltan Linux, las pantallas a 75 Hz y varias familias de teléfonos, en lugar de mostrarse con un número que no podríamos sostener. Donde un grupo es pequeño, su número de ejecuciones va impreso al lado. Trata una mediana de 20 ejecuciones como una pista.

Lo que guardamos de una ejecución es corto: la puntuación, los seis resultados de escena, los números de la pantalla y familias gruesas de la GPU, el sistema operativo y el navegador. Ni dirección IP, ni país, ni identificador, nada que diga quién la ejecutó. La página de privacidad tiene la lista completa, y nada en esta página es más fino que esa lista.

Las puntuaciones solo se comparan dentro de una versión del benchmark, así que todo esto describe 2.5.0. Si quieres tu máquina en la siguiente ronda de números, ejecuta el benchmark. Tarda unos tres minutos, y cómo se construye la puntuación está escrito en la página de metodología.

Compartir esta página
DiscusiónUn hilo por idioma, compartido en todo el sitio. Inicia sesión con Google para publicar.
Discusión