Nouveautés
De la plus récente à la plus ancienne. Toute modification qui change les scores entraîne une nouvelle version du benchmark. RSS
2.12.0
Des commandes qui s’écartent, et une page d’accueil pour chaque langue2026-09-03
- Les commandes du test tactile s’écartent de votre doigt. La bande de couverture et le bouton de fermeture se placent ensemble sur le bord où vous ne peignez pas — peignez en bas, elles montent ; peignez en haut, elles descendent —, si bien que chaque cellule de la dalle reste atteignable. La ligne d’instructions part au premier contact et revient à la réinitialisation, et sur un téléphone le bouton de réinitialisation ne nomme plus une touche que vous n’avez pas. Safari sur iPhone ne donne aux pages aucune API plein écran : les barres du navigateur restent ; celles de l’outil, non.
- Un triangle de lecture qui s’affiche partout. Chaque bouton de démarrage se termine par ▶ et non plus par ►, qui se dessinait sur les téléphones comme un glyphe trapu et mal assorti. Les seize éditions, les fiches d’aide, le bouton de reprise du test de marquage et les pages traduites ont changé ensemble.
- Moins de texte au-dessus de la première pastille. Le titre de la page d’accueil est désormais « Screen test & benchmark », la ligne en dessous a disparu, et sur les écrans étroits l’indice du panneau laisse tomber les raccourcis clavier : « Esc quitte » ne veut rien dire sur un téléphone. La barre supérieure lit « Screen Test Pro » dans toutes les langues ; la forme en nom de domaine a quitté la carte de partage et la ligne de résultat copiée.
- Le catalogue en un clic est prêt à être traduit. Chaque nom de pastille, chaque note de groupe, chaque ligne du HUD et chaque libellé de la fiche que montre la page d’accueil anglaise possède maintenant une clé dans les quinze dictionnaires, et une langue passe au catalogue dès que ses clés portent des traductions. En attendant, une page d’accueil traduite ressemble exactement à celle d’hier.
2.11.0
Le classement complet, et les mires apprennent à s’enchaîner2026-09-03
- Une page de classement. Le tableau de l’accueil s’arrête à dix. /leaderboard/ continue : jusqu’à 200 lignes, une par machine, sur les 30 derniers jours ou sur toute la période, et pour chaque version du benchmark dont nous conservons encore des échantillons — choisissez 2.1.0 ou 2.0.0 et voyez à quoi ressemblait le classement sous cette charge. Mêmes champs grossiers que sur l’accueil, même règle d’une ligne par machine ; seules la profondeur et l’histoire sont nouvelles. La page de confidentialité le dit en toutes lettres.
- Un seul cycle pour les seize mires. Les pastilles de mires d’hier ouvraient deux outils différents — les trois cartes de diffusion dans l’un, les treize mires tracées dans l’autre — si bien que « Test patterns ▶ » et les flèches ne parcouraient qu’une partie de l’ensemble. Maintenant, chaque pastille et le bouton du groupe ouvrent le même outil, et → parcourt les seize, cartes comprises. L’outil à trois cartes reste sur la page téléviseurs et sur les pages traduites.
- Des OVNIs. L’objet mobile du test de mouvement est désormais un OVNI, comme le veut le genre, avec six dessins au choix dans la barre du bas — et le bloc rayé reste là pour qui préfère les arêtes aux soucoupes. Icônes de Flaticon, créditées sur la page du ghosting.
- Le défilement défile enfin. Le mode texte défilant est sorti avec un défaut de bouclage qui faisait rebondir le texte entre le haut et le bas de l’écran au lieu de le faire traverser. Corrigé : un seul anneau continu de lignes, de bas en haut, sans couture.
2.10.0
Chaque champ à un clic de la page d’accueil2026-09-03
- Cinquante-cinq contrôles en page d’accueil. L’accueil proposait trois outils et cachait les champs à l’intérieur. La console montre désormais les champs eux-mêmes : 16 couleurs pleines, 13 dégradés, 16 mires, 4 tests de mouvement et 6 instruments de mesure, chacun sous forme de pastille qui passe en plein écran en un clic. Les pastilles sont dessinées dans les couleurs dont elles rempliront l’écran : vous choisissez le champ voulu au lieu d’avancer jusqu’à lui.
- Des champs qui manquaient. Les couleurs pleines gagnent l’orange, le violet, quatre gris supplémentaires et un sélecteur hexadécimal libre. Les dégradés gagnent une séparation RVB, un balayage de teinte, le quart des ombres et le quart des hautes lumières isolés, des paliers de gamma et un escalier à 16 marches. Un nouvel outil de mires trace une grille fine, un damier, du texte en onze tailles, des lignes d’un pixel dans trois directions, un champ de points, un damier d’un pixel pour vérifier la résolution native, des paliers de contraste près du noir et près du blanc, la saturation, un cadre d’overscan et une grille pour suivre les fissures — le tout en pixels physiques, jamais mis à l’échelle par le navigateur.
- Le mouvement a quatre modes. Les couloirs d’OVNI ne bougent pas. S’y ajoutent : une poursuite de blocs qui saute d’une case par image (une image perdue se voit comme un saut), un bloc clignotant pour le scintillement et les fréquences mal accordées, et du texte défilant pour les saccades. Les touches 1–4 changent de mode sans quitter le test.
- Le classement reste à sa place, avec un pied. Les dix meilleurs tests et votre propre ligne gardent leur place dans la carte du benchmark. En dessous, les mêmes groupes de matériel que publie /benchmarks/ affichent leur médiane dès qu’un groupe dépasse trente échantillons — avant cela, la ligne dit combien d’échantillons existent, et non un chiffre inventé.
- La fiche de l’appareil tient de nouveau. Le classement étant dans la carte, les quatorze lignes de relevé se répartissent maintenant sur deux colonnes : un bureau en 1440×900 voit toute la console sans faire défiler.
- Page d’accueil anglaise seulement, pour l’instant. Les accueils des autres langues gardent leur console à trois rangées tant que leurs textes n’ont pas reçu une vraie relecture humaine ; chaque nouvel outil s’ouvre toujours depuis les pages traduites.
2.9.0
Bridé est un marqueur, pas une disqualification2026-09-02
- Les tests qui se brident comptent désormais. Jusqu’à aujourd’hui, le classement ne publiait que les tests où l’appareil n’avait jamais ralenti — et un téléphone, cent secondes après le début d’un test GPU à pleine charge, ralentit toujours, parce que c’est ce que font les téléphones. Résultat : aucun téléphone n’avait jamais atteint le classement sur le benchmark 2.2.0, et seize de ses vingt premiers tests étaient silencieusement invisibles. Maintenant, un test dont toutes les scènes ont été mesurées mais dont l’appareil a chauffé reçoit un nouveau statut — bridé — et prend place au classement avec ce mot inscrit sur sa ligne. Rien n’a changé dans le score : le même test produit aujourd’hui le même chiffre qu’hier, le classement conserve donc son historique et le benchmark 2.2.0 garde sa version.
- Dégradé veut toujours dire dégradé. Un test dont une scène n’a pas pu être mesurée, ou dont le niveau n’a pas pu être confirmé, reste hors classement : ce score est un plancher, et classer des planchers face à des sommets tromperait tout le monde. La fiche de résultat le dit désormais en toutes lettres, au lieu de vous laisser vous demander si l’outil a avalé votre score, et les marqueurs de chaque scène disent précisément ce qui s’est passé. Votre propre couloir traite « bridé » comme « terminé », place le marqueur en tête de ligne (là où l’écran étroit d’un téléphone ne peut pas le tronquer), et les tests dégradés gardent leur place avec une étiquette honnête.
- Le conseil avant, le diagnostic après. La carte de départ dit maintenant ce qui restait tu : un appareil chaud se bride et perd des points, alors laissez-lui une minute si vous venez de le pousser — et s’il se bride quand même, le test est marqué, pas écarté. Après un test bridé, la fiche propose l’expérience évidente : à froid, branché sur secteur, relancez.
- L’échantillon a appris à parler de chaleur. Les échantillons partagés (schéma v5) enregistrent désormais pourquoi une scène a été marquée et de combien l’appareil avait ralenti à la fin de celle-ci — un simple rapport, 1,3 par exemple. Ce sont exactement les données de terrain dont aura besoin une future révision du benchmark tenant compte du refroidissement, recueillies honnêtement. La politique de confidentialité énumère les nouveaux champs ; comme toujours, ils décrivent le test, pas vous.
- Classement plus frais. Un score envoyé apparaît maintenant sans attendre cinq minutes : la page l’actualise dès la fin de votre test, et les autres appareils le voient en moins d’une minute.
2.8.0
Un arbitre équitable et une échelle plus haute2026-09-01
- Benchmark 2.2.0. Les scores repartent de zéro — voici ce que cela rapporte. Une sortie sur le terrain a réuni trois fleurons d’Apple côte à côte : un portable M2 Max, un Mac Studio M4 Max, un portable M5 Pro. Le benchmark les a classés à moins de 9% d’écart, le GPU le plus puissant en bas du tableau. Mauvaise réponse, et trois causes distinctes à l’origine : une règle de validation qui avantageait les écrans de portables, une scène qui mesurait autre chose, et un plafond de score que le matériel réel avait dépassé. Les trois sont corrigées ci-dessous. Les corriger change tous les chiffres : la 2.2.0 ouvre donc un classement neuf, et le calcul du score détaille la méthode, mise à jour en conséquence.
- Le juge de validation comprend enfin les écrans. Un moniteur fixe à 60 Hz ne peut présenter une image qu’au bout de 16,7 ms ou de 33,3 ms — rien entre les deux — alors qu’une dalle adaptative de portable rend une image de 18 ms telle quelle. Les anciennes tolérances laissaient tranquillement les dalles adaptatives se contenter de 55 fps quand les moniteurs de bureau devaient tenir un vrai 60 : même GPU, score plus bas sur un bureau. Une sonde de cadence d’environ 600 ms lit désormais la façon dont votre écran rend les images avant la première scène, et la règle de validation — au plus 5% des images au-dessus du seuil ajusté à cette cadence, moyenne tronquée à l’intérieur du budget de 16,67 ms — fait de « tient 60 fps » la même affirmation sur toutes les dalles. Et si votre écran est bloqué sous 50 Hz (mode économie d’énergie, câble limité à 30 Hz), le test refuse de se lancer et explique pourquoi, plutôt que de juger un GPU par le trou d’une serrure.
- Liquid Chrome mesurait des allocations mémoire, pas du raymarching. Changer sa charge redimensionne la cible de rendu, et le navigateur facture cela comme une image interminable — qui tombait dans la fenêtre de mesure suivante et faisait échouer des niveaux que le GPU tient sans effort. Une M4 Max se « mesurait » ainsi à la moitié d’une M2 Max. Les images qui suivent immédiatement un changement de charge sont maintenant écartées : la transition n’est pas le travail à mesurer. Sur notre machine d’essai, la recherche corrigée se stabilise 45% plus haut, au niveau que le silicium tient réellement.
- Le score ne peut plus atteindre son plafond avant la mesure. L’ancienne limite fixe de 20× figeait deux scènes entières à 20 000 exactement sur tous les GPU Apple rapides — 38% du score, identique d’un bout à l’autre d’une génération de puces. Les sommets d’échelle se situent désormais 6 à 14× au-delà de la machine la plus rapide mesurée à ce jour (60,6 millions de points de nébuleuse, 32 millions d’instances de ville, 180 échantillons de raymarch par pixel), ils ne coûtent rien tant qu’un appareil ne les mérite pas, et le score est écrêté exactement là où l’échelle s’arrête, pas avant.
- Références recentrées sur du matériel réel et non bridé. Les scènes sont normalisées pour que la machine de référence — une M2 Max sur un banc branché sur secteur — obtienne 13 000 avec les six scènes concordant à quelques pour cent près, au lieu d’une même machine relevant 0,11× sur une scène et 4,42× sur une autre. Les paliers sont redécoupés selon la nouvelle échelle et validés en rejouant le calcul sur tous les échantillons de production : Débutant sous 500, Équilibré jusqu’à 1 499, Rapide jusqu’à 5 999, Extrême à partir de 6 000.
- Les échantillons partagés emportent désormais les chiffres bruts. La charge stable maximale réelle de chaque scène — celle que l’écrêtage du score effaçait — ainsi qu’une classe grossière de cadence d’affichage (fixe / adaptative / inconnue) accompagnent maintenant un résultat partagé. C’est ce que lira le prochain étalonnage, qui ne dépendra donc pas de la photo d’un modèle d’exposition dans un Apple Store. Rien d’identifiant n’a été ajouté ; la politique de confidentialité énumère chaque champ, comme toujours.
2.7.1
Une place au classement par machine2026-09-01
- Le classement des meilleurs scores n’accorde plus qu’une ligne par profil de machine. Le premier mois du benchmark 2.1.0 a rendu le problème évident : dix places, et presque toutes affichaient « GeForce · Windows · Edge » — plusieurs étaient de façon démontrable les mêmes un ou deux ordinateurs, relancés encore et encore. Les scores ne portent toujours aucun identifiant, quel qu’il soit ; le classement regroupe donc les tests selon ce qu’une machine ne peut pas changer d’un essai à l’autre — GPU, système, navigateur et version, cœurs du processeur, mémoire, type d’appareil — et ne garde que le meilleur test de chaque groupe. Relancer peut améliorer la ligne que vous détenez déjà ; cela n’en achète pas une deuxième. Rien de nouveau n’est collecté, et la politique de confidentialité n’a pas eu à s’allonger pour l’autoriser : elle s’est resserrée.
- Les lignes indiquent maintenant la version du navigateur. « Edge 152 » plutôt que « Edge », sur les lignes globales comme dans votre propre couloir. La version faisait déjà partie de l’échantillon ; l’afficher permet à deux machines différentes de ressembler à deux machines différentes.
2.7.0
Bandes-son de la galerie, partage et paliers plus justes2026-08-30
- La galerie d’effets a désormais sa musique. Trente morceaux originaux accompagnent les 13 scènes, chacun composé pour ce qui se passe à l’écran. Ouvrez une scène et touchez ♪ : l’activation et le volume sont mémorisés sur votre appareil. Rien n’est chargé avant l’activation, et le test de performances reste muet pour que les scores gardent partout le même sens. Tous les détails sont dans le billet de blog.
- Les paliers ont été redécoupés. Les anciens seuils dataient d’une époque où les scores plafonnaient vers 4 300. Le benchmark 2.1.0 a porté le plafond à 20 000 et, soudain, la moitié des tests se retrouvaient en « Extrême » — un mot qui ne voulait plus rien dire. Les nouvelles tranches sont de simples multiples de la machine de référence : sous 1×, Débutant ; jusqu’à 3×, Équilibré ; jusqu’à 9×, Rapide ; au-delà de 9×, Extrême. Votre score n’a pas changé ; le mot affiché à côté, peut-être. Plus de détails dans le calcul du score.
- Chaque libellé de la fiche de résultat est maintenant un bouton. Cliquez sur Extrême, dégradé, dérive, limité ou échec : une brève explication apparaît juste dessous et précise ce que ce mot signifie pour votre test. Le plus souvent mal compris, limité, indique que la recherche a manqué de temps ; la valeur réelle est donc égale ou supérieure.
- Les pages peuvent être partagées. Une rangée de boutons se place au-dessus du pied de page des outils, guides et billets : grands réseaux, e-mail, code QR pour envoyer le lien vers un téléphone et simple copie du lien. Ils ne se chargent qu’à l’approche du défilement ; les pages restent donc exactement aussi rapides.
- Les liens de langue passent tout en bas du pied de page. On change rarement de langue ; les tests et les pages réellement consultés passent désormais avant.
2.6.0
Le benchmark ne bute plus sur son plafond2026-08-29
- Benchmark 2.1.0 : les scores se différencient de nouveau. Cinq des six scènes du mode Standard atteignaient le sommet de leur propre échelle de charge et rapportaient cette limite plutôt que votre matériel — Cascade d’étoiles dans 98 % des tests complets. Avec une seule scène encore libre de varier, des machines sans aucun rapport obtenaient des totaux identiques : un téléphone Android, un PC Windows et un Mac affichaient tous exactement 3 977. Chaque scène dispose désormais de seize fois sa charge de référence pour grimper, et la recherche du point d’arrêt se resserre à environ 6 % au lieu de 15 %. Les charges de référence et les pondérations sont inchangées : 1 000 signifie toujours la même chose. Les scores 2.0.0 et 2.1.0 ne se comparent jamais ; les classements repartent donc de zéro et se remplissent sur quelques jours.
- Deux scènes cessent d’accaparer la mémoire. Dérive nébuleuse et Hypernova allouaient d’emblée leur nombre maximal de particules sur chaque appareil, quel que soit le nombre réellement dessiné — 58 Mo à elles deux, sur des téléphones et des tablettes qui n’en approchaient jamais. Elles répètent maintenant un tampon plus petit : moitié moins de mémoire, pour un plafond bien plus haut.
- Un test se termine toujours par un résultat. Sur un appareil incapable de tenir le budget d’image même au réglage le plus bas d’une scène, le benchmark n’enregistrait rien, se fermait tout seul et vous ramenait à la page sans fiche ni explication. Il affiche désormais le score réellement mesuré, explique pourquoi il est ce qu’il est, et n’empêche plus la dernière scène de s’exécuter.
- Les appareils lents sont mesurés, pas abandonnés. En dessous d’environ quatre images par seconde, chaque image ressemblait à un à-coup isolé : le moteur jetait la mesure et restait à sa charge de départ jusqu’à l’expiration de la scène. Il reconnaît maintenant une lenteur durable pour ce qu’elle est et redescend jusqu’à une vraie réponse.
- Votre propre résultat a toujours sa place. La ligne you du classement affichait l’invitation « lancez le benchmark » à des gens qui venaient précisément de le lancer, dès lors que le test revenait dégradé. Elle affiche désormais votre meilleur résultat quel que soit son état, honnêtement étiqueté, en bas du tableau.
- Même GPU, mêmes pixels. La taille de rendu interne est enfin plafonnée comme la page de méthode l’annonçait depuis toujours. À charge nominale égale, un écran 4K traitait quatre fois plus de fragments qu’un 1080p ; ces deux scores n’ont jamais été comparables, ils le sont maintenant.
2.5.0
Un classement des meilleurs scores et une galerie à réglages2026-08-28
- Meilleurs scores. Les dix meilleurs tests complets des 30 derniers jours, sur la page du test de performances et sur la carte d’accueil. Cette fois ce sont des tests individuels, pas des médianes : les benchmarks matériels répondent toujours à « combien ce matériel obtient-il d’habitude », tandis que ce classement répond à « qu’ont fait les plus rapides ces derniers temps ». Les lignes restent exactement aussi grossières que la liste de champs de la carte de consentement, et la politique de confidentialité le dit désormais noir sur blanc. Le classement comporte aussi un couloir vous : votre meilleur test, inséré dans le classement directement depuis l’historique local de cet appareil — ou une place réservée tant que vous n’avez pas fait le test. Rien de ce couloir n’est envoyé.
- La galerie d’effets devient une page. Les 13 scènes, chacune avec trois réglages que le benchmark n’offre jamais : charge de particules sur la propre échelle de la scène, vitesse de simulation jusqu’à 0,1× et échelle de rendu jusqu’à 2× la définition native pour éprouver le taux de remplissage. Le mode libre reste sans score, et three.js ne se charge toujours qu’à l’ouverture d’une scène Signature.
- Page des benchmarks, utilisable. Un bouton de lancement sur la page des statistiques elle-même : vous voyez un tableau, vous y confrontez votre appareil sur-le-champ. Les tableaux se chargent aussi dans un espace réservé au lieu de bousculer la page.
- Finitions. L’index du test de moniteur respire davantage ; la carte de benchmark de l’accueil se centre sur son bouton de lancement, qui bat maintenant d’une lente pulsation de veille (et reste immobile en mode mouvement réduit) ; le lien vers la notation est devenu un ⓘ qui explique sur place ; l’aperçu de la carte de départ du benchmark est un peu moins collé au bord.
2.4.0
Sept nouvelles pages et un vrai menu2026-08-26
- Le catalogue de tests double. Le test tactile trace une grille multitouch pour révéler zones mortes et touches fantômes. Le test de marquage fait défiler des aplats uniformes avec un curseur de durée d’affichage : lent pour inspecter, rapide pour solliciter la rémanence. Le test d’écran OLED enchaîne huit diapositives calées sur les défaillances propres à l’OLED, du noir absolu au presque-noir jusqu’à l’usure par canal. Le test de dégradés et banding donne enfin leur propre page aux rampes existantes.
- Pages dédiées aux appareils. Le test d’écran de téléviseur achemine tout vers un téléviseur — navigateur intégré, diffusion d’onglet ou HDMI — avec les mires de diffusion expliquées. Le test d’écran de téléphone rassemble la vérification en cinq minutes d’un téléphone d’occasion.
- Une seule carte. Le test de moniteur répertorie les douze instruments dans l’ordre où une vérification complète se déroule réellement.
- Un menu de site. La barre supérieure a gagné un bouton de menu : chaque test et chaque page, en trois colonnes denses, et le mobile dispose enfin d’une navigation. Le pied de page relie désormais chaque page d’outil depuis toutes les pages anglaises.
- Le mode Classique, enfin accessible. Les huit effets de la v1 étaient entièrement câblés comme benchmark Classique noté — moteur, profil, traductions — mais rien ne le lançait. La page du test de performances a maintenant le bouton. Les tests Classiques sont notés localement et ne sont jamais envoyés.
2.3.0
Quatre nouveaux instruments2026-08-26
- Chaque test a sa propre page. La fréquence de rafraîchissement mesure les Hz que votre écran délivre réellement, avec une bande de temps d’image en direct. Le vérificateur de résolution répond à la question des pixels annoncés contre pixels physiques et calcule le PPP. Le ghosting fait défiler des blocs rayés à trois vitesses sur cinq fonds. La calibration d’écran parcourt niveau de noir, niveau de blanc, gamma et équilibre des gris en quatre étapes plein écran — et dit franchement là où seul un colorimètre fera l’affaire.
- Test de pixels morts approfondi. Une vraie FAQ (combien de pixels morts sont acceptables, est-ce que cela se propage) et des liens vers les nouveaux tests.
- Deux nouveaux guides. Calibrer à l’œil — et quand un colorimètre devient nécessaire ainsi que ghosting, temps de réponse et flou de mouvement expliqués.
- Mots décollés. Une particularité d’Astro sur les espaces recollait silencieusement des mots par-dessus les sauts de ligne autour des liens (« collected the policies inDead vs stuck… »). Corrigé partout, avec un test de non-régression qui balaie chaque page.
2.2.1
Tout l’instrument en 14 langues2026-08-26
- Le benchmark parle votre langue. Carte de départ, HUD, fiche de résultats, historique des scores et cartes d’aide des outils : 87 chaînes traduites dans les 13 langues autres que l’anglais. Les noms de scènes l’étaient déjà ; tout ce qui les entoure l’est désormais aussi.
- Notes des mires traduites. La ligne « ce qu’il faut regarder » de chaque mire de diffusion s’affiche maintenant dans la langue de la page.
- Les outils partenaires renvoient vers la bonne langue. Les liens vers les sites frères, en pied de page, pointent désormais vers la version linguistique correspondante plutôt que vers l’anglais.
- Pages de langue allégées. Les pages d’accueil localisées n’embarquent que les chaînes réellement utilisées par les outils, et non plus l’ancien bloc complet.
- Correction de la progression du HUD. La barre de progression ne se bloque plus pendant la phase de recherche par encadrement.
2.2.0
Carte de départ allégée, galerie plus vivante, moins de données2026-08-23
- Moins de collecte, pas plus. Les échantillons n’enregistrent plus le pays ni la langue du site : la liste des champs a rétréci (schéma v3), et la politique de confidentialité a rétréci avec elle.
- La carte de départ montre ce qui vous attend. Un aperçu de résultat — score, palier, barres par scène — occupe désormais le haut de la carte du benchmark, et les notes techniques sont repliées dans un bouton « Plus d’informations ». Un coup d’œil suffit à savoir ce qu’un test vous rapporte.
- Les scènes Signature s’animent au survol. Les 13 vignettes de la galerie s’aperçoivent maintenant en mouvement : les cinq vignettes Signature animent leur affiche en Canvas 2D, si bien que three.js ne se charge toujours qu’à l’ouverture réelle d’une scène.
- Nouveau logo d’en-tête et barre supérieure plus discrète : les mesures de l’écran ne vivent plus que dans le panneau « Cet écran ».
- Une FAQ sur la page d’accueil. Huit réponses courtes — pixels morts, banding, sens du score, données envoyées — renvoyant chacune vers la lecture approfondie.
2.1.0
Les statistiques matérielles en ligne2026-08-23
- Page benchmarks matériels. Des scores médians par famille de GPU et par famille d’appareils Android, construits à partir d’échantillons anonymes. Chaque ligne attend au moins 30 échantillons avant d’être publiée ; ce sont des médianes, donc un seul test chanceux n’achète pas un rang.
- L’envoi est activé par défaut. La carte de départ du benchmark porte désormais une case cochée au lieu de deux boutons, avec un aperçu en direct des valeurs exactes que votre appareil enverrait. Décochez-la et rien ne part ; le choix est mémorisé. La politique de confidentialité a été mise à jour dans le même mouvement.
- Trois nouveaux champs d’échantillon (schéma v2) : sur batterie ou branché, format de l’appareil et — sur Android uniquement — une famille d’appareils approximative du type « Galaxy S24 ». Les modèles rares sont ramenés à des ensembles par marque dès la collecte ; la chaîne exacte du modèle ne quitte jamais l’appareil.
- Un benchmark dont on peut suivre la durée. Le HUD affiche maintenant la scène 2/6, une barre de progression globale et une estimation approximative du temps restant, avec le nom de la scène suivante en intermède.
- Un démarrage identique aux autres outils. Valider la carte de départ bascule directement en plein écran, sur la première scène.
- Les scènes Signature parlent 14 langues. Dérive nébuleuse, Métropole néon, Chrome liquide, Cascade d’étoiles et Hypernova ont désormais un nom et une description dans chaque langue, et la galerie affiche les 13 scènes partout.
- Page d’accueil plus sobre : moins de texte, bouton de lancement plus grand.
2.0.0
La reconstruction2026-08-23Screen Test Pro reconstruit de fond en comble. Mêmes URL, mêmes quatorze langues, tout le reste est neuf.
- Nouveau benchmark. Cinq scènes Signature en WebGL2 (Dérive nébuleuse, Métropole néon, Chrome liquide, Cascade d’étoiles, Hypernova) et les huit effets Classiques de la v1, portés fidèlement et notés à part. Les scores sont numérotés — il s’agit du benchmark
2.0.0 — et la méthode est publique.
- Une vraie mesure. Percentiles de temps d’image sur des fenêtres statistiques, échelle de charge adaptative avec hystérésis, détection de la dérive thermique et délais stricts sur chaque état. Le benchmark peut être annulé ; il ne peut pas se figer.
- Statistiques matérielles anonymes, consentement d’abord. Un test noté et mené à son terme peut envoyer un échantillon anonyme. La liste exacte des champs s’affiche avant le départ, refuser tient en un clic, et la politique de confidentialité a été réécrite en conséquence.
- Nouvelles pages d’outils. Le test de pixels morts et le test de performances ont enfin de vraies pages, avec de vraies explications.
- Nouveau design. Dense, sombre par défaut, allure d’instrument de mesure. La page affiche les mesures en direct de votre écran plutôt qu’une bannière publicitaire.
- Plus rapide. HTML statique, aucun framework à l’exécution, aucune police web, et le code des scènes ne se charge qu’au moment où vous lancez quelque chose.