Principes de publication
Comment PanelCompare classe les panels SMM
Chaque chiffre ci-dessous est produit à partir de src/lib/scoring.ts, le fichier même qu’exécute la chaîne de classement. La page ne peut pas s’écarter de la formule, puisqu’elle l’appelle.
Mis à jour le par La rédaction de PanelCompare
Comment la liste par défaut est-elle ordonnée ?
Une question se place au-dessus du score, et c’est la seule dans ce cas : qui se tient derrière la fiche, et ce que cette personne a réellement fait pour s’en porter garante. La liste par défaut compte donc trois groupes, dans cet ordre. Au sein de chaque groupe, l’ordre est celui du score global, exactement tel que la formule ci-dessus le calcule.
- 1.Le propriétaire a prouvé qu’il contrôle le domaine. Une revendication passe par un enregistrement DNS que seul l’exploitant du domaine peut publier : c’est donc le seul signal de ce site qu’un panel ne peut pas produire en parlant de lui-même. Elle place derrière la fiche un exploitant identifié et joignable : quelqu’un à qui l’on peut demander des comptes, qui répond publiquement aux plaintes et qui a quelque chose de réel à perdre si le panel se conduit mal.
- 2.Le propriétaire a demandé à être référencé, et nous avons accepté. Ce signal est plus faible, et nous ne le ferons pas passer pour celui du dessus : personne n’a prouvé qu’il contrôle quoi que ce soit, et ce n’est pas une vérification. Il atteste que quelqu’un s’est manifesté – un exploitant qui nous a écrit depuis une adresse qui fonctionnait, qui a accepté d’être mesuré et que le résultat ne peut pas prendre de court – et, depuis que l’assistant d’inscription a remplacé l’ancien formulaire, qu’il détenait une clé API valide et nous a laissés la tester sur l’API même du panel. Un panel que nous avons trouvé en parcourant le marché n’a rien accepté et ignore peut-être que ce site existe.
- 3.Tous les autres. C’est l’essentiel de l’indice, et cela ne dit rien contre eux. Rien n’est retenu contre un panel ici. Nous n’avons simplement personne à l’autre bout, ce qui est un fait sur notre contact avec le panel, et non sur le panel lui-même.
Un score élevé dit qu’un panel est peu cher et en ligne. Les deux groupes placés au-dessus disent qu’il y a quelqu’un derrière, et jusqu’où cette personne s’est réellement engagée en son nom. Ce sont deux questions différentes, et un acheteur sur le point d’envoyer de l’argent est en droit d’obtenir d’abord la réponse à la seconde.
Les deux démarches sont gratuites, ouvertes à tous les panels de l’indice aux mêmes conditions, et aucune n’a d’équivalent payant – ni aujourd’hui ni jamais. Un panel ne peut pas plus acheter l’une de ces positions qu’il ne peut acheter un score. La vérification tient en un enregistrement TXT et environ deux minutes, depuis la page du panel lui-même ; on accède au deuxième groupe en référençant un panel, une fois la demande acceptée par la rédaction.
Le deuxième groupe est nouveau : il existe depuis aujourd’hui. Jusqu’ici, il n’y en avait que deux – les vérifiés, puis tous les autres – et cette page le disait. Un panel dont l’exploitant nous avait écrit, avait répondu à nos questions et nous avait remis une clé API valide se retrouvait ainsi exactement au même rang qu’un panel glané sur un forum, ce qui minimisait ce que nous savions du premier. Personne n’a eu à faire quoi que ce soit pour obtenir ce nouveau rang, et on ne l’a demandé à personne : la colonne a été remplie rétroactivement à partir des demandes déjà acceptées, si bien qu’un exploitant qui nous a écrit il y a plusieurs mois en bénéficie aujourd’hui sans lever le petit doigt. Ce groupe ne fait en revanche passer personne devant un propriétaire vérifié, et il ne devient pas une vérification parce qu’il se trouve juste en dessous : prouver le contrôle du domaine, c’est le groupe du dessus, et cela le reste.
La règle ne s’applique qu’au classement par défaut. Les tris Les moins chers, Meilleure disponibilité, Catalogue le plus large, Les plus récents et Les mieux notés promettent chacun un ordre précis et s’y tiennent strictement : une liste intitulée « Les moins chers » qui ne commencerait pas par le moins cher serait pire que pas de tri du tout. Les filtres et tous les tableaux de prix ne sont pas concernés.
Payer PanelCompare change-t-il la position d’un panel ?
Non. Le statut d’affilié, le sponsoring et les emplacements payants n’apparaissent nulle part dans la formule de classement, et cela se vérifie au lieu de s’affirmer : toute la formule tient dans un seul fichier, qui ne contient aucun champ décrivant une relation commerciale. La base de données comporte bien un indicateur is_affiliate et un indicateur is_sponsored : le premier détermine si un lien sortant porte rel="sponsored" et une étiquette « partenaire » visible, le second signale un panel qui paie pour une ligne épinglée au-dessus de la première place, marquée Sponsorisé et jamais numérotée. Le code de notation ne lit ni l’un ni l’autre.
Ce pour quoi nous pouvons être payés est détaillé sur la page transparence, y compris la liste précise des liens sortants monétisés aujourd’hui.
Qu’est-ce qui entre dans le score global ?
Cinq composantes, pondérées. Le prix et la confiance pèsent 60 % à eux deux, parce que ce sont les deux questions que se pose réellement un acheteur : puis-je me le permettre, et la commande sera-t-elle livrée ? Le support pèse le moins, parce qu’un widget de chat s’installe facilement et se vérifie difficilement. Les pondérations ci-dessous sont lues dans la constante exportée OVERALL_WEIGHTS au moment de l’affichage.
| Composante | Pondération | Échelle | Ce qui est mesuré |
|---|---|---|---|
| Prix | 30 % | 0–10 | Médiane des ratios de prix du panel, service par service, par rapport à la médiane du marché pour chaque service. |
| Confiance | 30 % | 0–100, ramené sur 0–10 à partir de sa base de 85 points | Le score de confiance détaillé ci-dessous. Chaque donnée est une observation, pas une opinion. Il entre dans cette moyenne divisé par 8,5 et non par 10, car c’est 85 – et non 100 – qui représente la note maximale sur les composantes dont la confiance fait la moyenne. Le point médian de la confiance, 42,5, tombe ainsi sur le 5 neutre qu’utilisent toutes les autres composantes de ce tableau. |
| Fonctionnalités | 18 % | 0–10 | Indicateurs de fonctionnalités pondérés selon ce que leur absence coûte à l’acheteur, plus l’étendue du catalogue. |
| Fiabilité | 14 % | 0–10 | Disponibilité sur les 30 derniers jours, le temps de réponse servant à départager. |
| Support | 8 % | 0–10 | Canaux publiés – un système de tickets, un widget de chat en direct et une adresse e-mail de support sur le domaine du panel –, remplacés par les notes que les acheteurs donnent au support dès que nous en avons au moins trois. |
| Total | 100 % | ||
Source : OVERALL_WEIGHTS dans src/lib/scoring.ts, lu au moment de la compilation. Le score global est arrondi à une décimale.
Comment le score de confiance est-il calculé ?
La confiance est une moyenne sur 5 composantes qui valent 85 points à elles toutes, plus un bonus de vérification pouvant atteindre 15 points, moins une pénalité pour les plaintes publiées. Les pondérations répondent à une seule question : combien coûterait-il à un adversaire de falsifier ce signal ? L’ancienneté du domaine et un achat test mené à terme coûtent cher à falsifier. Un certificat TLS est gratuit : il ne vaut donc rien ici et n’est même pas une composante.
C’est une moyenne sur les composantes que nous avons mesurées, et non sur toutes. Une composante sans observation derrière elle – un panel que nous n’avons pas testé, un panel qui n’a pas encore d’avis vérifié – est retirée à la fois des points obtenus et des points disponibles. Elle ne vaut pas zéro, et elle n’est pas non plus remplie avec une demi-note neutre.
| Composante | Max. | Ce qui est mesuré | Pourquoi cette pondération |
|---|---|---|---|
| Ancienneté du domaine | 20 | Date d’enregistrement issue de RDAP/WHOIS, notée sur une courbe en racine carrée qui atteint la note maximale à cinq ans. | L’ancienneté ne s’achète pas rétroactivement : c’est la meilleure défense contre un panel qui ferme puis rouvre sous un autre nom, et elle démasque la mention « depuis 2014 » en pied de page d’un domaine enregistré l’an dernier. |
| Disponibilité sur 30 jours | 25 | Part des tests HTTP et API réussis sur l’ensemble des tests des 30 derniers jours, avec un lissage de Laplace : un succès fictif et un échec fictif sont ajoutés à l’échantillon avant que le taux soit élevé au carré puis mis à l’échelle. | C’est la seule composante que nous produisons nous-mêmes en continu, et un effondrement de la disponibilité est le premier signal observable d’une défaillance du fournisseur ou d’une fermeture. Le lissage encadre une série trop courte des deux côtés : cinq succès sur cinq valent 18,4 sur 25 et non la note maximale, et zéro sur cinq valent 0,5. La formule mixte qu’il a remplacée leur attribuait respectivement 16,9 et 8,1 : elle récompensait un petit échantillon pour ses échecs et en pénalisait un autre pour ses succès, c’est-à-dire l’ordre exactement inversé. |
| Fraîcheur du catalogue | 10 | Date de la dernière synchronisation réussie du catalogue de ce panel dans notre indice. Un panel que nous n’avons jamais synchronisé n’est pas noté ici du tout : c’est une clé API qui nous manque, pas un retard de sa part, et cela réduit donc la couverture. | Un catalogue que nous ne pouvons pas relire est un catalogue dont nous ne pouvons pas garantir les prix : un retard constaté coûte donc des points, même quand le panel lui-même fonctionne bien. L’absence de toute synchronisation n’en coûte plus. Jusqu’à aujourd’hui, elle en coûtait : un forfait de −10 appliqué à 127 des 129 panels de l’indice, un chiffre qui décrivait notre trousseau de clés plutôt qu’un quelconque panel. |
| Avis d’acheteurs vérifiés | 20 | Note moyenne en étoiles des avis d’acheteurs vérifiés du panel – les avis approuvés pour lesquels un modérateur a aussi vu une preuve d’achat –, ramenée vers la moyenne vérifiée de tout l’indice en mêlant aux avis du panel 8 avis fictifs à cette valeur a priori. La valeur a priori est de 3,0/5 tant que l’indice ne compte pas assez d’avis vérifiés pour en estimer une. En dessous de 3 avis vérifiés, la composante n’est pas notée du tout. Cet ensemble est plus restreint que la note en étoiles affichée sur la page d’un panel, qui compte tous les avis approuvés, vérifiés ou non : le badge décide si un avis entre dans cette composante de 20 points sur 85, pas s’il compte comme avis. | 1★ correspond à 0, la valeur a priori à la moitié des 20 points, 5★ à la totalité : les acheteurs peuvent donc faire descendre un panel autant que le faire monter, ce que la formule précédente ne permettait pas. Celle-ci multipliait la qualité par un terme de volume et ne descendait jamais sous zéro : deux cents avis vérifiés à une étoile rapportaient encore 9 points sur 20, si bien que le panel le plus mal noté que nous puissions décrire restait à moins de deux points d’un panel que personne n’avait jamais évalué. Seuls les avis vérifiés comptent, car c’est la composante qu’un panel peut écrire lui-même : un avis non vérifié ne coûte rien à fabriquer et fait bouger la note publique en étoiles, où le lecteur voit bien que le badge manque ; gagner jusqu’à 20 des 85 points de confiance pondérés devrait coûter une vraie commande. |
| Vérification | 15 | Dix points quand nous avons passé une vraie commande et qu’elle a été livrée ; cinq quand le propriétaire a prouvé qu’il contrôle le domaine. | Un achat test mené à terme est le seul signal de ce tableau que nous produisons nous-mêmes face à un panel qui a tout intérêt à se montrer sous son meilleur jour : c’est pourquoi il pèse le plus dans cette composante. Il s’ajoute en bonus au lieu d’entrer dans la moyenne : que nous ayons ou non trouvé le temps de passer une commande test chez un panel est un fait qui concerne notre charge de travail, et un panel ne doit pas être pénalisé pour notre retard. |
| Politiques publiées | 10 | Conditions publiées (3), politique de remboursement publiée (4) et canal de support joignable (3). | Facile à satisfaire et facile à simuler, ce critère vaut peu ; mais un panel sans conditions publiées ni support joignable vous a déjà appris quelque chose. |
| Base de la moyenne | 85 | La vérification se situe hors de ce total : elle ajoute des points sans les diluer, si bien que le fait de ne pas avoir acheté nous-mêmes chez un panel ne joue jamais contre lui. | |
Source : maxima des composantes lus dans computeTrust(), dans src/lib/scoring.ts, au moment de la compilation.
Que coûte une plainte publiée à un panel ?
La pénalité s’applique après la somme des composantes : elle peut donc faire descendre un panel sous n’importe quel score que ses autres signaux lui avaient valu. Chaque plainte publiée par un modérateur compte. Un signalement ne sort du décompte que lorsqu’un modérateur le fait passer à disputed (contesté) ou resolved (résolu), ce qui relève d’un jugement porté par une personne sur un cas précis.
La réponse d’un propriétaire n’y suffit pas. Un propriétaire vérifié peut répondre publiquement à n’importe quel signalement, et sa réponse est publiée telle quelle à côté ; mais elle ne fait bouger aucun point à elle seule, car relier la pénalité au champ de réponse ferait de cet endroit le seul du site où un panel modifie son propre score en tapant dans un champ de saisie. Savoir si une réponse répond vraiment relève d’un modérateur, et c’est disputed qui enregistre sa décision. Cette page affirmait auparavant le contraire – qu’un signalement auquel le propriétaire avait répondu cessait de compter – et le code n’a jamais fait cela.
Ce qui change le poids, en revanche, ce sont les preuves. Un signalement pour lequel un modérateur a vu une preuve – un numéro de commande, un hash de transaction, une capture d’écran avec un horodatage visible – compte en entier ; un signalement jugé crédible et précis mais invérifiable compte pour 0,4 signalement. Pas zéro, car l’acheteur qui a le dossier le plus solide est souvent celui à qui il ne reste qu’un identifiant de connexion qui ne fonctionne plus. La courbe est logarithmique et plafonnée, car la dixième plainte en dit bien moins que la première.
| Plaintes publiées | Toutes prouvées | Aucune prouvée |
|---|---|---|
| 1 | −12,0 | −7,9 |
| 2 | −16,7 | −10,8 |
| 3 | −20,0 | −13,1 |
| 5 | −24,7 | −16,7 |
| 10 | −31,7 | −22,6 |
| 25 | −35,0 | −31,7 |
Source : computeTrust() évalué pour chaque nombre de plaintes, avec tous les signalements prouvés puis avec aucun. La déduction est plafonnée à 35 points. Lorsqu’un panel en subit une, le chiffre exact et les signalements qui la fondent sont détaillés sur sa propre page de confiance.
Que se passe-t-il quand nous n’avons pas mesuré quelque chose ?
Ce qui n’a pas été mesuré sort de la moyenne et fait baisser la couverture à la place : la part des 85 points pondérés pour lesquels nous détenons réellement des preuves. La couverture est publiée à côté de chaque score de confiance de ce site et renvoyée par l’API, car un 70 bâti sur cinq composantes et un 70 bâti sur deux sont des affirmations différentes, et un seul chiffre ne peut pas dire laquelle vous avez sous les yeux.
Ce mécanisme a remplacé une conception antérieure qui comblait chaque lacune avec une demi-note neutre. Cela ressemble à un choix prudent, et ce n’en est pas un, pour une raison qu’il vaut la peine de dire clairement : la valeur de remplissage est la même constante pour tous les panels, si bien que plus elle occupe l’échelle, plus elle ramène tous les panels vers le même chiffre. Au moment où nous l’avons remarqué, 60 des 100 points étaient identiques pour presque tous les panels de l’indice – disponibilité, avis et vérification n’étaient mesurés pour personne – et quatre valeurs couvraient neuf fiches sur dix. Le score avait cessé de décrire les panels pour décrire notre propre couverture, tout en s’affichant comme un chiffre sur cent parfaitement sûr de lui.
La renormalisation a le défaut inverse : avec une seule composante mesurée, cette composante devient tout le score. En dessous de 50 % de couverture, le résultat est donc ramené vers le point médian en proportion de l’écart, et un panel dont l’unique composante mesurée se trouve avoir la note maximale ne peut pas passer pour un panel que nous avons vérifié.
Un second seuil, plus bas, décide d’autre chose : si nous mettons un mot sur le score. En dessous de 30 % de couverture, aucun niveau n’est attribué – le panel est marqué Provisoire, et le chiffre porte un soulignement en pointillé partout où il apparaît. « Établi » est une affirmation sur un panel, et une seule observation favorable ne nous autorise pas à la faire : la composante la plus lourde vaut à elle seule 25 points sur 85, soit 29 %, et aucune ne franchit donc ce seuil seule.
Ces deux seuils n’étaient jusqu’à aujourd’hui qu’une seule constante, fixée à 50 %, et cette page le disait. C’était doublement faux. Ils répondent à des questions différentes – « à quel point sommes-nous sûrs de ce chiffre ? » et « y a-t-il assez d’éléments pour prononcer un mot ? » – et les lier rendait le seuil des niveaux inatteignable : tout ce que nous pouvons apprendre d’un panel sans clé API ni série de tests totalise 40 points sur 85, soit moins de la moitié. Sur les 129 panels de l’indice, 128 étaient donc marqués « Provisoire », le meilleur d’entre eux avec 72,5, et une mise en garde qui s’applique à quatre-vingt-dix-neuf fiches sur cent n’apprend rien sur aucune d’elles. Entre 30 % et 50 %, un panel reçoit désormais un niveau et reste décoté, et c’est le chiffre de couverture affiché à côté du niveau, partout où il apparaît, qui vous dit lequel des deux cas vous lisez.
Que signifient les niveaux de confiance ?
Les niveaux sont définis une seule fois, dans trustBand(), et sont identiques partout où ils apparaissent : 80 et plus, « Confiance élevée » ; de 62 à 79, « Établi » ; de 42 à 61, « Historique limité » ; moins de 42, « Non éprouvé ». Un nouveau panel est « Non éprouvé » par construction, et c’est une indication sur nos preuves, pas sur le panel.
Comment le score de prix est-il calculé ?
Pour chaque service qu’un panel vend réellement, nous exprimons son prix en ratio de la médiane du marché pour ce même service de référence, puis nous prenons la médiane de ces ratios. Un ratio de 0,5 (la moitié du marché) vaut 10. Un ratio de 1,0 vaut 5. Un ratio de 2,0 vaut 0. Le score n’est calculé que là où le panel est en concurrence : un catalogue restreint n’est ni récompensé ni pénalisé pour les services qu’il ne propose pas.
| Ratio médian au marché | Lecture | Score de prix |
|---|---|---|
| 0,40× | 60 % sous la médiane du marché | 10,0 |
| 0,50× | 50 % sous la médiane du marché | 10,0 |
| 0,75× | 25 % sous la médiane du marché | 7,1 |
| 1,00× | Au niveau de la médiane du marché | 5,0 |
| 1,50× | 50 % au-dessus de la médiane du marché | 2,1 |
| 2,00× | 100 % au-dessus de la médiane du marché | 0,0 |
Source : computePriceScore() évalué pour chaque ratio sur un catalogue synthétique de trois services.
Pourquoi la médiane des ratios plutôt qu’une comparaison de moyennes ?
Parce que comparer des prix moyens mesure la composition d’un catalogue, pas sa politique tarifaire. Un panel qui ne propose que les deux catégories les moins chères du marché (likes Instagram et vues TikTok, toutes deux vendues à des fractions de cent) affiche un prix moyen bas et ne vous dit rien du prix de ses abonnés ou de ses heures de visionnage. Exprimer chaque service en ratio de la médiane de marché de ce même service élimine entièrement l’effet de composition : chaque ligne n’est comparée qu’à son équivalent, et une seule ligne aberrante ne fait pas bouger la médiane de ces ratios.
Cela compte davantage ici que sur la plupart des marchés, car plusieurs de ces marchés sont bimodaux. Les abonnés YouTube ont un palier bot vendu de 0,02 à 0,72 $, qui se présente lui-même comme à forte perte et sans refill, et un palier réel avec garantie de remplacement qui se négocie autour de 14,40 $, sans rien de significatif entre les deux (étude sectorielle de PanelCompare, 6 septembre 2026). Une moyenne de ces deux paliers ne décrit rien que l’on puisse acheter.
Deux garde-fous encadrent le calcul. Les ratios inférieurs à 0,02 fois ou supérieurs à 20 fois la médiane sont écartés comme des erreurs de données ou des services sur mesure, et non traités comme des signaux de prix : un service vendu cent fois le prix du marché est généralement un autre produit qui porte le même nom. Et un panel qui a moins de trois services comparables reçoit un 5 neutre plutôt qu’un 10 flatteur, car trois lignes ne font pas une politique tarifaire.
Comment les fonctionnalités, la fiabilité et le support sont-ils notés ?
Les pondérations des fonctionnalités reflètent ce que coûte à un acheteur l’absence d’une fonctionnalité, pas l’effet qu’elle produit sur le papier. Une garantie de remplacement protège l’achat lui-même ; un abonnement automatique fait gagner des clics. Les pondérations ci-dessous sont mesurées en activant un indicateur à la fois sur un jeu de données mis à zéro et en lisant la différence : ce sont donc les pondérations du code, et non une description de celles-ci.
| Fonctionnalité | Points | Pourquoi |
|---|---|---|
| Garantie de remplacement (refill) | 1,60 | La seule promesse de durabilité adossée à un mécanisme. |
| API publique | 1,30 | Indispensable pour automatiser, et vérifiable de façon indépendante. |
| Livraison progressive | 1,20 | Maîtrise du rythme sur les grosses commandes. |
| Bouton d’annulation | 1,10 | Le seul contrôle dont dispose l’acheteur après la commande. |
| Ciblage géographique | 0,90 | Le premier facteur de prix de tout catalogue. |
| Panels enfants | 0,80 | Compte pour les revendeurs, pas pour les acheteurs finaux. |
| Commande groupée | 0,60 | Envoi en masse sans passer par l’API. |
| Abonnements automatiques | 0,50 | Un confort, pas une protection. |
| Crédit d’essai gratuit | 0,50 | Permet de tester la livraison avant tout dépôt. |
| Taille du catalogue (note maximale : 10 000 services) | 0,70 | Échelle logarithmique : passer de 50 à 500 services compte, passer de 5 000 à 50 000 ne compte pas. |
| Moyens de paiement (note maximale : 8 ou plus) | 0,40 | La diversité des moyens de paiement est une voie de secours, pas un confort. |
| Plateformes couvertes (note maximale : 15 ou plus) | 0,40 | Étendue des relations d’approvisionnement, déduite du catalogue synchronisé. |
| Bonus selon la durée de refill | 0,30 / 0,45 / 0,50 | Valeurs à 30 j / 90 j / 365 j. La courbe s’aplatit nettement au-delà de 90 jours, car les durées longues et « à vie » sont souvent non honorées en pratique. |
Source : computeFeatureScore() évalué indicateur par indicateur. Le score final est plafonné à 10 : un panel qui a toutes les fonctionnalités ne dépasse pas l’échelle.
Comment la disponibilité est-elle notée ?
La disponibilité est élevée au carré avant la mise à l’échelle, ce qui rend l’écart entre 99 % et 95 % bien plus grand que l’écart entre 80 % et 76 % : en haut de l’échelle, la disponibilité est le produit lui-même, et en bas, le panel est déjà inutilisable. Le temps de réponse sert à départager et vaut au plus 1,5 point : un panel en ligne mais lent prend quand même votre commande. En dessous de cinq tests en 30 jours, nous ne notons pas du tout la composante.
| Disponibilité sur 30 jours | Score de fiabilité |
|---|---|
| 100 % | 9,85 |
| 99 % | 9,68 |
| 95 % | 9,02 |
| 90 % | 8,24 |
| 80 % | 6,79 |
Source : computeReliabilityScore() pour 60 tests et un temps de réponse moyen de 800 ms.
Comment le support est-il noté ?
Les canaux publiés fixent un plancher, et les notes des acheteurs prennent le dessus. Dès qu’au moins trois des avis approuvés qui composent la note en étoiles d’un panel ont noté directement le support, ces éléments valent 65 % de la composante et la présence d’un widget de chat seulement 35 %, car un widget s’achète alors qu’une réponse est un comportement. Le badge d’acheteur vérifié ne conditionne pas ce calcul : il conditionne la composante avis du score de confiance, décrite plus haut, et rien d’autre.
| Dispositif de support | Score |
|---|---|
| Aucun canal publié | 3,50 |
| Système de tickets seul | 5,50 |
| Chat en direct seul | 6,00 |
| Une adresse e-mail de support publiée, sans widget de chat | 6,00 |
| Les deux canaux | 8,00 |
| Les trois canaux | 8,50 |
| Les trois, et les acheteurs notent le support 4,5/5 | 8,66 |
Source : computeSupportScore() pour chaque combinaison.
À quoi ressemble le calcul sur un vrai panel ?
L’exemple ci-dessous est le panel qui occupe actuellement la première place, choisi par le classement lui-même et non par nous, et chaque chiffre est lu en direct dans l’indice. Ses cinq notes partielles entrent dans la somme pondérée ; le résultat est le chiffre affiché sur la page du panel NSBOOSTBD.
- Panel
- NSBOOSTBD
- Confiance
- 75,1 / 100
- Score global
- 7,8 / 10
nsboostbd.com
Établi
Recalculé ici : 7,9 · couverture 92 %
Étape 1 : le score de confiance détaillé
| Composante | Points | Max. | Ce que nous avons observé |
|---|---|---|---|
| Ancienneté du domaine | 0,0 | 20 | Recherche WHOIS en attente. Critère exclu de la moyenne tant que nous n’avons pas de date. |
| Disponibilité sur 30 jours | 21,3 | 25 | 100,0 % des 11 vérifications ont abouti. |
| Fraîcheur du catalogue | 10,0 | 10 | Prix synchronisés au cours des dernières 24 heures. |
| Avis d’acheteurs vérifiés | 0,0 | 20 | Aucun avis vérifié pour l’instant. Ne pas avoir d’avis n’est pas la même chose qu’avoir de mauvais avis : ce critère est donc exclu de la moyenne et réduit plutôt la couverture. |
| Vérification | 5,0 | 15 | Vérifié : le propriétaire a prouvé qu’il contrôle le domaine. |
| Politiques publiées | 0,0 | 10 | Nous n’avons pas encore recherché de conditions d’utilisation, de politique de remboursement ni de canal de support. |
| Score de confiance | 75,1 | 100 |
Source : le trust_breakdown enregistré pour nsboostbd.com, écrit par la même fonction computeTrust() dont les maxima figurent plus haut. Dernière mise à jour : 30 sept. 2026.
Étape 2 : le score de prix, et ce qu’une moyenne aurait dit à la place
NSBOOSTBD propose 126 services que nous pouvons comparer à une médiane de marché. La médiane de ses ratios par service est de 0,925, ce qui donne un score de 5,6 sur 10.
| Méthode | Ratio au marché | Score obtenu |
|---|---|---|
| Médiane des ratios par service (notre méthode) | 0,925× | 5,6 |
| Prix moyen du panel ÷ médiane de marché moyenne (la comparaison naïve) | 0,646× | 8,1 |
Les deux lignes portent sur les mêmes 7544 services comparables. Le prix moyen du panel est de 11,17 $ pour 1 000, contre une médiane de marché moyenne de 17,28 $ : des chiffres qu’une poignée de lignes chères ciblées par pays peut faire bouger à elle seule, ce qui est précisément la distorsion que la médiane élimine.
Étape 3 : la moyenne pondérée, sur ce qui a été mesuré
Une composante sans observation derrière elle est retirée des deux côtés de cette moyenne au lieu d’y entrer avec un 5 neutre. Ce sont les pondérations des composantes restantes qui servent de diviseur : le chiffre est ainsi une moyenne de ce que nous savons, et non un mélange de ce que nous savons et d’une constante.
| Composante | Score | Pondération | Contribution |
|---|---|---|---|
| Prix par rapport au marché | 5,30 | 30 % | 1,590 |
| Confiance | 8,84 | 30 % | 2,651 |
| Couverture des fonctionnalités | 8,90 | 18 % | 1,602 |
| Disponibilité | 9,90 | 14 % | 1,386 |
| Supportnon mesuré | — | — | — |
| Divisé par la pondération mesurée | 92 % | 7,9 |
La ligne de la confiance est la seule qui mérite un mot d’arithmétique. Le score de confiance que nous publions pour NSBOOSTBD est de 75,1 sur 100, et il entre dans ce tableau à 8,84 : divisé par 8,5, et non par 10. C’est 85 et non 100 qui constitue la note maximale sur les 5 composantes dont la confiance fait la moyenne ; les 15 autres points sont le bonus de vérification, qui se situe hors de cette moyenne et est plafonné ici en haut de l’échelle. Diviser par 10 ferait entrer le point médian de la confiance, 42,5, à 4,25 sur une échelle dont le neutre est 5 : chaque panel dont nous ne savons rien porterait alors trois quarts de point de pessimisme sur 30 % de son score global, sans la moindre raison tirée des preuves. Avec cette mise à l’échelle, un panel qui n’a presque aucune preuve de confiance – dont le score de confiance a été décoté jusqu’à ce point médian – arrive ici à 5,0, le même neutre que celui de toutes les autres composantes de cette page lorsque nous ne les avons pas mesurées.
Source : le détail des composantes enregistré pour nsboostbd.com, repassé dans computeOverall() sur cette page. Le score global enregistré est de 7,8 ; si ces deux chiffres divergent un jour, l’indice n’est plus à jour, et c’est un bug qui mérite d’être signalé. 1 des 5 composantes n’est pas mesurée ici, d’où une couverture de 92 % et non de 100 %.
Que devient un panel que nous n’avons pas encore mesuré ?
Les données manquantes réduisent la confiance, pas le score. Quand nous n’avons aucune observation pour une composante, celle-ci sort entièrement de la moyenne – elle ne vaut pas zéro, et elle n’est pas remplie avec une demi-note neutre – et c’est le chiffre de couverture du panel qui baisse à la place. Pénaliser l’inconnu ferait dépendre le classement de la durée depuis laquelle nous observons un panel plutôt que de sa qualité, ce qui favoriserait discrètement les acteurs installés et désavantagerait chaque nouvel entrant.
Combler la lacune avec une constante, comme ce site le faisait auparavant, revient à commettre la même erreur sous un autre habit. La valeur de remplissage est identique pour tous les panels : plus elle couvre l’échelle, plus elle ramène tous les panels vers un seul chiffre – et un classement où personne ne peut descendre est un classement où personne ne peut monter non plus.
Une composante faisait exception, et c’était une erreur plutôt qu’un choix. Un panel que nous n’avions jamais synchronisé recevait un zéro sec sur 10 pour la fraîcheur du catalogue et restait dans le dénominateur, au motif que des prix saisis à la main méritaient d’être signalés dans le score.
Ce que cela mesurait, c’était notre propre trousseau de clés. Au moment où ces lignes ont été écrites, nous détenions des clés API pour 2 des 129 panels de l’indice – nous en avons 11 sur 128 aujourd’hui –, si bien que presque chaque fiche se voyait retirer la totalité des 10 points d’une base de 85 points, soit environ dix points de confiance une fois la moyenne renormalisée, pour une clé que nous n’avions pas. C’était la plus grande source de pessimisme de l’indice ; elle s’appliquait de façon presque uniforme, si bien qu’elle ne déplaçait personne par rapport à personne, et c’était précisément la règle que cette section dit ne pas suivre : une composante non mesurée, notée zéro au lieu d’être retirée. Un panel jamais synchronisé est désormais non mesuré. Cela lui coûte de la couverture plutôt que des points, et la ligne correspondante sur sa propre page indique en toutes lettres que les prix affichés sont saisis à la main.
Le retard que nous pouvons réellement constater coûte toujours des points, et cette branche n’a pas changé : un catalogue qui répondait le mois dernier et ne répond plus aujourd’hui est une observation sur le panel. C’est la même distinction que celle que nous faisons entre un indicateur de fonctionnalité qui vaut null et un indicateur qui vaut false.
Les petits échantillons sont ramenés vers la neutralité au lieu d’être traités comme des certitudes. Trois tests réussis ne prouvent pas la fiabilité : la composante disponibilité fait donc l’objet d’un lissage de Laplace – un succès fictif et un échec fictif ajoutés à l’échantillon – et n’est notée qu’au-delà de cinq tests en 30 jours.
Que ce score ne mesure-t-il pas ?
Dire ce qui manque fait partie de la méthodologie, car un score qui laisse entendre plus qu’il ne mesure est pire que pas de score du tout. Voici ce que nous ne savons pas aujourd’hui, et qu’il faudrait un programme de mesure pour apprendre.
- Si les refills sont réellement honorés. Nous notons la durée de refill annoncée, pas le respect constaté de la garantie. Mesurer la réalité exige un programme de commandes test ou une collecte structurée des litiges ; tant qu’il n’existe pas, les durées de refill que nous publions sont présentées comme une estimation du secteur.
- Les taux de perte et les délais de livraison réels. Les fourchettes de délai de démarrage annoncées sont des moyennes que le panel calcule lui-même à partir de ses commandes récentes, et elles sont souvent manipulées. Nous les enregistrons comme des déclarations, pas comme des mesures.
- La qualité livrée. Aucun comparateur ne peut inspecter les comptes qu’un panel envoie. Les gammes de qualité de nos données sont les libellés du panel lui-même, harmonisés mais non vérifiés.
- Les liens de propriété, dans leur totalité. Nous pouvons repérer des paires de clones à partir de textes, de ressources, de données de titulaire et de points de paiement communs, et nous publions ce que nous trouvons ; mais un exploitant qui sépare correctement ces signaux ne sera pas détecté.
Quand un score change-t-il ?
Quand une observation change. Les scores ne sont jamais modifiés à la main, et le schéma ne comporte aucun champ de forçage qu’un humain pourrait actionner. Ce qui varie, c’est la vitesse à laquelle un changement atteint la page, fixée par le délai de revalidation de chaque route.
| Type de page | Délai d’actualisation maximal |
|---|---|
| Tableaux de prix et pages de services | 30 minutes |
| Profils de panels et classements des meilleurs | 6 heures |
| Pages éditoriales, dont celle-ci | 1 jour |
| Pages légales (conditions, confidentialité) | 7 jours |
Source : les constantes REVALIDATE dans src/lib/site.config.ts.
Questions sur la formule
Un panel peut-il payer pour être mieux classé sur PanelCompare ?
Non. La formule de classement tient dans un seul fichier, src/lib/scoring.ts, et ne prend aucune donnée décrivant le statut d’affilié, le sponsoring ou un paiement. Un panel peut payer pour être affiché en premier : un panel sponsorisé est épinglé au-dessus de la première place, marqué Sponsorisé et non numéroté, et le classement numéroté qui suit est exactement celui que la formule a produit.
Pourquoi un panel moins bien noté apparaît-il au-dessus d’un panel mieux noté ?
À cause de qui se tient derrière. La liste par défaut compte trois groupes et trie par score au sein de chacun : d’abord les panels dont le propriétaire a prouvé par DNS qu’il contrôle le domaine, puis ceux dont l’exploitant nous a demandé à être référencé et a été accepté, puis tous les autres. Le premier signal est le seul de ce site qu’un panel ne peut pas fabriquer en se décrivant lui-même – un enregistrement DNS que seul l’exploitant du domaine peut publier – et il signifie qu’un propriétaire identifié répond publiquement aux plaintes. Le second est volontairement plus faible et ne vaut pas vérification : personne n’a prouvé qu’il contrôle quoi que ce soit, seulement qu’un exploitant réel s’est manifesté depuis une adresse qui fonctionnait, a accepté d’être mesuré et nous a laissés tester une clé API sur son propre panel. Un panel trouvé en parcourant le marché n’a rien accepté et ignore peut-être que ce site existe. Les deux démarches sont gratuites, ouvertes à tous les panels aux mêmes conditions, et aucune n’a d’équivalent payant. Les tris par prix, disponibilité, nombre de services, nouveauté et note ignorent tout cela et s’en tiennent strictement au critère qu’ils annoncent.
Que devient un panel que PanelCompare n’a pas encore mesuré ?
Les données manquantes réduisent la confiance, pas le score. Une composante sans observation derrière elle est retirée de la moyenne – elle ne vaut pas zéro et n’est pas remplie avec une demi-note neutre – et fait baisser à la place le chiffre de couverture publié pour le panel. Deux seuils distincts s’appliquent ensuite, et ils sont distincts à dessein. En dessous de 50 % de couverture, le score est ramené vers le point médian en proportion de l’écart, pour qu’une seule composante favorable ne puisse pas passer pour un panel vérifié. En dessous de 30 % de couverture, aucun niveau n’est attribué et le score s’affiche comme « Provisoire ». Pénaliser l’inconnu ferait dépendre le classement de la durée depuis laquelle nous observons un panel ; le combler avec une constante ramènerait tous les panels vers le même chiffre, et c’est précisément le défaut que cette méthode a remplacé.
Pourquoi le score de prix est-il une médiane de ratios plutôt qu’une comparaison de prix moyens ?
Parce qu’avec une moyenne, un panel peut obtenir un bon score en ne proposant que les deux catégories les moins chères du marché. Exprimer chaque service en ratio de la médiane de marché de ce service, puis prendre la médiane de ces ratios, ne mesure un panel que là où il est réellement en concurrence. Quand un panel vend un même service à plusieurs niveaux de qualité, ces lignes sont d’abord ramenées à un seul chiffre pour ce service par leur médiane : un service, une voix. Sans cette étape, un panel qui proposait 141 lignes d’abonnés Instagram et une seule ligne pour tout le reste voyait son service phare l’emporter 141 fois sur le reste de son catalogue, ce qui mesurait sa façon de découper ses gammes et non ce qu’il facture.
À quelle fréquence les scores changent-ils ?
Les tableaux de prix sont actualisés dans un délai maximal de 30 minutes, les profils de panels de 6 heures, et cette page de 1 jour. Un score bouge quand une observation sous-jacente bouge (un nouveau test, une nouvelle synchronisation du catalogue, un avis approuvé), jamais à la main.
Un chiffre de cette page vous semble faux ?
Chaque chiffre publié sur PanelCompare porte la date de son relevé, et chacun peut être contesté preuves à l’appui. La procédure, y compris ce qui compte comme preuve et le temps que prend une correction, est décrite sur la page À propos. Les propriétaires de panels peuvent aussi répondre publiquement à toute plainte publiée contre eux.