Zum Inhalt springen

Redaktionelle Grundsätze

Wie PanelCompare SMM-Panels bewertet

Jede Zahl auf dieser Seite wird aus src/lib/scoring.ts erzeugt, derselben Datei, mit der die Ranking-Pipeline läuft. Die Seite kann nicht von der Formel abweichen, denn sie ruft sie auf.

Zuletzt aktualisiert am von der Redaktion PanelCompare

Wie die Standardliste sortiert ist

Über der Wertung steht eine einzige Frage, und nur diese eine: Wer steht hinter dem Eintrag, und was hat er tatsächlich getan, um dafür einzustehen? Daraus ergeben sich für die Standardliste drei Stufen, in dieser Reihenfolge. Innerhalb jeder Stufe entscheidet die Gesamtwertung, genau so, wie die Formel sie berechnet.

  1. 1.Der Inhaber hat die Domain nachgewiesen. Der Nachweis ist ein DNS-Eintrag, den nur der Betreiber der Domain veröffentlichen kann. Damit ist er das einzige Signal auf dieser Website, das kein Panel erzeugen kann, indem es über sich selbst spricht. Er stellt einen benannten, erreichbaren Betreiber hinter den Eintrag: jemanden, von dem man eine Antwort verlangen kann, der öffentlich auf Beschwerden antwortet und der etwas Reales verliert, wenn sich das Panel etwas zuschulden kommen lässt.
  2. 2.Der Inhaber hat um Aufnahme gebeten, und wir haben zugestimmt. Diese Stufe ist schwächer, und wir geben sie nicht für die Stufe darüber aus: Niemand hat die Kontrolle über irgendetwas nachgewiesen, und sie ist keine Verifizierung. Sie belegt, dass sich jemand gemeldet hat – ein Betreiber, der uns von einer funktionierenden Adresse aus geschrieben hat, der Messung zugestimmt hat und vom Ergebnis nicht überrascht werden kann – und, seit der Einrichtungsassistent das alte Formular ersetzt hat, dass er einen funktionierenden API-Schlüssel besaß und uns diesen an der API seines eigenen Panels prüfen ließ. Ein Panel, das wir beim Durchsuchen des Marktes gefunden haben, hat sich zu nichts bereit erklärt und weiß womöglich gar nicht, dass es diese Website gibt.
  3. 3.Alle übrigen. Der größte Teil des Index, und kein Urteil über diese Panels. Hier wird keinem Panel etwas angelastet. Wir haben schlicht niemanden auf der anderen Seite, und das ist eine Aussage über unseren Kontakt zum Panel, nicht über das Panel.

Eine hohe Wertung sagt, dass ein Panel günstig und erreichbar ist. Die beiden Stufen darüber sagen, dass jemand dahintersteht – und wie weit dieser Jemand tatsächlich mit seinem Namen dafür einsteht. Das sind verschiedene Fragen, und wer gerade Geld überweisen will, hat Anspruch darauf, dass die zweite zuerst beantwortet wird.

Beide Stufen sind kostenlos, beide stehen jedem Panel im Index zu identischen Bedingungen offen, und für keine gibt es eine bezahlte Entsprechung – weder jetzt noch künftig. Ein Panel kann keine der beiden Positionen kaufen, so wenig wie eine Wertung. Die Verifizierung ist ein einziger TXT-Eintrag und dauert etwa zwei Minuten, direkt auf der Seite des Panels; die zweite Stufe erhält, wer ein Panel einträgt, sobald die Redaktion den Eintrag annimmt.

Die zweite Stufe ist neu, Stand heute. Bis heute gab es zwei – verifiziert, dann alle übrigen –, und so stand es auf dieser Seite. Damit stand ein Panel, dessen Betreiber sich gemeldet, unsere Fragen beantwortet und einen funktionierenden API-Schlüssel übergeben hatte, an genau derselben Stelle wie eines, das wir in einem Forum aufgelesen hatten. Das unterschätzte, was wir über das erste wussten. Niemand musste etwas tun, um die neue Stufe zu erhalten, und niemand wurde darum gebeten: Die Spalte wurde rückwirkend aus den bereits angenommenen Einsendungen befüllt, sodass ein Betreiber, der uns vor Monaten geschrieben hat, sie heute ohne jedes Zutun hat. Was sie nicht bewirkt: Sie bringt niemanden an einem verifizierten Inhaber vorbei, und sie wird nicht dadurch zur Verifizierung, dass sie neben einer steht. Der Domain-Nachweis ist die Stufe darüber, und dort bleibt er.

Die Regel gilt nur für das Standard-Ranking. Die Sortierungen Günstigste zuerst, Beste Verfügbarkeit, Größter Katalog, Neueste zuerst und Beste Bewertung versprechen jeweils eine bestimmte Reihenfolge und halten sich strikt daran. Eine Liste mit der Überschrift „Günstigste zuerst“, die nicht die günstigsten zuerst zeigt, wäre schlimmer als gar keine Sortierung. Filter und sämtliche Preistabellen bleiben davon unberührt.

Ändert eine Zahlung an PanelCompare die Position eines Panels?

Nein. Affiliate-Status, Sponsoring und bezahlte Platzierung kommen in der Ranking-Formel nicht vor, und das lässt sich nachprüfen statt nur behaupten: Die gesamte Formel steht in einer Datei, und diese enthält kein Feld, das eine Geschäftsbeziehung beschreibt. Die Datenbank führt zwar ein Flag is_affiliate und ein Flag is_sponsored: Das erste entscheidet, ob ein ausgehender Link rel="sponsored" und einen sichtbaren Partner-Hinweis trägt. Das zweite markiert ein Panel, das für eine über Platz 1 fixierte Zeile bezahlt; diese Zeile ist als „Anzeige“ gekennzeichnet und trägt nie eine Platznummer. Keines der beiden Flags liest der Wertungscode.

Wofür wir bezahlt werden können, steht auf der Seite zur Offenlegung, einschließlich der Angabe, welche ausgehenden Links derzeit konkret vergütet werden.

Was fließt in die Gesamtwertung ein?

Fünf Komponenten, gewichtet. Preis und Vertrauen tragen zusammen 60 %, weil das die beiden Fragen sind, die sich Käufer tatsächlich stellen: Kann ich es mir leisten, und wird geliefert? Support zählt am wenigsten, weil ein Chat-Widget leicht einzubauen und schwer zu überprüfen ist. Die Gewichte unten werden beim Rendern aus der exportierten Konstante OVERALL_WEIGHTS gelesen.

Gewichtung der Gesamtwertung nach Komponente
KomponenteGewichtSkalaWas gemessen wird
Preis30 %0–10Median der Preisverhältnisse dieses Panels pro Service, jeweils gemessen am Marktmedian des Services.
Vertrauen30 %0–100, über die Basis von 85 Punkten auf 0–10 umgerechnetDer unten aufgeschlüsselte Vertrauenswert. Jede Eingangsgröße ist eine Beobachtung, keine Meinung. Er geht in diesen Durchschnitt geteilt durch 8,5 statt durch 10 ein, denn die volle Punktzahl der Komponenten, über die das Vertrauen gemittelt wird, ist 85 – nicht 100. So landet der Mittelpunkt des Vertrauenswerts von 42,5 auf der neutralen 5, die alle anderen Komponenten hier verwenden.
Funktionen18 %0–10Funktionsmerkmale, gewichtet danach, was es Käufer kostet, wenn eines fehlt, plus die Breite des Katalogs.
Zuverlässigkeit14 %0–10Verfügbarkeit in den letzten 30 Tagen; bei knappen Abständen gibt die Antwortzeit den Ausschlag.
Support8 %0–10Veröffentlichte Kanäle – ein Ticketsystem, ein Live-Chat-Widget und ein Funktionspostfach auf der eigenen Domain des Panels –, ersetzt durch Käuferbewertungen des Supports, sobald mindestens drei vorliegen.
Summe100 %

Quelle: OVERALL_WEIGHTS in src/lib/scoring.ts, beim Build gelesen. Die Gesamtwertung wird auf eine Nachkommastelle gerundet.

Wie wird der Vertrauenswert berechnet?

Das Vertrauen ist ein Durchschnitt über 5 Komponenten mit zusammen 85 Punkten, plus bis zu 15 Punkte Verifizierungsbonus; für veröffentlichte Beschwerden gibt es einen Abzug. Die Gewichte beantworten eine einzige Frage: Wie viel würde es einen Angreifer kosten, dieses Signal zu fälschen? Domainalter und ein abgeschlossener Testkauf sind teuer zu fälschen. Ein TLS-Zertifikat ist kostenlos, zählt hier also nichts und ist überhaupt keine Komponente.

Es ist ein Durchschnitt über die Komponenten, die wir gemessen haben, nicht über alle. Eine Komponente ohne Beobachtung – ein Panel, das wir noch nicht geprüft haben, eines ohne verifizierte Bewertungen – fällt sowohl aus den erreichten als auch aus den möglichen Punkten heraus. Sie zählt nicht als null, und sie wird auch nicht mit einer neutralen Hälfte aufgefüllt.

Komponenten des Vertrauenswerts, Höchstpunktzahl und Begründung
KomponenteMax.Was gemessen wirdWarum so gewichtet
Domainalter20Registrierungsdatum laut RDAP/WHOIS, bewertet auf einer Wurzelkurve, die nach fünf Jahren die volle Punktzahl erreicht.Alter lässt sich nicht rückwirkend kaufen. Deshalb ist es der stärkste Schutz gegen ein Panel, das verschwindet und unter neuem Namen wieder aufmacht, und es entlarvt ein „seit 2014“ im Footer einer Domain, die letztes Jahr registriert wurde.
Verfügbarkeit, letzte 30 Tage25Erfolgreiche HTTP- und API-Prüfungen als Anteil aller Prüfungen der letzten 30 Tage, mit Laplace-Glättung: Bevor die Quote quadriert und skaliert wird, kommen ein gedachter Erfolg und ein gedachter Fehlschlag zur Stichprobe hinzu.Es ist die einzige Komponente, die wir selbst laufend erzeugen, und ein Einbruch der Verfügbarkeit ist das früheste beobachtbare Signal für den Ausfall eines Anbieters oder einen Ausstieg des Betreibers. Die Glättung begrenzt eine kurze Messreihe von beiden Seiten: Fünf Erfolge aus fünf Prüfungen ergeben 18,4 von 25 Punkten statt der vollen Punktzahl, null aus fünf ergeben 0,5. Die Mischformel, die dadurch ersetzt wurde, gab dafür 16,9 bzw. 8,1 Punkte. Sie belohnte eine kleine Stichprobe fürs Scheitern und bestrafte eine fürs Gelingen – genau die umgekehrte Reihenfolge.
Aktualität des Katalogs10Wie kürzlich der Katalog dieses Panels erfolgreich in unseren Index synchronisiert wurde. Ein Panel, das wir nie synchronisiert haben, wird hier gar nicht bewertet: Das ist ein fehlender API-Schlüssel auf unserer Seite, keine Veraltung auf seiner, und kostet deshalb Abdeckung statt Punkte.Für die Preise eines Katalogs, den wir nicht erneut auslesen können, können wir nicht geradestehen. Beobachtete Veraltung kostet daher Punkte, auch wenn das Panel selbst einwandfrei läuft. Das bloße Fehlen jeder Synchronisierung tut das nicht mehr. Bis heute tat es das, mit pauschal −10 Punkten für 127 der 129 Panels im Index – eine Zahl, die unseren Schlüsselbund beschrieb, nicht irgendein Panel darin.
Verifizierte Käuferbewertungen20Durchschnittliche Sternebewertung aus den Bewertungen verifizierter Käufer des Panels – den freigegebenen Bewertungen, bei denen ein Moderator auch einen Kaufnachweis gesehen hat –, zum indexweiten verifizierten Durchschnitt hin gezogen: 8 gedachte Bewertungen auf diesem Ausgangswert (Prior) werden mit den eigenen Bewertungen des Panels zusammengelegt. Der Ausgangswert beträgt 3,0/5, bis der Index genug verifizierte Bewertungen enthält, um ihn zu schätzen. Unter 3 verifizierten Bewertungen wird die Komponente gar nicht bewertet. Diese Menge ist enger als die Sternebewertung auf der Seite eines Panels, die jede freigegebene Bewertung zählt, verifiziert oder nicht: Das Abzeichen entscheidet, ob eine Bewertung in diese Komponente mit 20 von 85 Punkten eingeht, nicht, ob sie als Bewertung zählt.1★ entspricht 0, der Ausgangswert der Hälfte der 20 Punkte, 5★ allen – Käufer können ein Panel also nach unten wie nach oben bewegen, was die frühere Formel nicht konnte. Sie multiplizierte die Qualität mit einem Mengenfaktor und war nach unten bei null begrenzt: Zweihundert verifizierte Ein-Stern-Bewertungen brachten noch 9 von 20 Punkten, sodass das am schlechtesten bewertete Panel, das wir beschreiben konnten, keine zwei Punkte hinter einem lag, das nie jemand bewertet hatte. Nur verifizierte Bewertungen, weil ein Panel diese Komponente selbst schreiben kann: Eine unverifizierte Bewertung kostet nichts in der Herstellung und bewegt die öffentliche Sternebewertung, bei der Leser sehen, dass das Abzeichen fehlt. Bis zu 20 von 85 gewichteten Vertrauenspunkten zu bewegen, sollte eine echte Bestellung kosten.
Verifizierung15Zehn Punkte, wenn wir eine echte Bestellung aufgegeben haben und sie geliefert wurde; fünf, wenn der Inhaber die Kontrolle über die Domain nachgewiesen hat.Ein abgeschlossener Testkauf ist das einzige Signal hier, das wir selbst erzeugen – gegenüber einem Panel, das ein Interesse daran hat, gut dazustehen. Deshalb hat er in dieser Komponente das größte Gewicht. Er wird als Bonus addiert statt eingemittelt: Ob wir schon dazu gekommen sind, bei einem Panel testweise zu bestellen, ist eine Aussage über unsere Arbeitslast, und ein Panel sollte nicht für unseren Rückstand abgewertet werden.
Veröffentlichte Richtlinien10Veröffentlichte AGB (3), veröffentlichte Erstattungsregeln (4) und ein erreichbarer Support-Kanal (3).Leicht zu erfüllen und leicht zu fälschen, daher wenig wert. Aber ein Panel ohne veröffentlichte AGB und ohne erreichbaren Support hat Ihnen damit schon etwas gesagt.
Gemittelt über85Die Verifizierung steht außerhalb dieser Summe: Sie fügt Punkte hinzu, ohne sie zu verwässern. Dass wir selbst noch nicht bei einem Panel gekauft haben, zählt also nie gegen das Panel.

Quelle: Höchstwerte der Komponenten, beim Build aus computeTrust() in src/lib/scoring.ts gelesen.

Was kostet eine veröffentlichte Beschwerde ein Panel?

Der Abzug wird nach der Summe der Komponenten angewendet und kann ein Panel daher unter jede Wertung drücken, die seine übrigen Signale erreicht haben. Jede Beschwerde, die ein Moderator veröffentlicht hat, zählt. Eine Meldung fällt erst aus der Zählung heraus, wenn ein Moderator sie auf disputed (bestritten) oder resolved (erledigt) setzt – eine Entscheidung, die ein Mensch über einen konkreten Fall trifft.

Die Antwort eines Inhabers bewirkt das nicht. Ein verifizierter Inhaber kann auf jede Meldung öffentlich antworten, und die Antwort erscheint unbearbeitet daneben. Punkte bewegt sie allein aber nicht: Den Abzug an das Antwortfeld zu koppeln, würde diese Stelle zur einzigen auf der Website machen, an der ein Panel seine eigene Wertung ändert, indem es etwas in ein Feld tippt. Ob eine Antwort tatsächlich eine Antwort ist, entscheidet ein Moderator, und disputed ist der Status, in dem diese Entscheidung festgehalten wird. Auf dieser Seite stand früher das Gegenteil – dass eine Meldung, auf die der Inhaber geantwortet hatte, nicht mehr zählt –, und das hat der Code nie getan.

Was das Gewicht tatsächlich verändert, sind Belege. Eine Meldung, für die ein Moderator einen Nachweis gesehen hat – eine Bestell-ID, einen Transaktions-Hash, einen Screenshot mit sichtbarem Zeitstempel –, zählt voll. Eine Meldung, die er für glaubwürdig und konkret hielt, aber nicht überprüfen konnte, zählt mit dem Faktor 0,4. Nicht null, weil gerade der Käufer mit dem stärksten Fall oft nur noch einen Login in der Hand hat, der nicht mehr funktioniert. Die Kurve ist logarithmisch und gedeckelt, denn die zehnte Beschwerde sagt weit weniger aus als die erste.

Abzug für Beschwerden nach Anzahl veröffentlichter Meldungen
Veröffentlichte BeschwerdenAlle belegtKeine belegt
1−12,0−7,9
2−16,7−10,8
3−20,0−13,1
5−24,7−16,7
10−31,7−22,6
25−35,0−31,7

Quelle: computeTrust(), ausgewertet für jede Anzahl von Beschwerden, einmal mit allen Meldungen belegt und einmal mit keiner. Der Abzug ist auf 35 Punkte gedeckelt. Trägt ein Panel einen Abzug, sind der genaue Wert und die zugrunde liegenden Meldungen auf der Vertrauensseite dieses Panels aufgeschlüsselt.

Was passiert, wenn wir etwas nicht gemessen haben?

Die Komponente fällt aus dem Durchschnitt heraus und senkt stattdessen die Abdeckung – den Anteil der 85 gewichteten Punkte, für die wir tatsächlich Belege haben. Die Abdeckung steht auf dieser Website neben jedem Vertrauenswert und wird von der API mitgeliefert, denn eine 70 aus fünf Komponenten und eine 70 aus zwei sind verschiedene Aussagen, und eine einzelne Zahl kann nicht sagen, welche Sie vor sich haben.

Das ersetzte einen früheren Ansatz, der jede Lücke mit einem neutralen halben Anteil füllte. Das klingt nach der vorsichtigen Wahl und ist es nicht, aus einem Grund, der klar ausgesprochen gehört: Der Füllwert ist für jedes Panel dieselbe Konstante. Je mehr der Skala er belegt, desto stärker wird jedes Panel auf dieselbe Zahl gezogen. Als es uns auffiel, waren 60 der 100 Punkte für fast jedes Panel im Index gleich – Verfügbarkeit, Bewertungen und Verifizierung waren durchweg ungemessen –, und vier Werte deckten neun von zehn Einträgen ab. Die Wertung beschrieb keine Panels mehr, sondern unsere eigene Abdeckung, und erschien dabei weiter als scheinbar sichere Zahl von hundert.

Eine Renormierung hat das umgekehrte Problem: Ist nur eine Komponente gemessen, wird diese Komponente zur ganzen Wertung. Deshalb wird das Ergebnis unter 50 % Abdeckung zum Mittelpunkt hin zurückgezogen, und zwar anteilig dazu, wie weit es darunter liegt. So kann ein Panel, dessen einzige gemessene Komponente zufällig die volle Punktzahl hat, nicht wie ein Panel aussehen, das wir geprüft haben.

Eine zweite, niedrigere Schwelle entscheidet etwas anderes: ob wir der Wertung ein Wort geben. Unter 30 % Abdeckung wird keine Stufe vergeben – das Panel erscheint als Vorläufig, und die Zahl ist überall, wo sie steht, gepunktet unterstrichen. „Etabliert“ ist eine Aussage über ein Panel, und eine einzelne glückliche Beobachtung berechtigt uns nicht dazu: Die schwerste einzelne Komponente zählt 25 von 85 Punkten, also 29 %, sodass keine allein diese Schwelle überschreitet.

Bis heute waren beide Schwellen eine einzige Konstante bei 50 %, und so stand es auf dieser Seite. Das war in doppelter Hinsicht falsch. Sie beantworten verschiedene Fragen – „Wie sicher sind wir uns dieser Zahl?“ und „Reicht das, um ein Wort laut auszusprechen?“ –, und die Kopplung machte die Stufenschwelle unerreichbar: Alles, was wir ohne API-Schlüssel oder eine Reihe von Prüfungen über ein Panel erfahren können, ergibt zusammen 40 von 85 Punkten, also weniger als die Hälfte. So wurden 128 der 129 Panels im Index als „Vorläufig“ eingestuft, das beste davon mit 72,5 Punkten, und ein Vorbehalt, der für neunundneunzig von hundert Einträgen gilt, sagt über keinen von ihnen etwas aus. Zwischen 30 % und 50 % erhält ein Panel jetzt eine Stufe und trotzdem einen Abschlag. Die Abdeckung, die überall neben der Stufe steht, zeigt Ihnen, welcher der beiden Fälle vorliegt.

Was bedeuten die Vertrauensstufen?

Hohes VertrauenEtabliertBegrenzte HistorieUnbewiesen

Die Stufen sind an einer einzigen Stelle definiert, in trustBand(), und überall gleich: ab 80 „Hohes Vertrauen“, 62–79 „Etabliert“, 42–61 „Begrenzte Historie“, unter 42 „Unbewiesen“. Ein neues Panel ist zwangsläufig „Unbewiesen“, und das ist eine Aussage über unsere Belege, nicht über das Panel.

Wie wird die Preiswertung berechnet?

Für jeden Service, den ein Panel tatsächlich verkauft, setzen wir seinen Preis ins Verhältnis zum Marktmedian desselben Standard-Services und bilden dann den Median dieser Verhältnisse. Ein Verhältnis von 0,5 (halber Marktpreis) ergibt 10 Punkte, ein Verhältnis von 1,0 ergibt 5, ein Verhältnis von 2,0 ergibt 0. Gewertet wird nur, wo ein Panel im Wettbewerb steht: Ein schmaler Katalog wird für die Services, die er nicht führt, weder belohnt noch bestraft.

Medianes Preisverhältnis und die daraus folgende Preiswertung
Medianverhältnis zum MarktBedeutungPreiswertung
0,40×60 % unter dem Marktmedian10,0
0,50×50 % unter dem Marktmedian10,0
0,75×25 % unter dem Marktmedian7,1
1,00×Auf Höhe des Marktmedians5,0
1,50×50 % über dem Marktmedian2,1
2,00×100 % über dem Marktmedian0,0

Quelle: computePriceScore(), für jedes Verhältnis an einem synthetischen Katalog mit drei Services ausgewertet.

Warum der Median der Verhältnisse statt eines Vergleichs von Durchschnittspreisen?

Weil ein Vergleich von Durchschnittspreisen die Zusammensetzung eines Katalogs misst, nicht seine Preise. Ein Panel, das nur die zwei günstigsten Kategorien des Marktes führt (Instagram-Likes und TikTok-Aufrufe, beide zu Bruchteilen eines Cents), hat einen niedrigen Durchschnittspreis und sagt nichts darüber, was seine Follower oder Wiedergabestunden kosten. Wird jeder Service als Verhältnis zum Marktmedian genau dieses Services erfasst, fällt die Zusammensetzung vollständig heraus: Jede Zeile wird nur mit ihresgleichen verglichen, und der Median dieser Verhältnisse bleibt von einer einzelnen Ausreißerzeile unberührt.

Das wiegt hier schwerer als in den meisten Märkten, weil mehrere dieser Märkte bimodal sind. Bei YouTube-Abonnenten gibt es eine Bot-Stufe zu 0,02–0,72 $, die sich selbst als Stufe mit hohem Schwund und ohne Refill beschreibt, und eine echte Stufe mit Refill-Garantie, deren Marktpreis bei etwa 14,40 $ liegt – dazwischen nichts Nennenswertes (Domainrecherche von PanelCompare, 6. September 2026). Ein Mittelwert über diese beiden Stufen beschreibt nichts, was irgendjemand kaufen kann.

Zwei Schutzregeln sichern die Berechnung ab. Verhältnisse außerhalb von 0,02× bis 20× werden als Datenfehler oder Sonderanfertigungen verworfen statt als Preissignal gewertet: Ein Service zum Hundertfachen des Marktpreises ist meist ein anderes Produkt unter demselben Namen. Und ein Panel mit weniger als drei vergleichbaren Services erhält eine neutrale 5 statt einer schmeichelhaften 10, denn drei Zeilen sind keine Preispolitik.

Wie werden Funktionen, Zuverlässigkeit und Support bewertet?

Die Gewichte der Funktionen spiegeln, was es Käufer kostet, wenn eine Funktion fehlt – nicht, wie beeindruckend sie klingt. Eine Refill-Garantie schützt den Kauf selbst; ein automatisches Abo spart Klicks. Die Gewichte unten werden gemessen, indem jeweils ein einziges Merkmal an einem auf null gesetzten Eingabesatz umgeschaltet und die Differenz abgelesen wird. Es sind also die Gewichte des Codes, keine Beschreibung davon.

Gewichte der Funktionsmerkmale, von 10 Punkten
FunktionPunkteWarum
Refill-Garantie1,60Das einzige Haltbarkeitsversprechen, hinter dem ein Mechanismus steht.
Öffentliche API1,30Nötig für Automatisierung und unabhängig überprüfbar.
Drip-Feed1,20Steuert das Tempo großer Bestellungen.
Storno-Button1,10Die einzige Eingriffsmöglichkeit, die Käufer nach der Bestellung haben.
Geo-Targeting0,90Der größte Preistreiber in jedem Katalog.
Child-Panels0,80Wichtig für Reseller, nicht für Endkunden.
Massenbestellung0,60Viele Bestellungen auf einmal, ohne API.
Automatische Abos0,50Bequemlichkeit, kein Schutz.
Kostenloses Guthaben0,50Käufer können die Lieferung testen, bevor sie einzahlen.
Kataloggröße (volle Punktzahl ab 10.000 Services)0,70Logarithmisch skaliert: Der Schritt von 50 auf 500 Services zählt, der von 5.000 auf 50.000 nicht.
Zahlungsmethoden (volle Punktzahl ab 8 oder mehr)0,40Mehrere Zahlungswege sind ein Ausweg im Ernstfall, keine Bequemlichkeit.
Abgedeckte Plattformen (volle Punktzahl ab 15 oder mehr)0,40Breite der Lieferbeziehungen, abgeleitet aus dem synchronisierten Katalog.
Bonus für den Refill-Zeitraum0,30 / 0,45 / 0,50Bei 30 / 90 / 365 Tagen. Die Kurve flacht nach 90 Tagen stark ab, weil lange und lebenslange Refill-Zeiträume in der Praxis häufig nicht eingehalten werden.

Quelle: computeFeatureScore(), jeweils mit einem einzelnen Merkmal ausgewertet. Die Endwertung wird bei 10 gekappt, sodass ein Panel mit allen Funktionen die Skala nicht überschreitet.

Wie wird die Verfügbarkeit bewertet?

Die Verfügbarkeit wird vor dem Skalieren quadriert. Dadurch ist der Abstand zwischen 99 % und 95 % viel größer als der zwischen 80 % und 76 %, denn im oberen Bereich ist die Verfügbarkeit das Produkt, und im unteren ist das Panel ohnehin unbrauchbar. Die Antwortzeit ist das Zünglein an der Waage und höchstens 1,5 Punkte wert: Ein Panel, das erreichbar, aber langsam ist, nimmt Ihre Bestellung trotzdem an. Unter fünf Prüfungen in 30 Tagen bewerten wir die Komponente gar nicht.

Zuverlässigkeitswertung bei ausgewählten Verfügbarkeitswerten
Verfügbarkeit (30 Tage)Zuverlässigkeitswertung
100 %9,85
99 %9,68
95 %9,02
90 %8,24
80 %6,79

Quelle: computeReliabilityScore() bei 60 Prüfungen und einer durchschnittlichen Antwortzeit von 800 ms.

Wie wird der Support bewertet?

Veröffentlichte Kanäle legen eine Untergrenze fest, Käuferbewertungen haben Vorrang. Wo mindestens drei der freigegebenen Bewertungen, aus denen sich die Sternebewertung eines Panels zusammensetzt, den Support direkt bewertet haben, zählen diese Belege 65 % der Komponente und das Vorhandensein eines Chat-Widgets nur 35 %, denn ein Widget ist ein Kauf und eine Antwort ein Verhalten. Das Abzeichen „verifizierter Käufer“ spielt hier keine Rolle: Es entscheidet über die Bewertungskomponente des Vertrauenswerts, wie oben beschrieben, und über nichts sonst.

Supportwertung für jede Kombination von Kanälen
Support-AusstattungWertung
Kein veröffentlichter Kanal3,50
Nur Ticketsystem5,50
Nur Live-Chat6,00
Ein veröffentlichtes Support-Postfach, kein Chat-Widget6,00
Beide Kanäle8,00
Alle drei Kanäle8,50
Alle drei, und Käufer bewerten den Support mit 4,5/58,66

Quelle: computeSupportScore() für jede Kombination.

Wie sieht die Rechnung bei einem echten Panel aus?

Das Beispiel unten ist das Panel, das gerade auf Platz 1 steht – ausgewählt vom Ranking selbst, nicht von uns –, und jede Zahl wird live aus dem Index gelesen. Seine fünf Teilwertungen gehen in die gewichtete Summe ein; das Ergebnis ist die Zahl, die auf der Seite von NSBOOSTBD steht.

Panel
NSBOOSTBD

nsboostbd.com

Vertrauen
75,1 / 100

Etabliert

Gesamt
7,8 / 10

Hier neu berechnet: 7,9 · 92 % belegt

Schritt 1: der aufgeschlüsselte Vertrauenswert

Gespeicherte Aufschlüsselung des Vertrauenswerts von NSBOOSTBD
KomponentePunkteMax.Was wir beobachtet haben
Domainalter0,020WHOIS-Abfrage ausstehend. Bis wir ein Datum haben, bleibt dieser Wert beim Durchschnitt außen vor.
Verfügbarkeit, letzte 30 Tage21,325100,0 % von 11 Prüfungen waren erfolgreich.
Aktualität des Katalogs10,010Preise innerhalb der letzten 24 Stunden synchronisiert.
Verifizierte Käuferbewertungen0,020Noch keine verifizierten Bewertungen. Nicht bewertet ist nicht dasselbe wie schlecht bewertet: Dieser Wert bleibt beim Durchschnitt außen vor und wird stattdessen von der Abdeckung abgezogen.
Verifizierung5,015Verifiziert: Der Inhaber hat nachgewiesen, dass er die Domain kontrolliert.
Veröffentlichte Richtlinien0,010Noch nicht auf AGB, Erstattungsregeln oder einen Support-Kanal geprüft.
Vertrauenswert75,1100

Quelle: die gespeicherte trust_breakdown für nsboostbd.com, geschrieben von derselben Funktion computeTrust(), deren Höchstwerte oben tabelliert sind. Zuletzt aktualisiert am 30. Sept. 2026.

Schritt 2: die Preiswertung – und was ein Durchschnitt stattdessen ergeben hätte

NSBOOSTBD hat 126 Services, die wir mit einem Marktmedian vergleichen können. Der Median seiner Preisverhältnisse pro Service liegt bei 0,925×, was 5,6 von 10 Punkten ergibt.

Median der Verhältnisse im Vergleich zu einem naiven Durchschnittsvergleich für NSBOOSTBD
MethodeVerhältnis zum MarktErgäbe
Median der Preisverhältnisse pro Service (unsere Methode)0,925×5,6
Mittlerer Panelpreis ÷ mittlerer Marktmedian (der naive Vergleich)0,646×8,1

Beide Zeilen beruhen auf denselben 7544 vergleichbaren Services. Der mittlere Panelpreis liegt bei 11,17 $ pro 1.000, der mittlere Marktmedian bei 17,28 $ – Zahlen, die eine Handvoll teurer länderspezifischer Zeilen allein verschieben kann. Genau diese Verzerrung beseitigt der Median.

Schritt 3: der gewichtete Durchschnitt über das Gemessene

Eine Komponente ohne Beobachtung fällt auf beiden Seiten dieses Durchschnitts heraus, statt mit einer neutralen 5 einzugehen. Geteilt wird durch die Gewichte der verbleibenden Komponenten. Die Zahl ist also ein Durchschnitt dessen, was wir wissen, und keine Mischung aus Wissen und einer Konstante.

Berechnung der gewichteten Gesamtwertung für NSBOOSTBD
KomponenteWertungGewichtBeitrag
Preis im Marktvergleich5,3030 %1,590
Vertrauen8,8430 %2,651
Funktionsumfang8,9018 %1,602
Verfügbarkeit9,9014 %1,386
Supportnicht gemessen———
Geteilt durch das gemessene Gewicht92 %7,9

Die Vertrauenszeile braucht ein Wort zur Rechnung. Der veröffentlichte Vertrauenswert von NSBOOSTBD beträgt 75,1 von 100 und geht mit 8,84 in diese Tabelle ein – geteilt durch 8,5, nicht durch 10. Die volle Punktzahl der 5 Komponenten, über die das Vertrauen gemittelt wird, ist 85, nicht 100; die übrigen 15 Punkte sind der Verifizierungsbonus, der außerhalb dieses Durchschnitts steht und hier am oberen Ende der Skala gekappt wird. Eine Division durch 10 ließe den Mittelpunkt des Vertrauenswerts von 42,5 mit 4,25 eingehen, auf einer Skala, deren neutraler Wert 5 ist. Jedes Panel, über das wir nichts wissen, trüge dann auf 30 % seiner Gesamtwertung einen Dreiviertelpunkt Pessimismus, ohne jeden sachlichen Grund. So umgerechnet kommt ein Panel mit kaum Vertrauensbelegen – dessen Vertrauenswert ganz auf diesen Mittelpunkt zurückgezogen wurde – hier bei 5,0 an, demselben neutralen Wert, auf dem jede andere Komponente dieser Seite steht, wenn wir sie nicht gemessen haben.

Quelle: die gespeicherte Aufschlüsselung der Komponenten für nsboostbd.com, auf dieser Seite erneut durch computeOverall() gerechnet. Die gespeicherte Gesamtwertung beträgt 7,8. Weichen diese beiden Zahlen je voneinander ab, ist der Index veraltet, und das ist ein Fehler, den Sie uns melden sollten. 1 von 5 Komponenten ist hier nicht gemessen, deshalb liegt die Abdeckung bei 92 % und nicht bei 100 %.

Was passiert mit einem Panel, das wir noch nicht gemessen haben?

Fehlende Daten senken die Aussagekraft, nicht die Wertung. Wo wir für eine Komponente keine Beobachtung haben, fällt sie ganz aus dem Durchschnitt heraus – sie zählt nicht als null und wird nicht mit einer neutralen Hälfte aufgefüllt –, und stattdessen sinkt die Abdeckung des Panels. Ein Unbekanntes zu bestrafen, würde das Ranking daran koppeln, wie lange wir ein Panel schon beobachten, statt daran, wie gut es ist. Das würde stillschweigend etablierte Anbieter bevorzugen und jeden Neuling benachteiligen.

Die Lücke mit einer Konstante zu füllen, wie es diese Website früher tat, ist derselbe Fehler im umgekehrten Gewand. Der Füllwert ist für jedes Panel identisch; je mehr der Skala er abdeckt, desto stärker wird jedes Panel auf eine einzige Zahl gezogen. Und ein Ranking, in dem niemand nach unten rutschen kann, ist ein Ranking, in dem auch niemand aufsteigen kann.

Eine Komponente wich früher davon ab, und das war ein Fehler, keine Absicht. Ein Panel, das wir nie synchronisiert hatten, erhielt bei der Aktualität des Katalogs glatte null von 10 Punkten und blieb im Nenner – mit der Begründung, dass von Hand eingetragene Preise in der Wertung offen benannt werden sollten.

Gemessen hat das unseren eigenen Schlüsselbund. Als dieser Text entstand, hatten wir API-Schlüssel für 2 der 129 Panels im Index – heute sind es 11 von 129 –, sodass fast jedem Eintrag die vollen 10 Punkte einer Basis von 85 Punkten abgezogen wurden, nach der Renormierung des Durchschnitts rund zehn Vertrauenspunkte, und zwar für einen Schlüssel, den wir nicht hatten. Es war die größte einzelne Quelle von Pessimismus im Index. Da sie fast gleichmäßig wirkte, verschob sie niemanden gegenüber irgendjemandem, und sie war genau die Regel, der wir laut diesem Abschnitt nicht folgen: eine Komponente, die wir nicht gemessen haben, mit null bewertet statt herausgenommen. „Nie synchronisiert“ gilt jetzt als nicht gemessen. Es kostet Abdeckung statt Punkte, und die Zeile auf der Seite des Panels sagt ausdrücklich, dass die Preise dort von Hand eingetragen sind.

Veraltung, die wir tatsächlich sehen können, kostet weiterhin, und dieser Zweig bleibt unverändert: Ein Katalog, der letzten Monat geantwortet hat und heute nicht, ist eine Beobachtung über das Panel. Es ist dieselbe Unterscheidung, die wir zwischen einem Funktionsmerkmal mit dem Wert null und einem mit dem Wert false treffen.

Kleine Stichproben werden zum neutralen Wert hin gezogen, statt als Gewissheit zu gelten. Drei erfolgreiche Prüfungen belegen keine Zuverlässigkeit. Deshalb wird die Verfügbarkeitskomponente mit Laplace-Glättung berechnet – ein gedachter Erfolg und ein gedachter Fehlschlag kommen zur Stichprobe hinzu – und überhaupt erst ab fünf Prüfungen in 30 Tagen bewertet.

Was misst diese Wertung nicht?

Die Lücken zu benennen, gehört zur Methodik, denn eine Wertung, die mehr andeutet, als sie misst, ist schlimmer als gar keine. Das Folgende wissen wir derzeit nicht, und um es zu erfahren, müssten wir ein eigenes Messprogramm aufbauen.

  • Ob Refills tatsächlich geleistet werden. Wir bewerten den beworbenen Refill-Zeitraum, nicht die beobachtete Einhaltung. Das tatsächliche Verhalten zu messen, erfordert ein Programm mit Testbestellungen oder eine strukturierte Erfassung von Streitfällen. Bis es das gibt, sind die Refill-Zeiträume, die wir veröffentlichen, als Branchenschätzung gekennzeichnet.
  • Tatsächliche Schwundquoten und Lieferzeiten. Beworbene Startzeit-Spannen sind Durchschnittswerte, die ein Panel selbst aus jüngsten Bestellungen berechnet, und sie werden häufig geschönt. Wir erfassen sie als Angaben, nicht als Messungen.
  • Die gelieferte Qualität. Keine Vergleichsseite kann die Accounts prüfen, die ein Panel liefert. Qualitätsstufen in unseren Daten sind die eigenen Bezeichnungen der Panels, vereinheitlicht, aber nicht überprüft.
  • Gemeinsame Eigentümerschaft, vollständig. Klon-Paare können wir aus gemeinsamen Texten, Assets, Registrantendaten und Zahlungsendpunkten ableiten, und wir legen offen, was wir finden. Ein Betreiber, der diese Signale sauber trennt, bleibt aber unentdeckt.

Wann ändert sich eine Wertung?

Wenn sich eine Beobachtung ändert. Wertungen werden nie von Hand bearbeitet, und das Schema enthält kein Feld, mit dem ein Mensch sie übersteuern könnte. Unterschiedlich ist nur, wie schnell eine Änderung auf der Seite ankommt; das legt das Revalidierungsintervall der jeweiligen Route fest.

Revalidierungsintervalle nach Seitentyp
SeitentypLängstes Aktualisierungsintervall
Preistabellen und Service-Seiten30 Minuten
Panelprofile und Bestenlisten6 Stunden
Redaktionelle Seiten, auch diese1 Tag
Rechtliche Seiten und Richtlinien7 Tage

Quelle: die Konstanten REVALIDATE in src/lib/site.config.ts.

Fragen zur Formel

Kann ein Panel dafür bezahlen, bei PanelCompare weiter oben zu stehen?

Nein. Die Ranking-Formel steht in einer einzigen Datei, src/lib/scoring.ts, und sie nimmt keine Eingangsgröße auf, die Affiliate-Status, Sponsoring oder Zahlungen beschreibt. Ein Panel kann dafür bezahlen, zuerst angezeigt zu werden: Ein gesponsertes Panel ist über Platz 1 fixiert, als „Anzeige“ gekennzeichnet und ohne Platznummer, und das nummerierte Ranking darunter ist genau das, was die Formel ergeben hat.

Warum steht bei PanelCompare ein Panel mit niedrigerer Wertung über einem mit höherer?

Wegen der Frage, wer dahintersteht. Die Standardliste hat drei Stufen und sortiert innerhalb jeder Stufe nach der Wertung: zuerst Panels, deren Inhaber die Kontrolle über die Domain per DNS nachgewiesen hat, dann Panels, deren Betreiber uns um Aufnahme gebeten hat und angenommen wurde, dann alle übrigen. Die erste Stufe beruht auf dem einzigen Signal dieser Website, das ein Panel nicht durch Selbstbeschreibung erzeugen kann – einem DNS-Eintrag, den nur der Betreiber der Domain veröffentlichen kann –, und sie bedeutet, dass es einen benannten Inhaber gibt, der öffentlich auf Beschwerden antwortet. Die zweite ist bewusst schwächer und keine Verifizierung: Niemand hat die Kontrolle über irgendetwas nachgewiesen. Belegt ist nur, dass sich ein echter Betreiber von einer funktionierenden Adresse aus gemeldet, der Messung zugestimmt und uns einen API-Schlüssel an seinem eigenen Panel hat prüfen lassen. Ein Panel, das wir beim Durchsuchen des Marktes gefunden haben, hat sich zu nichts bereit erklärt und weiß womöglich gar nicht, dass es diese Website gibt. Beide Stufen sind kostenlos, beide stehen jedem Panel zu identischen Bedingungen offen, und für keine gibt es eine bezahlte Entsprechung. Die Sortierungen nach Preis, Verfügbarkeit, Kataloggröße, Eintragsdatum und Bewertung ignorieren all das und halten sich strikt an das Kriterium, das sie nennen.

Was passiert mit einem Panel, das PanelCompare noch nicht gemessen hat?

Fehlende Daten senken die Aussagekraft, nicht die Wertung. Eine Komponente ohne Beobachtung fällt aus dem Durchschnitt heraus – sie zählt nicht als null und wird nicht mit einer neutralen Hälfte aufgefüllt – und senkt stattdessen die veröffentlichte Abdeckung des Panels. Danach greifen zwei getrennte Schwellen, und die Trennung ist gewollt. Unter 50 % Abdeckung wird die Wertung anteilig zum Fehlbetrag zum Mittelpunkt hin zurückgezogen, damit eine einzelne glückliche Komponente nicht wie ein geprüftes Panel aussieht. Unter 30 % Abdeckung wird überhaupt keine Stufe vergeben, und die Wertung erscheint als „Vorläufig“. Ein Unbekanntes zu bestrafen, würde das Ranking daran koppeln, wie lange wir ein Panel schon beobachten; es mit einer Konstante aufzufüllen, würde jedes Panel auf dieselbe Zahl ziehen – genau der Fehler, den dieses Verfahren ersetzt hat.

Warum ist die Preiswertung von PanelCompare ein Median von Verhältnissen statt eines Vergleichs von Durchschnittspreisen?

Weil ein Panel bei Durchschnittspreisen gut abschneiden könnte, indem es nur die zwei günstigsten Kategorien des Marktes führt. Wird jeder Service ins Verhältnis zum Marktmedian dieses Services gesetzt und dann der Median dieser Verhältnisse gebildet, misst das ein Panel nur dort, wo es tatsächlich im Wettbewerb steht. Verkauft ein Panel einen Service in mehreren Qualitätsstufen, werden diese Zeilen zuerst per Median zu einem einzigen Wert für diesen Service zusammengefasst: ein Service, eine Stimme. Ohne diesen Schritt zählte bei einem Panel mit 141 Zeilen für Instagram-Follower und je einer Zeile für alles andere dieser eine Service 141-fach gegen den Rest des Katalogs. Gemessen wurde dann, wie das Panel seine Stufen staffelt, nicht, was es verlangt.

Wie oft ändern sich die Wertungen auf PanelCompare?

Bei PanelCompare beträgt das Aktualisierungsintervall höchstens 30 Minuten für Preistabellen, 6 Stunden für Panelprofile und 1 Tag für die Methodik-Seite. Eine Wertung ändert sich, wenn sich eine zugrunde liegende Beobachtung ändert (eine neue Prüfung, eine frische Synchronisierung des Katalogs, eine freigegebene Bewertung), nie von Hand.

Halten Sie eine Zahl hier für falsch?

Jede Zahl auf PanelCompare trägt das Datum ihrer Erfassung, und jede lässt sich mit Belegen anfechten. Das Verfahren – einschließlich dessen, was als Beleg gilt und wie lange eine Korrektur dauert – steht auf der Seite „Über uns“. Panel-Inhaber können außerdem öffentlich auf jede Beschwerde antworten, die gegen sie veröffentlicht wurde.