Genauigkeit von Online Tests

Wie steht es um die Genauigkeit von Online Tests? Manche sind genau, mit Grenzen. Ein Online-Test mit Zeitmessung ist genau genug, um zu zeigen, wie sich deine eigenen Ergebnisse ändern und wo du ungefähr neben einer Studie stehst. Eine Zahl auf die Millisekunde genau gibt er nicht, weil ein Browser die Verzögerung von Bildschirm, Maus und Tastatur nicht sehen kann. Ein Online-Fragebogen zählt deine Antworten genau zusammen. Was die Summe bedeutet, ist aber nur so gut wie die Fragen, deine Stimmung an dem Tag und die Gruppe, mit der verglichen wird. Diese Seite sagt, wo die Grenzen liegen, damit du ein Ergebnis für das nutzen kannst, was es ist.

Bildschirm mit dem Monitor-Hz-Test prüfen

Sind Online-Reaktionstests genau?

Ein Test im Browser ist nur so genau wie der Browser. Ein guter Test nimmt die Zeit deines Drucks aus dem Moment, den der Browser aufgezeichnet hat, und nicht aus dem Moment, in dem die Seite ihn gelesen hat. Den Beginn des Signals nimmt er aus dem Moment, in dem das Bild auf dem Bildschirm gezeichnet wurde, und nicht aus dem Moment, in dem die Seite es angefordert hat. Der Abstand zwischen beiden Zeitpunkten ist deine Reaktion. So gemacht, ist die Uhr selbst nicht die Schwachstelle.

Was die Uhr nicht sehen kann, ist der Rest der Kette. Dein Bildschirm braucht einen Moment zum Aufleuchten, deine Maus oder dein Touchscreen braucht einen Moment, um deinen Druck zu melden, und dein Computer braucht einen Moment, um ihn weiterzugeben. Zusammen ergibt das eine Verzögerung, die der Seite verborgen bleibt und von Gerät zu Gerät anders ist.

Die Studie, mit der diese Seite Reaktionszeiten vergleicht, hat die Verzögerung ihres eigenen Aufbaus gemessen und nennt eine zweite, niedrigere Zahl ohne diese Verzögerung[1]. Das kann diese Seite für dein Gerät nicht messen, darum rechnet sie die Verzögerungen ein, die Roboter-Tests mit Alltagsgeräten fanden: 44,1 ms bis 115,1 ms mehr als die Ausrüstung der Studie mit Tastatur oder Maus und 39,8 ms bis 52 ms mit Touchscreen[2][3]. Keine Studie hat eine Maus gedrückt, darum bekommt eine Maus die Zahlen der Tastatur. Darum steht ein Ergebnis als Spanne neben der Studie und nicht als ein genauer Rang, und darum ist es am Computer, wo die Spanne breit ist, nur ein grober Hinweis.

Was dein Bildschirm macht

Ein Bildschirm zeigt nur eine bestimmte Anzahl neuer Bilder pro Sekunde. Ein Bildschirm mit 60 Hz zeichnet sechzigmal pro Sekunde ein neues Bild, einer mit 144 Hz mehr als doppelt so oft. Auf dem langsameren kann ein Signal darum etwas später erscheinen als geplant, und das nächste Bild kommt noch später. Ein Test kann das bemerken, und die Tests hier tun es: Hängt der Bildschirm, während ein Signal zu sehen ist, zählt der Versuch nicht, und du machst ihn noch einmal.

Der Monitor-Hz-Test zeigt, wie oft dein Browser wirklich ein neues Bild bekommt. Das ist das Erste, was du über ein Zeitergebnis von deinem eigenen Gerät wissen solltest.

Was Maus, Tastatur und Touchscreen machen

  • Eine Maus meldet ihre Position und ihre Klicks eine bestimmte Anzahl Mal pro Sekunde. Eine Maus mit 1000 Hz meldet viel öfter als eine mit 125 Hz, und eine Funk- oder Bluetooth-Maus kann eine eigene Verzögerung dazugeben. Der Polling-Rate-Test zeigt, was deine macht.
  • Eine Tastatur wartet nach einem Druck sehr kurz, um sicher zu sein, dass es ein echter Druck war und kein Flackern des Schalters. Dieses Warten gehört zu jedem Tastendruck und ist bei jeder Tastatur anders. Der Tastatur-Test zeigt, ob jede Taste einmal zählt.
  • Ein Touchscreen muss deinen Finger bemerken, entscheiden, dass es ein Tippen ist, und es weitergeben. Das dauert einen Moment. Darum ist ein Ergebnis vom Handy etwas anderes als eines von der Maus, und wir sagen über ein Handyergebnis weniger als über eines von der Maus.

Wie die Tests hier ein Ergebnis fair halten

  • Der erste Versuch ist zum Üben da und zählt nicht.
  • Ein Druck vor dem Signal oder so kurz danach, dass es geraten gewesen sein muss, zählt nicht, und du machst den Versuch noch einmal.
  • Wechselst du während eines Versuchs zu einem anderen Tab oder einer anderen App, zählt der Versuch nicht.
  • Dein Ergebnis ist der mittlere Wert mehrerer Versuche, ein Glücks- oder Pechversuch entscheidet es also nicht.
  • Ein Durchgang, der aussieht, als hätte ihn eine Maschine gemacht, bleibt erhalten, wird aber mit niemandem verglichen.

Die Seite So messen wir beschreibt dieselben Regeln und was noch ungeprüft ist.

Sind Online-Persönlichkeitstests genau?

Ein Fragebogen wird mit Rechnen ausgewertet, die Summe ist also genau. Fraglich ist, was die Summe bedeutet. Die Antworten zeigen, wie du dich an diesem Tag siehst. Sie hängen davon ab, wie die Aussagen formuliert sind, ob du sie so verstehst, wie die Autoren sie meinten, und wie du dich fühlst. Darum bewegt sich ein Ergebnis ein wenig, wenn du einen Test noch einmal machst. Darum ist ein längerer Fragebogen stabiler als ein kurzer.

Der Big-Five-Test auf dieser Seite nutzt den IPIP-NEO-120, einen gemeinfreien Fragebogen des Psychologen John A. Johnson[4], mit viel mehr Aussagen als die schnellen Tests. Ein Ergebnis zeigt, wo du zwischen den beiden Enden jeder Eigenschaft liegst. Gibt es für deine Sprache keine veröffentlichte Gruppe zum Vergleich, sagt das Ergebnis das und vergleicht dich nicht mit anderen Menschen.

Tests, die Menschen in ein paar Typen einsortieren, sind noch gröber, denn wer bei einer Eigenschaft nahe der Mitte liegt, kann an einem anderen Tag im anderen Fach landen. Ein Fragebogen ist ein Spiegel, um über dich nachzudenken. Er ist kein Urteil und keine Grundlage, um jemanden für eine Stelle auszuwählen.

So bekommst du ein möglichst genaues Ergebnis

  1. Nimm dasselbe Gerät und dieselbe Maus oder Tastatur, wenn du Ergebnisse vergleichst.
  2. Schließ andere Tabs und Programme, damit die Seite mitten in einem Versuch nicht gestört wird.
  3. Mach Tests mit Zeitmessung, wenn du ausgeruht bist, und zur ungefähr gleichen Tageszeit.
  4. Mach einen Test mit Zeitmessung mehrmals und schau auf die Mitte deiner Ergebnisse, nicht auf das beste.
  5. Lies die Aussagen eines Fragebogens langsam, antworte für den Menschen, der du meistens bist, und mach ihn später noch einmal, um zu sehen, was gleich bleibt.

Fragen

Sind Online-Tests genau?

Genau genug, um deinen eigenen Verlauf und einen groben Platz neben einer Studie zu zeigen, aber nicht exakt. Ein Browser kann die Verzögerung von Bildschirm und Maus oder Tastatur nicht sehen, und ein Fragebogen ist nur so gut wie seine Fragen und die Art, wie du sie beantwortest.

Warum ist meine Reaktionszeit online langsamer als im Labor?

Dein Bildschirm, deine Maus oder dein Touchscreen und dein Browser geben je eine Verzögerung dazu, die eine Webseite nicht sehen kann. Müdigkeit und Aufmerksamkeit kommen dazu.

Verändert mein Gerät mein Ergebnis?

Ja. Ein Handy, ein Laptop mit Touchpad und ein Computer mit Maus bringen jeweils eine eigene Verzögerung mit. Vergleiche deine Ergebnisse also nur mit Ergebnissen vom selben Gerät.

Sind Online-Persönlichkeitstests genau?

Sie zählen deine Antworten genau zusammen, beschreiben aber, wie du dich an dem Tag siehst. Ein Ergebnis ist also ein Anfang, um über dich nachzudenken, und kein Urteil.

Quellen

  1. Woods, D. L., Wyma, J. M., Yund, E. W., Herron, T. J., & Reed, B. (2015). Factors influencing the latency of simple reaction time. Frontiers in Human Neuroscience, 9, 131.doi:10.3389/fnhum.2015.00131
    n = 1.469; Community volunteers in Rotorua, New Zealand, aged 18 to 65 (mean age 45.8, 40% men)
  2. Pronk, T., Wiers, R. W., Molenkamp, B., & Murre, J. (2020). Mental chronometry in the pocket? Timing accuracy of web applications on touchscreen and keyboard devices. Behavior Research Methods, 52(3), 1371–1382.doi:10.3758/s13428-019-01321-2
    Four devices from 2015 and 2016: a MacBook Pro, an ASUS laptop, a Samsung Galaxy S7 and an iPhone 6S, pressed by a robot
    Abstract: "In controlled circumstances, as can be realized in a lab setting, very accurate stimulus timing and moderately accurate RT measurements could be achieved on both touchscreen and keyboard devices, though RTs were consistently overestimated." Table 4 "Descriptives of RT overestimations (in milliseconds) per device and browser" (OS, Web Browser, Minimum, Maximum, Mean, SD): "Android Chrome 46.0 103.5 69.8 7.4", "iOS Safari 48.3 96.3 57.6 6.5", "MacOS Safari 93.0 163.7 132.9 8.1", "Windows Chrome 64.7 70.6 68.5 1.7", "Windows Firefox 49.8 84.9 61.9 5.7". (gelesen am 2026-10-06: https://www.ebi.ac.uk/europepmc/webservices/rest/PMC7280355/fullTextXML)
  3. Anwyl-Irvine, A., Dalmaijer, E. S., Hodges, N., & Evershed, J. K. (2021). Realistic precision and accuracy of online experiment platforms, web browsers, and devices. Behavior Research Methods, 53(4), 1407–1425.doi:10.3758/s13428-020-01501-5
    Desktop and laptop computers with Windows 10 and macOS, pressed by a robot; and the equipment of 202,600 online participants
    Abstract: "We then employed a robot actuator in realistic set-ups to measure response recording across the aforementioned platforms, and between different keyboard types (desktop and integrated laptop)." "We found that modern web platforms provide reasonable accuracy and precision for display duration and manual response time". Table 2 "RT delay is calculated as the difference between known and recorded RT." Browser means: "Chrome 78.81", "Edge 80.10", "Firefox 82.30", "Safari 76.50"; device means: "macOS-Desktop 85.35", "Windows-Desktop 76.24", "Windows-Laptop 73.65". Results: "We found that 77% of these devices were desktop or laptop computers, whereas only 20% were mobile devices" "Based on a sample of 202,600 participants." (gelesen am 2026-10-06: https://www.ebi.ac.uk/europepmc/webservices/rest/PMC8367876/fullTextXML)
  4. Johnson, J. A. (2014). Measuring thirty facets of the Five Factor Model with a 120-item public domain inventory: Development of the IPIP-NEO-120. Journal of Research in Personality, 51, 78-89.doi:10.1016/j.jrp.2014.05.003