119 Tools, ein Markt: Was Online-Assessments gemeinsam haben und was sie unterscheidet
Das kürzeste Online-Assessment dauert zwei Minuten, das längste zwei Stunden. Eine Durchführung kostet zwischen 3,50 und 5.900 Euro. Wer in diesem Markt das passende Verfahren finden will, braucht zuerst eine klare Frage.
- 119 Tools, ein Markt: Was Online-Assessments gemeinsam haben und was sie unterscheidet
- Zwei Minuten oder zwei Stunden
- Warum die Wahl des Verfahrens mehr zählt als früher
- Was die Tools messen
- Wie die Tools aufgebaut sind
- Was ein Verfahren kostet, in Zeit und in Geld
- Was fast alle gemeinsam haben
- Welche Probleme die Tools lösen
- Erst die Frage, dann das Tool
Zwei Minuten oder zwei Stunden
Für diesen Beitrag habe ich 119 aktive Online-Assessment-Tools von 43 Anbietern Merkmal für Merkmal ausgewertet. Die Spannweite ist enorm. Die spielbasierten Verfahren von Aivy sind nach zwei bis drei Minuten abgeschlossen, das Leadership-Assessment KF4D von Korn Ferry braucht bis zu zwei Stunden. Der Preis pro Durchführung reicht von 3,50 Euro bei großen Stückzahlen bis 5.900 Euro für ein Verfahren mit vollständigem Interview.
Beide stehen in derselben Produktkategorie. Und beide sagen etwas über Menschen aus, allerdings über sehr verschiedene Dinge. Die 119 Tools messen unterschiedliche Merkmale, auf unterschiedliche Weise und zu unterschiedlichen Bedingungen. Wer das weiß, wählt anders.
Warum die Wahl des Verfahrens mehr zählt als früher
Die schriftliche Bewerbung verliert an Aussagekraft. In einer Umfrage von Greenhouse aus dem Jahr 2025 unter mehr als 4.000 Befragten berichten 91 Prozent der Recruiting-Verantwortlichen von beobachteter oder vermuteter KI-gestützter Täuschung. Laut Gartner haben 39 Prozent von 3.290 befragten Bewerbern bereits KI im Bewerbungsprozess eingesetzt, und Gartner prognostiziert, dass bis 2028 jedes vierte Kandidatenprofil nicht echt sein könnte.
Wenn Lebensläufe einander immer ähnlicher werden, rückt die Frage in den Vordergrund, womit man Menschen sonst verlässlich unterscheidet. Die Forschung gibt darauf eine differenzierte Antwort. Die Metaanalyse von Sackett, Zhang, Berry und Lievens (2022) beziffert die Vorhersagekraft für Berufsleistung beim strukturierten Interview auf .42, bei Fachwissenstests auf .40, bei Arbeitsproben auf .33 und bei kognitiven Fähigkeitstests auf .31. Verfahren unterscheiden sich also deutlich darin, was sie leisten. Die Wahl des Tools ist deshalb eine Entscheidung mit Folgen.
Was die Tools messen
Rund jedes dritte Tool im Markt misst Persönlichkeit oder Verhaltensstil, insgesamt 43 von 119, darunter OPQ32 von SHL, HPI von Hogan, MAP von Assessio und PPA von Thomas International. Kognitive Fähigkeiten erfassen 26 Tools, etwa Raven's Progressive Matrices von Pearson TalentLens, Verify G+ von SHL oder Matrigma von Assessio. Ebenso viele, nämlich 26, messen Führungsverhalten und Kompetenzen, zum Beispiel CAPTain von CNT, das Leadership Circle Profile oder XLNC_s von XLNC. Motive, Werte und Interessen stehen bei 16 Tools im Mittelpunkt, darunter MVPI von Hogan, das Reiss Motivation Profile von IDS und AKF von Ixly.
Kleiner sind die Spezialgebiete. Zehn Tools diagnostizieren Team, Kultur oder Klima, etwa das Organizational Culture Inventory von Human Synergistics oder das Lencioni Team Assessment von The Table Group. Je sieben Tools messen emotionale Intelligenz, wie EQ-i 2.0 von MHS, oder Urteilsvermögen in Arbeitssituationen. Sechs Tools richten sich auf Risiken, Derailer und Integrität, darunter HDS von Hogan sowie IBES und INWORK von Hogrefe. 18 Tools decken mehrere dieser Bereiche zugleich ab.
19 Tools, also jedes sechste, beziehen die Einschätzung anderer ein, als 360-Grad-Feedback oder Fremdbild. 15 davon sind Führungs-Tools. Führung wird damit häufig über die Wahrnehmung des Umfelds gemessen, die übrigen Bereiche setzen fast durchgehend auf Selbstauskunft.
Wie die Tools aufgebaut sind
Am häufigsten wird mit einer Skala gefragt. 54 Tools (45 Prozent) lassen Aussagen auf einer Likert-Skala bewerten. 18 Tools arbeiten mit Forced Choice, hier wählt man zwischen mehreren Aussagen, und das Ergebnis zeigt die Gewichtung innerhalb einer Person. Bekannte Beispiele sind OPQ32 von SHL, ADEPT-15 von Aon und PPA von Thomas International. 24 Tools sind Leistungstests mit richtigen und falschen Antworten, elf arbeiten mit Szenarien, sogenannten Situational Judgement Tests. Bei den Persönlichkeits-Tools zeigen sich zwei Lager: 28 fragen mit Skala, 14 lassen zwischen Aussagen wählen.
Zwei Drittel der Tools werten normbasiert aus, das Ergebnis einer Person wird also mit einer Vergleichsgruppe abgeglichen. 77 Tools tun das, unter den Tools mit Angabe zur Auswertungslogik sind es 94 Prozent. Neun Tools kombinieren den Normvergleich mit einem Abgleich gegen Kriterien, darunter Watson-Glaser von Pearson TalentLens und das Caliper Profile von Talogy. Rein kriterienbasiert wertet ein einziges Tool aus, CAPTain von CNT. Es misst Verhalten am Anforderungsprofil der Stelle, ohne Vergleichsgruppe.
Typentests sind bekannt und gehören zum Markt, zahlenmäßig sind sie in unserer Datenbank die Ausnahme. Die Hintergründe dazu sind oftmals die fehlende wissenschaftliche Belegbarkeit der Vorhersagekraft. Nur zwei der vielen typenorientierten Tools haben wir aufgenommen, diese ordnen Menschen in Typen ein, der MBTI von The Myers-Briggs Company und CORE Potential von Human Edge mit seinen Archetypen. Alle übrigen arbeiten mit Skalen, Dimensionen oder Scores.
Neue Technik ist seltener, als die Debatte vermuten lässt. Sechs Tools passen ihre Fragen adaptiv an die bisherigen Antworten an, etwa Verify G+ von SHL und ADEPT-15 von Aon. Ebenfalls sechs Tools, rund fünf Prozent, werten mit künstlicher Intelligenz aus, darunter ChatAssess von Aon und mehrere Verfahren von Zortify. Alle vier spielbasierten Tools stammen von Aivy.
Was ein Verfahren kostet, in Zeit und in Geld
Die mittlere Durchführungsdauer liegt bei 22,5 Minuten. 14 Tools sind in höchstens zehn Minuten erledigt, sechs dauern eine Stunde oder länger.
Auch die Sprachen gehen weit auseinander. 25 Tools liegen in 40 oder mehr Sprachen vor, alle fünf Tools mit über 50 Sprachen stammen von Thomas International. Sechs Tools gibt es ausschließlich auf Deutsch, vier von alpha-test und zwei von Hogrefe.
Beim Preis lohnt der zweite Blick. Für 72 Tools liegen konkrete Preise vor. Der Testpreis allein greift zu kurz, denn Feedbackgespräche kosten zwischen 50 und 360 Euro pro Stunde. Bei manchen Tools kostet eine Stunde Feedback mehr als der Test selbst. Auch die Mengenrabatte sind erheblich, bei großen Stückzahlen sinkt der Preis pro Test um 45 bis 82 Prozent.
Hinzu kommen Fixkosten. 32 Tools dürfen nur mit Zertifizierung eingesetzt werden. Die Kosten reichen von 600 Euro bei Ixly bis 4.900 Euro für Profile XT von Profiles International, dort inklusive 15 Lizenzen. Eine Zertifizierung für 2.400 Euro bedeutet bei zehn Kandidaten 240 Euro zusätzlich pro Person, bei 100 Kandidaten 24 Euro. Und sie gilt jeweils nur für den Anbieter, bei dem sie erworben wurde.
Was fast alle gemeinsam haben
Bei aller Vielfalt teilen die Tools ein Grundmuster. 84 von 119 sind Fragebögen zur Selbsteinschätzung. Die große Mehrheit vergleicht mit einer Norm und liefert als Ergebnis ein Profil, unter den Tools mit Angabe zum Output sind es 79 Prozent. Und fast alle laufen digital über ein Portal oder eine Plattform. Das einzige nicht automatisierte Verfahren ist SmartAssessment von ghSmart, ein mehrstündiges biografisches Interview.
Auch die Datenbasis hinter den Verfahren ist dokumentiert. Für 49 Tools liegt eine Normstichprobe mit Zahl vor, 39 davon umfassen 1.000 Personen oder mehr, der Median liegt bei 3.916. Die größten belegten Stichproben haben ADEPT-15 von Aon mit 254.307 Personen und HPI, HDS und MVPI von Hogan mit 159.440. Reliabilitätskennwerte sind für 46 Tools dokumentiert, Validitätsstudien für 29.
Der Markt selbst ist kleinteilig. 21 der 43 Anbieter haben genau ein Tool, die fünf größten Portfolios von Human Edge, Aon, Aivy, Hogan und Ixly stellen zusammen 38 Tools. Die ältesten Anbieter sind Gallup (1935), Talogy (1946) und Hogrefe (1949), die jüngsten Aivy und Zortify, beide 2018 gegründet.
Sieben Befunde, die überraschenZwei Minuten oder zwei Stunden. Die Spiele von Aivy dauern zwei bis drei Minuten, KF4D von Korn Ferry bis zu zwei Stunden.
3,50 Euro oder 5.900 Euro kostet eine Durchführung, je nach Tool und Umfang.
Typen sind die Ausnahme. Nur 2 von 119 Tools arbeiten mit Typen.
KI ist noch selten. Sechs Tools werten mit künstlicher Intelligenz aus.
Ein Tool ohne Vergleichsgruppe. Nur CAPTain wertet rein am Anforderungsprofil aus, 77 Tools vergleichen mit einer Norm.
Jedes sechste Tool fragt andere. 19 Tools beziehen das Fremdbild ein.
Normstichproben von 115 bis 254.307 Personen reichen von CORE Energy (Human Edge) bis ADEPT-15 (Aon).
Welche Probleme die Tools lösen
Am Anfang steht fast immer ein konkretes Problem. Ein Führungsteam arbeitet gegeneinander. Eine Schlüsselposition muss extern besetzt werden, und niemand kennt die Kandidaten. Nach einer Fusion ist offen, wer welche Rolle übernimmt. Ein Unternehmen weiß nicht, wer für die nächste Führungsebene bereit ist.
Für unsere Auswertung haben wir 29 solcher Entscheidungssituationen in fünf Feldern unterschieden. 14 betreffen Führung, von der Auswahl eines CEO über Krisenführung und Führung in Restrukturierungen bis zu Frühwarnzeichen von Führungsversagen. Sieben betreffen Potenzial, etwa Nachfolgeplanung, Karrierepfade oder die Frage, wer Führung lernen kann. Vier betreffen Teams, von Teamklima bis zu Konflikten und Rollenklarheit. Zwei betreffen Auszubildende und Trainees, zwei weitere das Fluktuationsrisiko und unternehmerisches Denken.
Vor diesen Fragen stehen HR-Verantwortliche, Führungskräfte, Coaches und Berater gleichermaßen. Die Tools sind dabei unterschiedlich breit einsetzbar. 72 der 119 Tools sind mindestens einer dieser Situationen zugeordnet. Einige decken bis zu neun ab, 17 sind auf genau eine spezialisiert.
Erst die Frage, dann das Tool
Aus diesen Zahlen folgt eine einfache Reihenfolge. Zuerst wird definiert, was die Stelle oder die Entwicklung verlangt, dann wird das Verfahren gewählt, das genau das misst. Fünf Fragen helfen dabei. Welche Entscheidung soll das Ergebnis stützen, eine Auswahl oder eine Entwicklung? Welches Merkmal ist dafür relevant, Persönlichkeit, Verhalten, Fähigkeit oder Motivation? Reicht die Selbstauskunft, oder braucht es das Urteil anderer? Soll mit einer Vergleichsgruppe verglichen oder gegen ein Anforderungsprofil gemessen werden? Und was kostet das Verfahren insgesamt, mit Test, Feedback und Zertifizierung, in den Sprachen, die tatsächlich gebraucht werden?
Wer diese Fragen beantwortet hat, findet in einem Markt von 119 Tools das passende.
Datenbasis: PEATS-Datenbank, 119 aktive Tools von 43 Anbietern, Stand 9. Oktober 2026.