Zum Inhalt
Home · Insights

Wenn die KI den Menschen im Blick haben soll – aber wer behält die KI im Blick?

05.12.2025von TROTZDEMKI
Wenn die KI den Menschen im Blick haben soll – aber wer behält die KI im Blick?

Wenn die KI den Menschen im Blick haben soll – aber wer behält die KI im Blick?

Eine Software entscheidet objektiver als ein Mensch. Sie wird nicht müde, sie hat keine schlechten Tage, und der Name auf der Bewerbung sagt ihr nichts.

Der stärkste Teil dieses Satzes handelt nicht von der Technik, sondern von uns. Menschliche Urteile über Bewerbungen sind unzuverlässig, und das ist keine Unterstellung, sondern die Erfahrung von jedem, der einmal einen Stapel durchgearbeitet hat. Die zwanzigste Unterlage wird anders gelesen als die zweite. Nach der Mittagspause anders als davor. Wer gerade eine sehr gute gesehen hat, liest die nächste strenger. Dazu kommt, was niemand zugeben würde und trotzdem wirkt: das Foto, die Lücke im Lebenslauf, der Wohnort, der Name der Hochschule. Ein Verfahren, das für alle dieselbe Regel anwendet, morgens wie abends, ist dem in einem Punkt tatsächlich überlegen. Es ist gleichmäßig.

Nur ist gleichmäßig nicht dasselbe wie richtig.

Woher die Kriterien kommen

In der verbreiteten Bauart bekommt ein System, das Bewerbungen vorsortiert, keine Definition davon, wer bei euch gut wäre. Es bekommt Beispiele. Die Beispiele sind die Entscheidungen, die ihr vorher getroffen habt: wen ihr eingeladen habt, wen ihr genommen habt, wer geblieben ist. Daraus zieht es das Muster. Was es lernt, ist deshalb ziemlich genau die bisherige Vorliebe eures Hauses, mitsamt allem, was daran systematisch war.

Das ist kein Vorwurf an die Technik. Es ist ihr Zweck. Sie soll wiederholen, und ein System, das etwas anderes täte als das Vergangene fortzuschreiben, wäre nach den Maßstäben seiner Entwickler defekt. Weil es sehr gleichmäßig wiederholt, wiederholt es eben auch das gleichmäßig, was an eurer bisherigen Auswahl nie jemand überprüft hat. Der Unterschied zu vorher ist nicht die Richtung des Fehlers, sondern seine Zuverlässigkeit.

Warum es sich nicht widerlegen lässt

Der naheliegende Einwand lautet: Dann prüft man eben die Ergebnisse. Genau das geht nicht, jedenfalls nicht so, wie es gemeint ist.

Ihr seht immer nur die, die durchgekommen sind. Ob sie sich bewähren, lässt sich beobachten, und es wird auch beobachtet. Die Aussortierten seht ihr nie wieder. Sie tauchen in keiner Auswertung auf, sie liefern keine Leistung, die sich mit einer Vorhersage vergleichen ließe, sie melden sich nicht zurück. Damit fehlt dem Verfahren der einzige Beleg, der es widerlegen könnte. Jede spätere Auswertung bestätigt es, weil sie nur mit denen rechnen kann, die es durchgelassen hat.

Hier wird aus einem technischen Detail ein organisatorisches Problem. Ein Verfahren, das sich aus eigener Kraft nicht irren kann, wird mit jedem Jahr sicherer, ohne besser zu werden. Und je länger es läuft, desto plausibler wird es, weil die Eingestellten ja tatsächlich zum Muster passen. Sie sind danach ausgewählt worden.

Dazu kommt eine zweite Eigenschaft, die im Alltag schwerer wiegt als die erste. Eine Vorauswahl, die niemand begründet, lässt sich auch nicht bestreiten. Über die Einschätzung einer Recruiterin kann die Fachabteilung streiten, notfalls im Flur, und manchmal dreht sich dabei eine Entscheidung. Über Rang 14 streitet niemand. Nicht, weil die Zahl geschützt wäre, sondern weil es keinen Satz gibt, gegen den man etwas sagen könnte.

Und weil dieser Satz fehlt, fehlt am Ende auch der, der ihn verantwortet. Die Personalabteilung verweist auf die Vorauswahl. Die Fachabteilung verweist auf die Liste, die sie bekommen hat. Der Anbieter verweist darauf, dass das System mit euren eigenen Daten arbeitet. Alle drei haben recht. Das ist kein böser Wille, sondern ein Aufbau, in dem das Kriterium niemandem gehört.

Was wir nicht wissen

Ob solche Systeme im Durchschnitt besser oder schlechter auswählen als Menschen, können wir dir nicht sagen. Wir haben dazu keine Zahl, für die wir geradestehen würden. Bei einer Zahl, die dir jemand anderes vorlegt, lohnen zwei Fragen: Wer hat sie erhoben, und an welchen Bewerbungen? Der Einwand in diesem Beitrag kommt ohne Statistik aus. Er lautet: Ihr wisst nicht, wonach sortiert wird, und aus den Ergebnissen könnt ihr es nicht erschließen. Das gilt unabhängig davon, ob die Software gut ist.

Drei Dinge, die sich prüfen lassen

Frag den Anbieter, woran das System gelernt hat. Nicht, welche Kriterien es berücksichtigt, darauf gibt es immer eine Antwort. Sondern: Welche vergangenen Entscheidungen waren die Beispiele, und aus welchem Zeitraum? Kommt statt eines Zeitraums eine Zahl von Merkmalen zurück, hast du deine Antwort trotzdem.

Zieh regelmäßig eine Stichprobe aus den Aussortierten. Einmal im Monat zehn Unterlagen, gelesen von jemandem, der die Rangliste nicht kennt. Nicht, um gerecht zu sein, sondern um an die eine Information zu kommen, die euch systematisch fehlt: ob ihr anders entschieden hättet. Macht ihr das ein halbes Jahr lang, wisst ihr über euer Verfahren mehr, als in jeder Anbieterunterlage steht.

Und schreib einen Namen auf. Eine Person, die für das Kriterium geradesteht, nicht für das Werkzeug. Jemand, der erklären kann, warum die Vorauswahl so aussieht, wie sie aussieht, und der sie ändern darf, wenn sie ihm nicht mehr gefällt. Ohne diesen Namen habt ihr die Auswahl nicht ausgelagert, sondern nur die Zuständigkeit.

Objektiv ist keine Eigenschaft eines Ergebnisses. Es ist eine Eigenschaft des Verfahrens dahinter. Und nachprüfbar ist bei euch nur das, was jemand nachprüft.

Noch Fragen?

Lass uns gemeinsam
Großes schaffen.