Schwierige Gespräche

Das Praxis-Paradox: Kompetenz messen, ohne Training zur Überwachung zu machen

4. Oktober 2026

Wenn berufliches Training Schwächen sichtbar machen soll, was passiert dann, wenn jede Schwäche auch für die Führungskraft sichtbar wird?

Genau diese Spannung entsteht bei einer neuen Generation von KI-Coaching-Systemen.

Die Technologie kann mehr Gespräche analysieren, wiederkehrende Muster erkennen und Feedback skalieren, das früher zu teuer gewesen wäre.

Dieselbe Technologie kann aber auch eine dauerhafte Spur aus Zögern, Fehlern und schwachen Momenten erzeugen.

Dann beginnt ein Entwicklungssystem, sich wie ein Performance-Monitoring-System anzufühlen.

Das ist relevant, weil Menschen anders üben, wenn Fehler erlaubt sind.

Dieselbe Analyse kann Coaching oder Überwachung sein

Ein aktueller Konflikt beim Weiterbildungsunternehmen Multiverse macht das Problem greifbar.

Am 25. September 2026 veröffentlichte Multiverse eine Erklärung zu Compass, seinem KI-gestützten System für die Entwicklung von Trainern. Das Unternehmen beschreibt ein nachvollziehbares Problem: Führungskräfte konnten bisher nur einen kleinen Teil der Sessions beobachten. Dadurch war Feedback schwer zu skalieren. Compass analysiert mehr Sitzungen und soll Entwicklung gezielter machen.

Drei Tage später berichtete The Guardian über Sorgen von Trainern, die die kontinuierliche Beobachtung als belastend beschrieben und sich wegen KI-generierter Bewertungen mit Sichtbarkeit für Führungskräfte unter Druck fühlten. Multiverse betonte, dass das System keine Performance-Management-Entscheidungen treffe und Menschen verantwortlich blieben.

Beides kann gleichzeitig stimmen.

Ein System kann ehrlich als Coaching-Instrument gedacht sein und sich für die beobachtete Person trotzdem wie Überwachung anfühlen.

Deshalb reicht die Frage "Ist ein Mensch in der Schleife?" nicht aus.

Wichtiger ist: Welche Evidenz wird gesammelt, wer kann sie sehen und welche Konsequenzen können daraus entstehen?

Bessere Messung verändert Verhalten

Unser Beitrag darüber, warum ein Trainingsabschluss noch keine Kompetenz beweist, argumentiert, dass beobachtbare Performance nützlicher ist als reine Abschlussquoten.

Daraus folgt sofort ein neues Problem.

Wenn jeder beobachtete Übungsversuch zur Management-Evidenz wird, verändert sich die Übungsumgebung.

Ein Einkäufer weiß, dass jede Simulation bewertet wird und jeder schwache Score für die Führungskraft sichtbar ist.

Welches Szenario wählt er dann?

Den schwierigen Lieferanten mit Versorgungssicherheitsdrohung?

Oder eine Situation, die er bereits beherrscht?

Probiert er eine ungewohnte Reaktion aus?

Oder schützt er lieber seinen Score?

Zeigt er die Schwäche, die er eigentlich trainieren müsste?

Oder verhindert er, dass überhaupt Evidenz über diese Schwäche entsteht?

Das Messsystem kann dann sehr präzise das falsche Verhalten messen: Selbstschutz im Training.

Übung braucht die Erlaubnis, vorübergehend schlecht zu sein

Bewusstes Üben funktioniert, weil Menschen etwas versuchen, das sie noch nicht zuverlässig können.

Fehler sind deshalb kein Ausnahmefall.

Sie sind Teil des Mechanismus.

Ein Einkäufer kann beim ersten Versuch zu früh nachgeben.

Eine Führungskraft kann schwieriges Feedback so weich formulieren, dass die Botschaft unklar wird.

Ein Category Manager kann bei einer Eskalation die Struktur verlieren.

Genau solche Momente zeigen, was als Nächstes trainiert werden sollte.

Wenn jeder davon zu dauerhafter Performance-Evidenz wird, ändert sich der rationale Anreiz.

Die Frage lautet nicht mehr:

"Welche Schwäche muss sichtbar werden, damit ich sie verbessern kann?"

Sondern:

"Welche Schwäche sollte ich besser nicht zeigen, weil sie gegen mich verwendet werden könnte?"

Eine Lernumgebung, die sichtbare Schwäche bestraft, wird irgendwann vor allem Stärken zeigen, die ohnehin schon vorhanden sind.

Führung braucht trotzdem Evidenz

Die Lösung ist nicht, Führungskräfte vollständig auszuschließen.

Eine Einkaufsleitung muss wissen, ob ein Kompetenzprogramm genutzt wird.

Sie muss erkennen können, ob das Team besser wird.

Sie sollte sehen, wenn sich ein gemeinsames Muster zeigt, etwa unbedingte Zugeständnisse, schwache Fragen nach Lieferantenwiderstand oder Strukturverlust bei Eskalationen.

Der entscheidende Unterschied liegt zwischen Evidenz über das System und Evidenz über den einzelnen Versuch.

Eine Führungskraft kann sinnvoll sehen:

  • wie viel das Team übt,
  • welche Drucksituationen teamweit Probleme bereiten,
  • ob wiederholte Praxis frühe Zugeständnisse reduziert,
  • welche Bereiche vor wichtigen Verhandlungen kaum üben.

Dafür braucht es keinen permanenten Feed darüber, wer in Minute sechs ins Stocken geraten ist.

Die Führungsfrage lautet: Entwickelt sich die Fähigkeit?

Die Lernendenfrage lautet: Wo genau muss ich mein Verhalten ändern?

Diese beiden Ansichten müssen nicht identisch sein.

Aggregierte Sicht kann nützlicher sein als Individualüberwachung

Mehr Detail ist für Führung nicht automatisch besser.

Ein einzelner schwacher Übungsversuch kann ein unbekanntes Szenario, einen schlechten Tag oder bewusstes Experimentieren widerspiegeln.

Teamweite Muster sind oft entscheidungsrelevanter.

Wenn zehn Einkäufer nach einer Versorgungssicherheitsdrohung regelmäßig nachgeben, ist das ein Signal für Kompetenzdesign.

Wenn eine Person das einmal tut, sagt das wenig.

Deshalb ist Entwicklung über Zeit wichtiger als Ranking.

Nicht die Frage "Wer hatte diese Woche den höchsten Score?" zählt, sondern ob eine wiederkehrende Schwäche nach gezielter Praxis stabiler wird.

Trainingsdaten brauchen einen erklärten Zweck

Eine einfache Governance-Regel lautet:

Nicht zuerst Daten sammeln und später entscheiden, wofür sie verwendet werden.

Vor Beginn sollte klar sein:

Ist die Analyse für privates Feedback?

Kann die Führungskraft das vollständige Transkript sehen?

Dürfen individuelle Scores in formales Performance Management einfließen?

Wie lange bleiben Daten gespeichert?

Kann jemand üben, ohne einen dauerhaften Datensatz zu erzeugen?

Lassen sich aggregierte Teammuster von individueller Analyse trennen?

Diese Fragen beeinflussen nicht nur Datenschutz und Compliance.

Sie beeinflussen das Verhalten im Training.

Lernende müssen wissen, ob das System Coach, Assessor oder beides ist.

Entwicklung und formale Bewertung können getrennt werden

Formale Bewertung kann legitim sein.

Ein Unternehmen kann nachweisen müssen, dass jemand eine sicherheitskritische Aufgabe beherrscht oder eine rollenbezogene Fähigkeit erfüllt.

Das ist aber etwas anderes als tägliche Übung.

Ein Entwicklungsmodus kann auf privates Feedback, Wiederholung und Experimentieren setzen.

Ein formaler Assessment-Modus kann Kriterien, Sichtbarkeit, Konsequenzen und Evidenzanforderungen ausdrücklich machen.

Wenn beides vermischt wird, leidet beides.

Fühlt sich Übung wie Bewertung an, experimentieren Menschen weniger.

Fühlt sich Bewertung wie lockere Übung an, ist die Evidenz womöglich nicht robust genug.

Was das für Verhandlungskompetenz bedeutet

Verhandlungstraining ist besonders sensibel, weil genau die wertvollsten Schwächen oft die sind, die Mitarbeitende ungern gegenüber Führung zeigen.

Nach einer aggressiven Drohung einfrieren.

Ohne Gegenleistung nachgeben.

Zu viel reden, weil Stille unangenehm wird.

Eine autoritär auftretende Gegenseite nicht hinterfragen.

Nach einem unerwarteten Einwand den Plan verlieren.

Genau diese Verhaltensweisen soll eine realistische Simulation sichtbar machen.

Und genau diese Verhaltensweisen werden verborgen, wenn Training zur Reputationspflege wird.

Voice2Evolve trennt deshalb die Zwecke bewusst. Detaillierte individuelle Analyse ist primär für die lernende Person. Führung erhält Nutzung und übergeordnete Entwicklungsmuster, ohne einen permanenten Feed aller individuellen Fehler zu benötigen.

Das ist nicht nur eine Datenschutzentscheidung.

Es ist eine Entscheidung über Lernarchitektur.

Wer Verhalten unter Druck verbessern will, braucht einen Ort, an dem schwaches Verhalten sichtbar werden darf, bevor es teuer wird.

Quellen

Warum Training zu kurz greiftWarum klassisches Verhandlungstraining zu kurz greift

Den Moment trainieren, nicht die Theorie.

Voice2Evolve versetzt Sie immer wieder in die Situation, bis Ihre Reaktion unter Druck keine Panik mehr ist.