Techniken und Dokumentation, die die Entscheidungslogik eines KI-Modells verständlich für Stakeholder und Prüfer machen.
Eine Kombination aus inhärenten (interpretierbaren Modellen) und Post-hoc-Methoden (SHAP, LIME, kontrafaktische Analysen), die Merkmalswichtigkeiten, Entscheidungsregeln oder alternative Ergebnisszenarien sichtbar machen. Eine wirksame Governance erfordert die Auswahl von Erklärbarkeitsverfahren, die zum Modell und zur Zielgruppe passen, die Einbettung von Erklärungen in Benutzeroberflächen oder Compliance-Berichte sowie die Validierung, dass die Erklärungen das Modellverhalten präzise widerspiegeln.
Ein Kreditkartenbetrugsmodell liefert zu jeder Warnmeldung SHAP-Erklärungen: „Wichtigste Faktoren: ungewöhnlicher Standort, atypische Transaktionshöhe.“ Betrugsanalysten nutzen diese Erklärungen, um Warnmeldungen effektiver zu priorisieren, und Aufsichtsbehörden prüfen die SHAP-Berichte im Rahmen von Compliance-Inspektionen.




