Unerklärliche und nicht nachvollziehbare Handlungen sind ein Risiko für KI
Beschreibung
Erklärungen, Abstammungs- und Rückverfolgungsinformationen sowie die Zuweisung von Quellen für die Handlungen von KI-Agenten können schwierig, ungenau oder nicht erhältlich sein.
Warum sind unerklärliche und nicht nachvollziehbare Handlungen ein Problem für Stiftungsmodelle?
Ohne klare Erklärungen, Informationen über die Herkunft der Daten und die Zuordnung der Aktionen von KI-Agenten ist es für Benutzer, Modellvalidierer und Auditoren schwierig, das Modell zu verstehen und ihm zu vertrauen. Falsche Erklärungen können zu übermäßigem Vertrauen führen.
Übergeordnetes Thema: AI-Risikoatlas
Anhand von Beispielen, über die in der Presse berichtet wurde, erläutern wir viele der Risiken der Stiftungsmodelle. Viele dieser Ereignisse, über die in der Presse berichtet wurde, sind entweder noch im Gange oder wurden bereits aufgeklärt, und ein Verweis darauf kann dem Leser helfen, die potenziellen Risiken zu verstehen und auf Abhilfemaßnahmen hinzuarbeiten. Die Hervorhebung dieser Beispiele dient lediglich der Veranschaulichung.