Angriff auf externe Ressourcen von KI-Agenten Risiko für KI
Beschreibung
Angreifer schaffen absichtlich Schwachstellen oder nutzen bestehende Schwachstellen in externen Ressourcen (Tools/Datenbank/Anwendungen/Dienste/andere Agenten) aus, auf die sich KI-Agenten verlassen, um ihre geplanten Aktionen auszuführen oder ihre Ziele zu erreichen.
Warum sind Angriffe auf externe Ressourcen von KI-Agenten ein Problem für Stiftungsmodelle?
Kompromittierte externe Ressourcen könnten die Leistung des KI-Agenten auf verschiedene Weise beeinträchtigen, z. B. indem sie KI-Agenten so manipulieren, dass sie ein anderes Ziel verfolgen, KI-Agenten dazu bringen, unerwünschte Aktionen auszuführen, Interaktionen zwischen KI-Agenten aufzeichnen und an böswillige Akteure weiterleiten oder KI-Agenten dazu bringen, persönliche oder vertrauliche Informationen weiterzugeben.
Übergeordnetes Thema: AI-Risikoatlas
Anhand von Beispielen, über die in der Presse berichtet wurde, erläutern wir viele der Risiken der Stiftungsmodelle. Viele dieser Ereignisse, über die in der Presse berichtet wurde, sind entweder noch im Gange oder wurden bereits aufgeklärt, und ein Verweis darauf kann dem Leser helfen, die potenziellen Risiken zu verstehen und auf Abhilfemaßnahmen hinzuarbeiten. Die Hervorhebung dieser Beispiele dient lediglich der Veranschaulichung.