Angriff auf externe Ressourcen von KI-Agenten Risiko für KI

Robustheit Symbol für Robustheitsrisiken.
Zuverlässigkeit
Agentische KI-Risiken
Spezifisch für agentenbasierte KI

Beschreibung

Angreifer schaffen absichtlich Schwachstellen oder nutzen bestehende Schwachstellen in externen Ressourcen (Tools/Datenbank/Anwendungen/Dienste/andere Agenten) aus, auf die sich KI-Agenten verlassen, um ihre geplanten Aktionen auszuführen oder ihre Ziele zu erreichen.

Warum sind Angriffe auf externe Ressourcen von KI-Agenten ein Problem für Stiftungsmodelle?

Kompromittierte externe Ressourcen könnten die Leistung des KI-Agenten auf verschiedene Weise beeinträchtigen, z. B. indem sie KI-Agenten so manipulieren, dass sie ein anderes Ziel verfolgen, KI-Agenten dazu bringen, unerwünschte Aktionen auszuführen, Interaktionen zwischen KI-Agenten aufzeichnen und an böswillige Akteure weiterleiten oder KI-Agenten dazu bringen, persönliche oder vertrauliche Informationen weiterzugeben.

Übergeordnetes Thema: AI-Risikoatlas

Anhand von Beispielen, über die in der Presse berichtet wurde, erläutern wir viele der Risiken der Stiftungsmodelle. Viele dieser Ereignisse, über die in der Presse berichtet wurde, sind entweder noch im Gange oder wurden bereits aufgeklärt, und ein Verweis darauf kann dem Leser helfen, die potenziellen Risiken zu verstehen und auf Abhilfemaßnahmen hinzuarbeiten. Die Hervorhebung dieser Beispiele dient lediglich der Veranschaulichung.