Falsch ausgerichtete Maßnahmen sind ein Risiko für AI

Ausrichtung der Werte
Agentische KI-Risiken
Verstärkt durch agentenbasierte KI

Beschreibung

KI-Agenten können Handlungen vornehmen, die nicht mit den einschlägigen menschlichen Werten, ethischen Erwägungen, Richtlinien und Grundsätzen in Einklang stehen. Falsch ausgerichtete Maßnahmen können auf unterschiedliche Weise erfolgen:

  • Unangemessene Anwendung der erlernten Ziele auf neue oder unvorhergesehene Situationen.
  • Einsatz von KI-Agenten für einen Zweck/eine Zielsetzung, die über ihren eigentlichen Zweck hinausgeht.
  • Voreingenommene Auswahl von Ressourcen oder Werkzeugen
  • Einsatz von Täuschungsmanövern, um das Ziel zu erreichen, indem die Fähigkeit entwickelt wird, auf der Grundlage der in einem bestimmten Kontext erteilten Anweisungen zu intrigieren.
  • Kompromisse bei den Werten des KI-Agenten, um mit einem anderen KI-Agenten oder Tool zusammenzuarbeiten, um die Aufgabe zu erfüllen.
{: .shortdesc}

Warum sind falsch ausgerichtete Aktionen ein Problem für Stiftungsmodelle?

Falsch ausgerichtete Handlungen können sich nachteilig auf Menschen auswirken oder ihnen schaden.

Übergeordnetes Thema: AI-Risikoatlas

Anhand von Beispielen, über die in der Presse berichtet wurde, erläutern wir viele der Risiken der Stiftungsmodelle. Viele dieser Ereignisse, über die in der Presse berichtet wurde, sind entweder noch im Gange oder wurden bereits aufgeklärt, und ein Verweis darauf kann dem Leser helfen, die potenziellen Risiken zu verstehen und auf Abhilfemaßnahmen hinzuarbeiten. Die Hervorhebung dieser Beispiele dient lediglich der Veranschaulichung.