Attacco alle risorse esterne degli agenti di IA rischio per l'IA

Robustezza Icona che rappresenta i rischi di robustezza.
Affidabilità
Rischi dell'IA agenziale
Specifico per l'IA agenziale

Descrizione

Gli aggressori creano intenzionalmente vulnerabilità o sfruttano le vulnerabilità esistenti nelle risorse esterne (strumenti/database/applicazioni/servizi/altri agenti) su cui gli agenti di intelligenza artificiale fanno affidamento per eseguire le azioni previste o per raggiungere i loro obiettivi.

Perché l'attacco alle risorse esterne degli agenti ai è un problema per i modelli di fondazione?

Le risorse esterne compromesse potrebbero avere un impatto sulle prestazioni dell'agente di intelligenza artificiale in diversi modi, ad esempio manipolando gli agenti di intelligenza artificiale per perseguire un obiettivo diverso, manipolando gli agenti di intelligenza artificiale per eseguire azioni indesiderate, catturando e trasmettendo le interazioni tra gli agenti di intelligenza artificiale ad attori malintenzionati e inducendo gli agenti di intelligenza artificiale a condividere informazioni personali o riservate.

Argomento principale: Atlante del rischio di IA

Forniamo esempi che la stampa ha riportato per spiegare molti dei rischi dei modelli di fondazione. Molti di questi eventi trattati dalla stampa sono ancora in evoluzione o sono stati risolti, e fare riferimento ad essi può aiutare il lettore a comprendere i rischi potenziali e a lavorare per mitigarli. Questi esempi sono evidenziati solo a scopo illustrativo.