Dizionario AI › Fondamenti AI
Il red teaming è la pratica di attaccare deliberatamente un sistema di IA per scoprirne le debolezze prima che lo facciano utenti malintenzionati o incidenti reali. Un gruppo di persone, il "red team", assume il ruolo dell'avversario e cerca in ogni modo di far sbagliare il modello: fargli generare contenuti pericolosi, aggirare le sue regole, estrarre informazioni riservate. È come assumere dei ladri professionisti per testare la sicurezza di una banca: meglio scoprire le falle in una simulazione controllata che in una rapina vera. Le tecniche vanno dalle domande subdole ai prompt camuffati fino ad attacchi automatizzati generati da altri modelli.
Il red teaming conta perché nessun sistema è sicuro per progetto: i difetti emergono solo mettendolo sotto pressione con creatività ostile. È un passaggio ormai obbligato prima di rilasciare un modello, e i risultati guidano le successive protezioni e correzioni.
Dalla nostra rete
AGORÀ Intelligence: Enterprise AI Governance Platform
Govern AI at scale: policies, adoption and measurable results on your data. Built for boards and C-suite.
Vai su agora-intelligence.com →Dal blog di Agora Intelligence
📱 Scarica l'app Android (beta) iOS in arrivo
Dì quello che intendi. Ottieni quello che ti serve.
Grace Certified, la coach AI che allena e certifica il tuo prompt engineering, di Agora Intelligence.