Dizionario AI › Prompting
Output Filtering
Il filtraggio dell'output è il controllo applicato al testo, all'immagine o al codice generati da un modello AI prima che vengano restituiti all'utente, allo scopo di individuare e bloccare o correggere contenuti problematici che il modello ha prodotto nonostante le istruzioni di sicurezza. È un livello di difesa complementare ai filtri applicati in ingresso: mentre questi ultimi cercano di impedire richieste pericolose, il filtraggio dell'output intercetta ciò che il modello ha effettivamente generato, indipendentemente dal motivo per cui lo ha fatto.
In pratica il testo generato viene analizzato da uno o più classificatori secondari, oppure confrontato con liste di pattern noti, prima di essere consegnato. Se viene rilevato un problema il sistema può bloccare completamente la risposta, sostituirla con un messaggio generico, oppure richiedere al modello stesso di rigenerarla applicando vincoli più stretti.
È particolarmente rilevante per gli use case in cui il modello genera contenuto non supervisionato in tempo reale, come chatbot pubblici o generatori di immagini: un filtro sull'output riduce il rischio che una singola risposta imprevista diventi virale sui social o esponga l'azienda a un danno reputazionale. È anche lo strumento con cui si applicano regole specifiche di un settore, ad esempio impedendo che un assistente finanziario fornisca consigli di investimento non autorizzati.
Il termine si è affermato con la diffusione su larga scala dei chatbot pubblici a partire dal 2022-2023, quando le aziende hanno dovuto affrontare concretamente il rischio che un modello generasse contenuti imbarazzanti o dannosi in produzione.
Dalla nostra rete
AGORÀ Intelligence: Enterprise AI Governance Platform
Govern AI at scale: policies, adoption and measurable results on your data. Built for boards and C-suite.
Vai su agora-intelligence.com →Dal blog di Agora Intelligence
📱 Scarica l'app Android (beta) iOS in arrivo
Dì quello che intendi. Ottieni quello che ti serve.
Grace Certified, la coach AI che allena e certifica il tuo prompt engineering, di Agora Intelligence.