Dizionario AI › Fondamenti AI
L'inference (inferenza) è il processo attraverso cui un modello di intelligenza artificiale già addestrato genera una risposta a partire da un input. A differenza del training (la fase in cui il modello impara dai dati), l'inference è la fase operativa: il modello riceve un prompt e produce un output applicando i pattern appresi durante l'addestramento.
Ogni volta che scrivi un messaggio a ChatGPT, Gemini o qualsiasi altro LLM e ricevi una risposta, stai usando l'inference. Dal punto di vista computazionale, l'inference richiede molta meno potenza di calcolo rispetto al training, ma a scala (miliardi di richieste al giorno) richiede comunque infrastrutture enormi e costose.
Comprende come funziona l'inference aiuta a capire perché i modelli AI possono risultare più lenti in certi momenti (alta domanda), perché la qualità della risposta può variare (campionamento stocastico e temperatura) e perché il prompt è così determinante: durante l'inference, il modello ha solo il testo del prompt come guida per generare la risposta.
Dalla nostra rete
INDACO TMS: Transport Management for European Logistics
Shipment tracking, multi-carrier EDI and automated invoicing in one cloud platform. Invoices generated in under 10 seconds.
Vai su indacotms.com →Dal blog di Agora Intelligence
📱 Scarica l'app Android (beta) iOS in arrivo
Dì quello che intendi. Ottieni quello che ti serve.
Grace Certified, la coach AI che allena e certifica il tuo prompt engineering, di Agora Intelligence.