Dizionario AI › Fondamenti AI

Inference

L'inference (inferenza) è il processo attraverso cui un modello di intelligenza artificiale già addestrato genera una risposta a partire da un input. A differenza del training (la fase in cui il modello impara dai dati), l'inference è la fase operativa: il modello riceve un prompt e produce un output applicando i pattern appresi durante l'addestramento.

Definizione

Ogni volta che scrivi un messaggio a ChatGPT, Gemini o qualsiasi altro LLM e ricevi una risposta, stai usando l'inference. Dal punto di vista computazionale, l'inference richiede molta meno potenza di calcolo rispetto al training, ma a scala (miliardi di richieste al giorno) richiede comunque infrastrutture enormi e costose.

Comprende come funziona l'inference aiuta a capire perché i modelli AI possono risultare più lenti in certi momenti (alta domanda), perché la qualità della risposta può variare (campionamento stocastico e temperatura) e perché il prompt è così determinante: durante l'inference, il modello ha solo il testo del prompt come guida per generare la risposta.

Termini correlati

Altri termini in Fondamenti AI

Mettilo alla prova

Dalla nostra rete

INDACO TMS: Transport Management for European Logistics

Shipment tracking, multi-carrier EDI and automated invoicing in one cloud platform. Invoices generated in under 10 seconds.

Vai su indacotms.com →

Dal blog di Agora Intelligence

Altro su agora-intelligence.com →

📱 Scarica l'app Android (beta) iOS in arrivo

Dì quello che intendi. Ottieni quello che ti serve.

Grace Certified, la coach AI che allena e certifica il tuo prompt engineering, di Agora Intelligence.