16 luglio 2026 - Corso AI - Capitolo 3

Glossario minimo e confronto fra LLM

I termini fondamentali dell'AI spiegati con chiarezza, più un confronto aggiornato fra i principali LLM di frontiera.

I termini da conoscere

Facciamo chiarezza su alcuni termini spesso usati come sinonimi a sproposito. Troverai questi termini e molti altri nel Glossario, con definizioni più complete. Li riproponiamo qui perché averli chiari fin da subito è molto importante.

AI (Artificial Intelligence): branca dell’informatica dei sistemi che simulano capacità cognitive (lo so, è imprecisa e riduttiva, non me ne vogliate).

LLM (Large Language Model): grandi modelli linguistici, pre-addestrati (pre-trained) su enormi quantità di testo, capaci di generare, completare, trasformare e analizzare linguaggio.

GPT (Generative Pre-trained Transformer): la parola ha due usi. In senso stretto indica i modelli di OpenAI (GPT-3, GPT-4 e successivi). In senso largo è diventata quasi sinonimo di “LLM”, perché è il tipo di modello di gran lunga più diffuso, quello basato sull’architettura transformer.

ChatGPT: l’interfaccia dell’LLM creato da OpenAI (impresa americana), è stato il primo a stupire il grande pubblico a fine 2022 (vedi Timeline AI). Spesso ChatGPT e GPT finiscono per essere sinonimi. Se sei confuso su quest’ultima parte hai ragione, è confusa ma è così.

Token: l’unità minima di testo che un LLM elabora. Non corrisponde a una parola: può essere una parola intera, un pezzo di parola, uno spazio o un segno di punteggiatura. In media, un token è circa 3/4 di una parola. Conta perché i token determinano quanto puoi scrivere in una chat e quanto paghi.

Prompt: il testo che scrivi all’LLM, la tua richiesta. Può essere una domanda secca o un’istruzione lunga e dettagliata. La qualità del prompt influenza direttamente la qualità della risposta.

Chat: una singola conversazione con l’LLM, ha un inizio e una fine. Ogni chat ha una sua memoria temporanea: il modello ricorda ciò che avete scritto dall’inizio della chat, ma non le chat precedenti (salvo memorie specifiche).

Modello: il “cervello” addestrato che genera le risposte. Non va confuso con l’interfaccia: ChatGPT è l’interfaccia, GPT-5.6 Sol è il modello che ci gira dentro.

Interfaccia: il sito o l’app con cui parli al modello. ChatGPT, Claude, Gemini, Le Chat sono interfacce; i modelli sottostanti sono un’altra cosa e spesso puoi scegliere quale usare.

Allucinazione: quando l’LLM genera informazioni false ma le presenta con sicurezza, come se fossero vere. Succede perché il modello prevede testo plausibile, non verifica i fatti.

Contesto (context window): la quantità massima di testo che un LLM può considerare in una singola conversazione. Più è grande, più informazione il modello tiene in considerazione, ma non è infinita.

Deep Research: una modalità in cui l’LLM fa autonomamente decine di ricerche sul web, le analizza e produce un rapporto lungo e documentato. Più lenta e costosa di una risposta normale, ma molto più approfondita.

Crediti: il budget di utilizzo incluso nell’abbonamento. Si consumano con ogni messaggio, più rapidamente quando si usano modelli potenti o modalità avanzate come Deep Research.

Abbonamento: il piano a pagamento (di solito mensile) che dà accesso ai modelli più potenti e a più crediti. I piani gratuiti esistono ma hanno limiti significativi.

Sycophancy: la tendenza del modello a darci ragione, a elogiarci e a non contraddirci, anche quando dovrebbe. Termine inglese simile a “compiacenza” ma più specifico.

Epistemia: l’illusione di possedere conoscenza autentica perché l’AI fornisce risposte eloquenti e convincenti. Confondere la forma con il contenuto.

Pesi aperti (open weights): quando un modello è scaricabile e puoi farlo girare sul tuo computer (con hardware adeguato), senza dipendere dal provider.

Modello di frontiera (frontier model): i modelli più avanzati e potenti disponibili in un dato momento. Il termine cambia di significato ogni pochi mesi perché il progresso è rapidissimo.


I modelli a confronto

Modelli di frontiera

MODELLOPROVIDERVERSIONI ATTUALI, luglio ‘26CARATTERISTICHE
ClaudeAnthropicFable 5, Opus 4.8, Sonnet 5, Haiku 4.5+ Claude Code: potente framework per coding agentico + Cowork: per task autonomi su file locali; scrittura lunga di qualità + Si può scegliere il “livello di impegno” che ottimizza la scelta prestazioni/costi - Nessun generatore di immagini nativo - Voce limitata (dettatura, non conversazione avanzata) - Costi alti sui modelli di punta
ChatGPTOpenAIGPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna+ ChatGPT Images 2.0: generazione immagini di qualità + GPT-Live: voce conversazionale di qualità + Codex CLI: potente framework per coding agentico + ChatGPT Work: assistente enterprise
GeminiGoogle3.5 Flash, 3.1 Pro, 3.1 Flash, 3.1 Flash-Lite+ Integrazione profonda nell’ecosistema Google (Calendar, Maps, Docs) + Contesto molto lungo (3.1 Pro: 1M token) + Antigravity: agente autonomo per coding e navigazione web + Nano Banana 2: generatore di immagini + Voice mode buono

Altri modelli

MODELLOPROVIDERVERSIONI ATTUALI, luglio ‘26CARATTERISTICHE
GrokSpaceXAIGrok 4.5, Grok 4.3, Grok 4.1 Fast+ Grok Build: coding agent (integrato con Cursor) + Integrazione real-time con X/web (DeepSearch) + Grok Imagine: generazione immagini e video + Prezzi molto competitivi - Non ancora disponibile in UE (Grok 4.5. luglio 2026) - Legato all’ecosistema X/Elon Musk
LlamaMetaLlama 4 Maverick, Llama 4 Scout+ Pesi aperti (te lo scarichi e lo fai girare in locale) + Integrato in WhatsApp/Instagram/Messenger + Contesto enorme (Scout: 10M token)
DeepSeekDeepSeekV4 Pro, V4 Flash+ Pesi aperti (te lo scarichi e lo fai girare in locale, con hardware adeguato) + Molto economico via API + V4 Pro gioca alla pari coi modelli di punta su coding e ragionamento - Provider cinese (dubbi privacy/sicurezza per aziende UE) - V4 ancora in Preview, GA prevista metà luglio
MistralMistral AIMedium 3.5, Large 3, Small 4+ Pesi aperti (Apache 2.0, scaricabile e modificabile) + Europeo, soggetto al GDPR + Vibe (ex Le Chat): agente unificato, economico + Devstral 2: coding agent + Buon ecosistema connettori (Google Workspace, Slack, GitHub, Notion, MCP) - Distante dai modelli di frontiera in potenza bruta