Modelli AI
Quale modello LLM scegliere
Confronto fra i 15 modelli AI disponibili: capacità, finestra di contesto, crediti per messaggio e casi d'uso ideali.
Il modello LLM è il “cervello” del tuo agente: decide come capire le domande, come usare la knowledge base e che tono usare nelle risposte. IperChat ti dà accesso a 15 modelli da OpenAI e Anthropic — alcuni sono velocissimi e leggeri, altri ragionano in profondità su problemi complessi. Questa pagina ti aiuta a scegliere il modello giusto in base al tuo caso d’uso.
Imposti il modello dal pannello operativo, sezione “Configurazioni Agenti” (menu laterale → gruppo Agents). Apri la riga del tuo origin e vai in “Comportamento” → “Modello”. Puoi cambiarlo in qualunque momento: il nuovo modello è attivo entro 60 secondi sulle nuove conversazioni.
Tabella comparativa
| Modello | Provider | Contesto | Crediti / msg | Best for |
|---|---|---|---|---|
| GPT-5.5 | OpenAI | 128k | 7 | Ragionamento massimo, casi specialistici |
| Claude Opus 5 | Anthropic | 200k | 5 | Il più capace in assoluto, documenti lunghi, conversazioni complesse multi-step |
| Claude Opus 4.8 | Anthropic | 200k | 5 | Generazione Opus precedente, stesso prezzo di Opus 5 |
| Claude Opus 4.7 | Anthropic | 200k | 5 | Documenti lunghi, ragionamento esteso |
| Claude Opus 4.6 | Anthropic | 200k | 5 | Alternativa Opus, leggermente meno recente |
| GPT-5.6 Sol | OpenAI | 128k | 5 | Flagship OpenAI, ragionamento profondo a costo inferiore a GPT-5.5 |
| GPT-5.4 | OpenAI | 128k | 3 | Conversazioni complesse, alta accuratezza |
| Claude Sonnet 4.6 | Anthropic | 200k | 3 | Knowledge base grandi, lead qualification |
| GPT-5.6 Terra | OpenAI | 128k | 2 | Miglior equilibrio qualità / costo, alto volume con reasoning |
| Claude Sonnet 5 | Anthropic | 200k | 2 | Qualità quasi Opus a prezzo Sonnet, knowledge base grandi |
| GPT-5.2 | OpenAI | 128k | 2 | Conversazioni standard con reasoning |
| GPT-5.6 Luna | OpenAI | 128k | 1 | Modello di reasoning OpenAI più economico e veloce, volume massimo |
| GPT-4.1 Mini | OpenAI | 128k | 1 | Generalista economico |
| GPT-4o | OpenAI | 128k | 1 | Modello collaudato, multilingua |
| GPT-4o Mini | OpenAI | 128k | 1 | Volume massimo, costo minimo |
Tier 1 — Massima capacità (5–7 crediti)
I modelli premium. Da usare quando l’accuratezza vale più del costo per messaggio: settori regolamentati, consulenze specialistiche, casi in cui un errore costa caro.
GPT-5.5
Il modello più potente di OpenAI nel catalogo. Reasoning effort configurabile per problemi che richiedono più passaggi di pensiero.
Best for:
- Consulenze legali, sanitarie, finanziarie
- Ragionamento multi-step su procedure complesse
- Riassunti analitici di documenti tecnici
- Settori in cui un’allucinazione costa molto
Claude Opus 5
Il modello più capace di Anthropic e il più potente dell’intero catalogo. Adaptive thinking con reasoning effort configurabile: ragiona a lungo solo quando la domanda lo richiede. Nessun parametro temperature. Finestra di contesto da 200k token.
Best for:
- I casi più difficili: domande ambigue, conversazioni con molti vincoli
- Documenti molto lunghi e knowledge base distribuite su decine di file
- Conversazioni complesse multi-step dove serve tenere traccia di tutto ciò che è stato detto
- Settori regolamentati dove la qualità della risposta non è negoziabile
Claude Opus 4.8
La generazione Opus precedente, allo stesso prezzo di Opus 5 (5 crediti). Adaptive thinking con reasoning effort configurabile, nessun parametro temperature, 200k di contesto. Da scegliere se hai già ottimizzato i prompt su 4.8 e vuoi un comportamento stabile mentre valuti Opus 5.
Best for:
- Configurazioni già rodate su 4.8
- Test di confronto con Opus 5 a parità di costo
Claude Opus 4.7
Il flagship Anthropic con extended thinking adattivo: quando la domanda è semplice risponde subito, quando è complessa si prende il tempo di “pensare” prima di rispondere. Finestra di contesto 200k token, ideale per knowledge base molto grandi.
Best for:
- Domande che spaziano su molti documenti contemporaneamente
- Analisi di contratti, perizie, report lunghi
- Conversazioni dove serve memoria del contesto a lungo termine
- Tono naturale e ragionato
Claude Opus 4.6
Versione precedente di Opus, mantenuta per chi ha già configurazioni e prompt ottimizzati su questa generazione. Stesse caratteristiche di Opus 4.7 (200k contesto, extended thinking, 5 crediti) con risposte leggermente meno raffinate.
Best for:
- Configurazioni già rodate su 4.6 (per stabilità)
- Test di confronto fra generazioni Opus
GPT-5.6 Sol
Il flagship della famiglia GPT-5.6 di OpenAI (rilasciata a luglio 2026, conoscenza aggiornata a febbraio 2026). Modello di reasoning con reasoning effort configurabile e nessun parametro temperature. Ragionamento profondo a 5 crediti, meno di GPT-5.5.
Best for:
- Ragionamento profondo su OpenAI quando il costo di GPT-5.5 è difficile da giustificare
- Procedure complesse e contenuti tecnici che beneficiano di una conoscenza recente
- Agenti specialistici che richiedono profondità analitica a un prezzo inferiore a GPT-5.5
Tier 2 — Bilanciati (2–3 crediti)
Il sweet spot per la maggior parte degli agenti in produzione. Buona qualità di risposta, costi sostenibili anche con volumi medio-alti.
GPT-5.4
Modello recente di OpenAI con reasoning effort. Buon compromesso fra qualità e prezzo, ottimo per conversazioni in cui serve precisione ma non il massimo livello di analisi.
Best for:
- Conversazioni complesse a costo contenuto
- Domande che richiedono riferimenti puntuali alla KB
- Agenti tecnici (IT, ingegneria, software)
Claude Sonnet 4.6
Sonnet è il “cavallo da lavoro” di Anthropic: 200k token di contesto, extended thinking quando serve, costo moderato. È la scelta di default per agenti che lavorano su knowledge base estese.
Best for:
- Knowledge base grandi (100+ documenti)
- Lead qualification con criteri articolati
- Agenti multilingua con tono curato
- Booking e gestione di flussi conversazionali
GPT-5.6 Terra
Il modello intermedio della famiglia GPT-5.6: modello di reasoning con reasoning effort configurabile, nessun parametro temperature, conoscenza aggiornata a febbraio 2026. A 2 crediti è il miglior equilibrio fra qualità e costo del catalogo: la scelta di default che consigliamo per la maggior parte degli agenti in produzione.
Best for:
- Scelta di default per i nuovi agenti
- Volumi alti che richiedono comunque reasoning
- Lead qualification, booking, supporto con procedure strutturate
Claude Sonnet 5
Il nuovo Sonnet di Anthropic: qualità vicina a Opus al prezzo di Sonnet. Adaptive thinking con reasoning effort configurabile, nessun parametro temperature, 200k di contesto. A 2 crediti costa meno di Sonnet 4.6 e risponde meglio: l’upgrade naturale per le knowledge base estese.
Best for:
- Knowledge base grandi (100+ documenti) con budget contenuto
- Agenti multilingua con tono curato
- Tutto ciò che faresti girare su Sonnet 4.6, a costo inferiore
GPT-5.2
Reasoning effort attivo a 2 crediti per messaggio. Più economico di 5.4 mantenendo capacità di ragionamento.
Best for:
- Conversazioni standard con un minimo di reasoning
- Volume medio con budget contenuto
Tier 3 — Veloci ed economici (1 credito)
Per chi gestisce volumi alti: customer support standard, FAQ ripetitive, deflection di traffico. Risposte rapide a basso costo.
GPT-5.6 Luna
La variante più piccola di GPT-5.6: il modello di reasoning OpenAI più economico e veloce. Reasoning effort configurabile, nessun parametro temperature, conoscenza aggiornata a febbraio 2026. La migliore opzione da 1 credito se vuoi reasoning al massimo volume.
Best for:
- Customer support su FAQ comuni
- Deflection di richieste ripetitive con traffico alto
- Volume massimo con budget controllato, senza rinunciare al reasoning
GPT-4.1 Mini
Generalista classico di OpenAI. Niente reasoning, ma supporta i parametri temperature e top_p se vuoi controllare la creatività delle risposte.
Best for:
- Configurazioni che richiedono temperature personalizzata
- Agenti con tono molto specifico (creativo o rigoroso)
GPT-4o
Modello multimodale collaudato di OpenAI. Eccellente supporto multilingua, qualità di scrittura naturale.
Best for:
- Agenti multilingua con utenti internazionali
- Casi in cui ti fidi di un modello “stabile” da mesi
- Configurazioni esistenti che già funzionano bene
GPT-4o Mini
La versione mini di 4o: il modello più economico nel pool OpenAI. Massimo volume al costo minimo.
Best for:
- Demo, prototipi, ambienti di test
- Traffico altissimo dove il budget conta più della perfezione
- Agenti di prima linea che fanno solo triage
Come scegliere
Una guida rapida per restringere la scelta in base al tuo caso d’uso:
- Customer support, FAQ rapide, traffico alto → Tier 3: GPT-5.6 Luna.
- Lead qualification, booking, conversazioni di media complessità → Tier 2: GPT-5.6 Terra o Claude Sonnet 5 (la scelta bilanciata di default).
- Settori regolamentati o consulenze specialistiche (legale, sanitario, finanziario) → Tier 1: Claude Opus 5 per i casi più difficili, oppure GPT-5.6 Sol / GPT-5.5 su OpenAI.
- Knowledge base molto grande (100+ documenti, contratti lunghi) → famiglia Claude (200k contesto): Sonnet 5 o Opus 5.
- Agente in inglese su contenuti tecnici → GPT-5.6 Terra o GPT-5.4.
- Demo, MVP, traffico di test → GPT-4o Mini o GPT-5.6 Luna.