Skip to main content
IperChat
Prova gratis EN
Accedi

Modelli AI

Quale modello LLM scegliere

Confronto fra i 15 modelli AI disponibili: capacità, finestra di contesto, crediti per messaggio e casi d'uso ideali.

Il modello LLM è il “cervello” del tuo agente: decide come capire le domande, come usare la knowledge base e che tono usare nelle risposte. IperChat ti dà accesso a 15 modelli da OpenAI e Anthropic — alcuni sono velocissimi e leggeri, altri ragionano in profondità su problemi complessi. Questa pagina ti aiuta a scegliere il modello giusto in base al tuo caso d’uso.

Imposti il modello dal pannello operativo, sezione “Configurazioni Agenti” (menu laterale → gruppo Agents). Apri la riga del tuo origin e vai in “Comportamento” → “Modello”. Puoi cambiarlo in qualunque momento: il nuovo modello è attivo entro 60 secondi sulle nuove conversazioni.

Tabella comparativa

ModelloProviderContestoCrediti / msgBest for
GPT-5.5OpenAI128k7Ragionamento massimo, casi specialistici
Claude Opus 5Anthropic200k5Il più capace in assoluto, documenti lunghi, conversazioni complesse multi-step
Claude Opus 4.8Anthropic200k5Generazione Opus precedente, stesso prezzo di Opus 5
Claude Opus 4.7Anthropic200k5Documenti lunghi, ragionamento esteso
Claude Opus 4.6Anthropic200k5Alternativa Opus, leggermente meno recente
GPT-5.6 SolOpenAI128k5Flagship OpenAI, ragionamento profondo a costo inferiore a GPT-5.5
GPT-5.4OpenAI128k3Conversazioni complesse, alta accuratezza
Claude Sonnet 4.6Anthropic200k3Knowledge base grandi, lead qualification
GPT-5.6 TerraOpenAI128k2Miglior equilibrio qualità / costo, alto volume con reasoning
Claude Sonnet 5Anthropic200k2Qualità quasi Opus a prezzo Sonnet, knowledge base grandi
GPT-5.2OpenAI128k2Conversazioni standard con reasoning
GPT-5.6 LunaOpenAI128k1Modello di reasoning OpenAI più economico e veloce, volume massimo
GPT-4.1 MiniOpenAI128k1Generalista economico
GPT-4oOpenAI128k1Modello collaudato, multilingua
GPT-4o MiniOpenAI128k1Volume massimo, costo minimo

Tier 1 — Massima capacità (5–7 crediti)

I modelli premium. Da usare quando l’accuratezza vale più del costo per messaggio: settori regolamentati, consulenze specialistiche, casi in cui un errore costa caro.

GPT-5.5

Il modello più potente di OpenAI nel catalogo. Reasoning effort configurabile per problemi che richiedono più passaggi di pensiero.

Best for:

  • Consulenze legali, sanitarie, finanziarie
  • Ragionamento multi-step su procedure complesse
  • Riassunti analitici di documenti tecnici
  • Settori in cui un’allucinazione costa molto

Claude Opus 5

Il modello più capace di Anthropic e il più potente dell’intero catalogo. Adaptive thinking con reasoning effort configurabile: ragiona a lungo solo quando la domanda lo richiede. Nessun parametro temperature. Finestra di contesto da 200k token.

Best for:

  • I casi più difficili: domande ambigue, conversazioni con molti vincoli
  • Documenti molto lunghi e knowledge base distribuite su decine di file
  • Conversazioni complesse multi-step dove serve tenere traccia di tutto ciò che è stato detto
  • Settori regolamentati dove la qualità della risposta non è negoziabile

Claude Opus 4.8

La generazione Opus precedente, allo stesso prezzo di Opus 5 (5 crediti). Adaptive thinking con reasoning effort configurabile, nessun parametro temperature, 200k di contesto. Da scegliere se hai già ottimizzato i prompt su 4.8 e vuoi un comportamento stabile mentre valuti Opus 5.

Best for:

  • Configurazioni già rodate su 4.8
  • Test di confronto con Opus 5 a parità di costo

Claude Opus 4.7

Il flagship Anthropic con extended thinking adattivo: quando la domanda è semplice risponde subito, quando è complessa si prende il tempo di “pensare” prima di rispondere. Finestra di contesto 200k token, ideale per knowledge base molto grandi.

Best for:

  • Domande che spaziano su molti documenti contemporaneamente
  • Analisi di contratti, perizie, report lunghi
  • Conversazioni dove serve memoria del contesto a lungo termine
  • Tono naturale e ragionato

Claude Opus 4.6

Versione precedente di Opus, mantenuta per chi ha già configurazioni e prompt ottimizzati su questa generazione. Stesse caratteristiche di Opus 4.7 (200k contesto, extended thinking, 5 crediti) con risposte leggermente meno raffinate.

Best for:

  • Configurazioni già rodate su 4.6 (per stabilità)
  • Test di confronto fra generazioni Opus

GPT-5.6 Sol

Il flagship della famiglia GPT-5.6 di OpenAI (rilasciata a luglio 2026, conoscenza aggiornata a febbraio 2026). Modello di reasoning con reasoning effort configurabile e nessun parametro temperature. Ragionamento profondo a 5 crediti, meno di GPT-5.5.

Best for:

  • Ragionamento profondo su OpenAI quando il costo di GPT-5.5 è difficile da giustificare
  • Procedure complesse e contenuti tecnici che beneficiano di una conoscenza recente
  • Agenti specialistici che richiedono profondità analitica a un prezzo inferiore a GPT-5.5

Tier 2 — Bilanciati (2–3 crediti)

Il sweet spot per la maggior parte degli agenti in produzione. Buona qualità di risposta, costi sostenibili anche con volumi medio-alti.

GPT-5.4

Modello recente di OpenAI con reasoning effort. Buon compromesso fra qualità e prezzo, ottimo per conversazioni in cui serve precisione ma non il massimo livello di analisi.

Best for:

  • Conversazioni complesse a costo contenuto
  • Domande che richiedono riferimenti puntuali alla KB
  • Agenti tecnici (IT, ingegneria, software)

Claude Sonnet 4.6

Sonnet è il “cavallo da lavoro” di Anthropic: 200k token di contesto, extended thinking quando serve, costo moderato. È la scelta di default per agenti che lavorano su knowledge base estese.

Best for:

  • Knowledge base grandi (100+ documenti)
  • Lead qualification con criteri articolati
  • Agenti multilingua con tono curato
  • Booking e gestione di flussi conversazionali

GPT-5.6 Terra

Il modello intermedio della famiglia GPT-5.6: modello di reasoning con reasoning effort configurabile, nessun parametro temperature, conoscenza aggiornata a febbraio 2026. A 2 crediti è il miglior equilibrio fra qualità e costo del catalogo: la scelta di default che consigliamo per la maggior parte degli agenti in produzione.

Best for:

  • Scelta di default per i nuovi agenti
  • Volumi alti che richiedono comunque reasoning
  • Lead qualification, booking, supporto con procedure strutturate

Claude Sonnet 5

Il nuovo Sonnet di Anthropic: qualità vicina a Opus al prezzo di Sonnet. Adaptive thinking con reasoning effort configurabile, nessun parametro temperature, 200k di contesto. A 2 crediti costa meno di Sonnet 4.6 e risponde meglio: l’upgrade naturale per le knowledge base estese.

Best for:

  • Knowledge base grandi (100+ documenti) con budget contenuto
  • Agenti multilingua con tono curato
  • Tutto ciò che faresti girare su Sonnet 4.6, a costo inferiore

GPT-5.2

Reasoning effort attivo a 2 crediti per messaggio. Più economico di 5.4 mantenendo capacità di ragionamento.

Best for:

  • Conversazioni standard con un minimo di reasoning
  • Volume medio con budget contenuto

Tier 3 — Veloci ed economici (1 credito)

Per chi gestisce volumi alti: customer support standard, FAQ ripetitive, deflection di traffico. Risposte rapide a basso costo.

GPT-5.6 Luna

La variante più piccola di GPT-5.6: il modello di reasoning OpenAI più economico e veloce. Reasoning effort configurabile, nessun parametro temperature, conoscenza aggiornata a febbraio 2026. La migliore opzione da 1 credito se vuoi reasoning al massimo volume.

Best for:

  • Customer support su FAQ comuni
  • Deflection di richieste ripetitive con traffico alto
  • Volume massimo con budget controllato, senza rinunciare al reasoning

GPT-4.1 Mini

Generalista classico di OpenAI. Niente reasoning, ma supporta i parametri temperature e top_p se vuoi controllare la creatività delle risposte.

Best for:

  • Configurazioni che richiedono temperature personalizzata
  • Agenti con tono molto specifico (creativo o rigoroso)

GPT-4o

Modello multimodale collaudato di OpenAI. Eccellente supporto multilingua, qualità di scrittura naturale.

Best for:

  • Agenti multilingua con utenti internazionali
  • Casi in cui ti fidi di un modello “stabile” da mesi
  • Configurazioni esistenti che già funzionano bene

GPT-4o Mini

La versione mini di 4o: il modello più economico nel pool OpenAI. Massimo volume al costo minimo.

Best for:

  • Demo, prototipi, ambienti di test
  • Traffico altissimo dove il budget conta più della perfezione
  • Agenti di prima linea che fanno solo triage

Come scegliere

Una guida rapida per restringere la scelta in base al tuo caso d’uso:

  • Customer support, FAQ rapide, traffico alto → Tier 3: GPT-5.6 Luna.
  • Lead qualification, booking, conversazioni di media complessità → Tier 2: GPT-5.6 Terra o Claude Sonnet 5 (la scelta bilanciata di default).
  • Settori regolamentati o consulenze specialistiche (legale, sanitario, finanziario) → Tier 1: Claude Opus 5 per i casi più difficili, oppure GPT-5.6 Sol / GPT-5.5 su OpenAI.
  • Knowledge base molto grande (100+ documenti, contratti lunghi) → famiglia Claude (200k contesto): Sonnet 5 o Opus 5.
  • Agente in inglese su contenuti tecniciGPT-5.6 Terra o GPT-5.4.
  • Demo, MVP, traffico di testGPT-4o Mini o GPT-5.6 Luna.

Prossimi passi