# Scegli il modello di IA con cui risponde il tuo agente

> Scegli il modello di IA che scrive le risposte del tuo agente intoCHAT: modelli di OpenAI, Anthropic e Google, quanti messaggi usa ogni risposta, quali piani li includono, Auto, modelli di riserva, prove nel Playground e dove finiscono i messaggi dei visitatori.

Ogni agente scrive le sue risposte con un modello di IA. Per impostazione predefinita è GPT-6 Luna di OpenAI, adatto alla maggior parte delle conversazioni di assistenza. Con un piano a pagamento puoi scegliere un altro modello per ogni agente, di OpenAI, Anthropic o Google, oppure lasciare che **Auto** ne scelga uno per ogni messaggio.

I modelli più grandi usano più messaggi del tuo piano per ogni risposta. Il resto del tuo agente resta uguale con qualsiasi modello: la sua conoscenza, le istruzioni, i guardrail, le azioni, i moduli e le procedure.

## Scegliere un modello

1. Apri il tuo agente e vai alla scheda **Setup**. Il riquadro **Model** si trova sotto **Reply language**.
2. Scegli un modello, oppure **Auto**. Ogni modello mostra il suo fornitore, la sua fascia, quanti messaggi usa per risposta e il piano più economico che lo include.
3. Clicca su **Save changes** in alto.

I modelli che il tuo piano non include sono elencati ma in grigio, con il piano che serve, per esempio **Needs Pro**. Un modello compare solo quando intoCHAT lo ha configurato; se un fornitore non è configurato, i suoi modelli non vengono elencati.

La scelta viene salvata con le altre impostazioni dell'agente, quindi compare nella [Cronologia delle impostazioni](/it/docs/settings-history) come **Model** e da lì si può ripristinare.

## I modelli e quanto costano

| Modello | Fornitore | Fascia | Messaggi per risposta | Piani |
| --- | --- | --- | --- | --- |
| GPT-6 Luna (predefinito) | OpenAI | Standard | 1 | Tutti i piani |
| Claude Haiku 4.5 | Anthropic | Veloce | 1 | Da Starter in su |
| Gemini Flash | Google | Veloce | 1 | Da Starter in su |
| Claude Sonnet 5.5 | Anthropic | Avanzato | 2 | Da Pro in su |
| Gemini Pro | Google | Avanzato | 2 | Da Pro in su |
| Claude Opus 5.5 | Anthropic | Premium | 5 | Da Pro in su |
| Auto | Sceglie per ogni messaggio | | 1 | Da Starter in su |

"Messaggi per risposta" indica quanti dei messaggi mensili del tuo piano usa una risposta. Con Claude Opus 5.5, per esempio, 10 risposte usano 50 messaggi. Una risposta che esegue azioni o una ricerca web conta comunque una volta sola, alla tariffa del suo modello. Il [tetto mensile di messaggi](/it/docs/limits-and-access#tetto-mensile-di-messaggi) di ogni agente conta allo stesso modo.

## Auto

Con **Auto**, intoCHAT sceglie un modello per ogni messaggio del visitatore, tra i modelli dell'elenco inclusi nel tuo piano. La scelta si basa sul messaggio, sulla lunghezza della conversazione, sulla presenza di file allegati e sulla disponibilità di azioni.

- Ogni risposta con Auto usa un messaggio, qualunque sia il modello che la scrive.
- Auto è disponibile da Starter. Con Free è in grigio.
- Auto non sceglie mai un modello che il tuo piano non include o che non è configurato.

## Come sceglie Auto

- Auto usa un messaggio per risposta, quindi sceglie solo tra i modelli che usano un messaggio: Claude Haiku 4.5, Gemini Flash e GPT-6 Luna (il predefinito).
- Nessun modello viene interpellato per decidere. La scelta avviene all'istante in base a regole semplici sul messaggio del visitatore, quindi non aggiunge ritardi e non usa messaggi.
- Un messaggio con un'immagine o un file va a un modello che sa leggere le immagini, prima di tutto GPT-6 Luna.
- I messaggi complessi vanno a GPT-6 Luna:
  - una richiesta di fare qualcosa, come un ordine, un rimborso, una prenotazione, una disdetta, una modifica, una tracciatura o un reso, oppure un messaggio con un numero d'ordine come #1234, quando l'agente ha qualcosa che può fare in quella conversazione (per esempio azioni, moduli, procedure, prenotazioni, ordini, passaggio al team o ricerca web);
  - una domanda in più parti, o un elenco di punti;
  - un messaggio di oltre 400 caratteri;
  - una richiesta di codice o di una tabella;
  - un confronto;
  - qualsiasi messaggio quando la conversazione ha già più di 12 messaggi precedenti.
- Tutto il resto, come saluti, ringraziamenti, risposte sì o no, chiacchiere e domande brevi, va al modello più veloce disponibile: Claude Haiku 4.5, poi Gemini Flash, poi GPT-6 Luna.
- Vengono considerati solo i modelli configurati su intoCHAT e inclusi nel tuo piano. Se nessuno di questi è adatto, risponde GPT-6 Luna.
- La lingua non cambia la scelta: tutti questi modelli sono multilingue, e le regole capiscono inglese, tedesco, francese, italiano e spagnolo.

Puoi vedere quali modelli hanno scritto le risposte dei tuoi agenti nella **Dashboard**, sotto **Outcomes**, nel riquadro **Models used**, per il periodo e l'agente che scegli. Con Auto mostra il modello scelto per ogni risposta, oppure GPT-6 Luna quando ha risposto al suo posto dopo un problema del fornitore.

## Modelli di riserva

I tuoi visitatori ricevono sempre una risposta. Il modello predefinito, GPT-6 Luna, risponde al posto del modello dell'agente quando:

- **Il piano non include più il modello**, per esempio dopo un downgrade da Pro a Starter. Il riquadro **Model** indica allora che le risposte usano GPT-6 Luna finché non passi a un piano superiore o scegli un altro modello. Nelle tue impostazioni non cambia nulla, e salvare le altre impostazioni funziona ancora.
- **Il modello non è più configurato** su intoCHAT.
- **Questo mese restano meno messaggi di quanti ne usa il modello**, ma almeno uno. La risposta usa allora un messaggio. Quando non resta nessun messaggio, i tuoi agenti smettono di rispondere come sempre; vedi [Piani e limiti](/it/docs/plans-and-limits#che-cosa-conta-come-messaggio).
- **Il fornitore ha un problema** prima che la risposta inizi, per esempio un'interruzione del servizio. intoCHAT prova invece una volta con GPT-6 Luna, e il resto di quella risposta resta su di esso. La risposta usa allora un messaggio, come qualsiasi risposta di GPT-6 Luna: i messaggi in più di un modello più grande vengono restituiti.

Per vedere quale modello ha scritto una risposta, apri **Why this answer** sotto di essa nella scheda **Conversations**. La riga **Model** indica il modello, dice quando l'ha scelto Auto e perché, e dice quando ha risposto invece il modello predefinito e per quale motivo. Vedi [Conversazioni e statistiche](/it/docs/conversations-and-dashboard#why-this-answer).

## Provare i modelli nel Playground

Il **Playground** usa il modello sullo schermo, salvato o no, come per le istruzioni e i guardrail. Scegli un modello nel riquadro **Model**, poi chatta nel Playground per provarlo prima di salvare. Solo chi può modificare l'agente può provare un modello non salvato; tutti gli altri ottengono quello salvato.

In **Compare**, ogni lato può usare il proprio modello:

- **B** ha un selettore **Model** accanto alle sue altre impostazioni di bozza. **Use B** lo copia nel modulo delle impostazioni insieme al resto della bozza.
- **A** risponde con il modello salvato, a meno che tu non ne scelga un altro in **A's model**.

Ogni invio in Compare usa i messaggi dei modelli di entrambi i lati, per esempio due con due modelli da un messaggio. Per un lato il cui modello non è incluso nel tuo piano o non è configurato risponde GPT-6 Luna, e quel lato usa un messaggio. La riga sopra le chat mostra il numero.

## Ovunque risponda il tuo agente

Il modello dell'agente scrive ogni risposta che ricevono i visitatori: nel widget di chat, nell'iframe incorporato e nel link alla chat, nella Help Page, in [Slack](/it/docs/slack-agent), via [email](/it/docs/email-agent), nella [REST API](/it/docs/rest-api), nel [server MCP](/it/docs/mcp-server) e nei [test con clienti simulati](/it/docs/agent-tests). In un test, solo le risposte del tuo agente usano il suo modello; il cliente simulato e il giudice non usano i tuoi messaggi.

Il lavoro di IA che intoCHAT svolge dietro le quinte usa sempre il suo modello standard di OpenAI e non dipende dalla tua scelta: la ricerca nella tua conoscenza, l'analisi degli argomenti, i controlli antispam, il copilot, le domande sulle tue conversazioni, la traduzione dal vivo e il controllo delle informazioni contraddittorie.

La REST API restituisce il modello dell'agente come `model` su un agente, e il modello che ha scritto ogni risposta come `model` sui messaggi di una conversazione. Vedi [REST API](/it/docs/rest-api).

## File e foto

Tutti i modelli dell'elenco leggono le immagini allegate dai visitatori. I PDF vengono letti solo dai modelli di OpenAI: con un modello di Anthropic o di Google, all'agente viene detto che è stato allegato un PDF ma non può aprirlo, e risponde in base a ciò che ha scritto il visitatore.

## Privacy

I messaggi del visitatore, la conversazione fino a quel momento, le tue istruzioni e gli estratti di conoscenza usati per la risposta vengono inviati al fornitore del modello che la scrive: OpenAI, Anthropic o Google. Con Auto può essere uno qualsiasi dei tre, a seconda del modello scelto per ogni messaggio. Quando risponde invece GPT-6 Luna dopo un problema del fornitore, anche la richiesta della risposta va a OpenAI.

Il lavoro di IA che intoCHAT svolge dietro le quinte, come la ricerca nella tua conoscenza, i controlli antispam e l'analisi degli argomenti, usa sempre OpenAI, quindi i messaggi dei visitatori arrivano anche a OpenAI qualunque modello tu scelga. Se la tua informativa sulla privacy nomina le aziende che trattano i messaggi della chat, elenca OpenAI e i fornitori dei modelli che usi.

## Utilizzo per modello

Per il proprietario dell'account, **Settings**, **Billing** mostra quante risposte ha scritto ogni modello nel periodo di fatturazione in corso, sotto **Replies by model this period**. Conta le risposte salvate nelle conversazioni, quindi le chat temporanee e i test non sono inclusi. Il conteggio dei messaggi del tuo piano, sopra, è il numero che conta per il tuo limite.

## Limiti

- Un modello per agente. Agenti diversi possono usare modelli diversi.
- Una risposta già in streaming quando un fornitore ha un problema non può cambiare modello; il visitatore può vedere la risposta interrompersi a metà. I modelli di riserva entrano in gioco prima che venga mostrato qualsiasi testo.
- Le risposte differiscono tra i modelli per stile e lunghezza. Prova un modello nel Playground prima di cambiarlo su un agente molto usato.
- I modelli più grandi di solito impiegano più tempo a rispondere di GPT-6 Luna e dei modelli veloci, soprattutto nelle risposte che eseguono azioni. intoCHAT aspetta fino a 25 secondi che Anthropic o Google rispondano prima che risponda invece GPT-6 Luna, quindi un fornitore lento può allungare ancora di più i tempi di una risposta.
