Scegli il modello di IA con cui risponde il tuo agente
Scegli il modello di IA che scrive le risposte del tuo agente intoCHAT: modelli di OpenAI, Anthropic e Google, quanti messaggi usa ogni risposta, quali piani li includono, Auto, modelli di riserva, prove nel Playground e dove finiscono i messaggi dei visitatori.
Ogni agente scrive le sue risposte con un modello di IA. Per impostazione predefinita è GPT-6 Luna di OpenAI, adatto alla maggior parte delle conversazioni di assistenza. Con un piano a pagamento puoi scegliere un altro modello per ogni agente, di OpenAI, Anthropic o Google, oppure lasciare che Auto ne scelga uno per ogni messaggio.
I modelli più grandi usano più messaggi del tuo piano per ogni risposta. Il resto del tuo agente resta uguale con qualsiasi modello: la sua conoscenza, le istruzioni, i guardrail, le azioni, i moduli e le procedure.
Scegliere un modello
- Apri il tuo agente e vai alla scheda Setup. Il riquadro Model si trova sotto Reply language.
- Scegli un modello, oppure Auto. Ogni modello mostra il suo fornitore, la sua fascia, quanti messaggi usa per risposta e il piano più economico che lo include.
- Clicca su Save changes in alto.
I modelli che il tuo piano non include sono elencati ma in grigio, con il piano che serve, per esempio Needs Pro. Un modello compare solo quando intoCHAT lo ha configurato; se un fornitore non è configurato, i suoi modelli non vengono elencati.
La scelta viene salvata con le altre impostazioni dell'agente, quindi compare nella Cronologia delle impostazioni come Model e da lì si può ripristinare.
I modelli e quanto costano
| Modello | Fornitore | Fascia | Messaggi per risposta | Piani |
|---|---|---|---|---|
| GPT-6 Luna (predefinito) | OpenAI | Standard | 1 | Tutti i piani |
| Claude Haiku 4.5 | Anthropic | Veloce | 1 | Da Starter in su |
| Gemini Flash | Veloce | 1 | Da Starter in su | |
| Claude Sonnet 5.5 | Anthropic | Avanzato | 2 | Da Pro in su |
| Gemini Pro | Avanzato | 2 | Da Pro in su | |
| Claude Opus 5.5 | Anthropic | Premium | 5 | Da Pro in su |
| Auto | Sceglie per ogni messaggio | 1 | Da Starter in su |
"Messaggi per risposta" indica quanti dei messaggi mensili del tuo piano usa una risposta. Con Claude Opus 5.5, per esempio, 10 risposte usano 50 messaggi. Una risposta che esegue azioni o una ricerca web conta comunque una volta sola, alla tariffa del suo modello. Il tetto mensile di messaggi di ogni agente conta allo stesso modo.
Auto
Con Auto, intoCHAT sceglie un modello per ogni messaggio del visitatore, tra i modelli dell'elenco inclusi nel tuo piano. La scelta si basa sul messaggio, sulla lunghezza della conversazione, sulla presenza di file allegati e sulla disponibilità di azioni.
- Ogni risposta con Auto usa un messaggio, qualunque sia il modello che la scrive.
- Auto è disponibile da Starter. Con Free è in grigio.
- Auto non sceglie mai un modello che il tuo piano non include o che non è configurato.
Come sceglie Auto
- Auto usa un messaggio per risposta, quindi sceglie solo tra i modelli che usano un messaggio: Claude Haiku 4.5, Gemini Flash e GPT-6 Luna (il predefinito).
- Nessun modello viene interpellato per decidere. La scelta avviene all'istante in base a regole semplici sul messaggio del visitatore, quindi non aggiunge ritardi e non usa messaggi.
- Un messaggio con un'immagine o un file va a un modello che sa leggere le immagini, prima di tutto GPT-6 Luna.
- I messaggi complessi vanno a GPT-6 Luna:
- una richiesta di fare qualcosa, come un ordine, un rimborso, una prenotazione, una disdetta, una modifica, una tracciatura o un reso, oppure un messaggio con un numero d'ordine come #1234, quando l'agente ha qualcosa che può fare in quella conversazione (per esempio azioni, moduli, procedure, prenotazioni, ordini, passaggio al team o ricerca web);
- una domanda in più parti, o un elenco di punti;
- un messaggio di oltre 400 caratteri;
- una richiesta di codice o di una tabella;
- un confronto;
- qualsiasi messaggio quando la conversazione ha già più di 12 messaggi precedenti.
- Tutto il resto, come saluti, ringraziamenti, risposte sì o no, chiacchiere e domande brevi, va al modello più veloce disponibile: Claude Haiku 4.5, poi Gemini Flash, poi GPT-6 Luna.
- Vengono considerati solo i modelli configurati su intoCHAT e inclusi nel tuo piano. Se nessuno di questi è adatto, risponde GPT-6 Luna.
- La lingua non cambia la scelta: tutti questi modelli sono multilingue, e le regole capiscono inglese, tedesco, francese, italiano e spagnolo.
Puoi vedere quali modelli hanno scritto le risposte dei tuoi agenti nella Dashboard, sotto Outcomes, nel riquadro Models used, per il periodo e l'agente che scegli. Con Auto mostra il modello scelto per ogni risposta, oppure GPT-6 Luna quando ha risposto al suo posto dopo un problema del fornitore.
Modelli di riserva
I tuoi visitatori ricevono sempre una risposta. Il modello predefinito, GPT-6 Luna, risponde al posto del modello dell'agente quando:
- Il piano non include più il modello, per esempio dopo un downgrade da Pro a Starter. Il riquadro Model indica allora che le risposte usano GPT-6 Luna finché non passi a un piano superiore o scegli un altro modello. Nelle tue impostazioni non cambia nulla, e salvare le altre impostazioni funziona ancora.
- Il modello non è più configurato su intoCHAT.
- Questo mese restano meno messaggi di quanti ne usa il modello, ma almeno uno. La risposta usa allora un messaggio. Quando non resta nessun messaggio, i tuoi agenti smettono di rispondere come sempre; vedi Piani e limiti.
- Il fornitore ha un problema prima che la risposta inizi, per esempio un'interruzione del servizio. intoCHAT prova invece una volta con GPT-6 Luna, e il resto di quella risposta resta su di esso. La risposta usa allora un messaggio, come qualsiasi risposta di GPT-6 Luna: i messaggi in più di un modello più grande vengono restituiti.
Per vedere quale modello ha scritto una risposta, apri Why this answer sotto di essa nella scheda Conversations. La riga Model indica il modello, dice quando l'ha scelto Auto e perché, e dice quando ha risposto invece il modello predefinito e per quale motivo. Vedi Conversazioni e statistiche.
Provare i modelli nel Playground
Il Playground usa il modello sullo schermo, salvato o no, come per le istruzioni e i guardrail. Scegli un modello nel riquadro Model, poi chatta nel Playground per provarlo prima di salvare. Solo chi può modificare l'agente può provare un modello non salvato; tutti gli altri ottengono quello salvato.
In Compare, ogni lato può usare il proprio modello:
- B ha un selettore Model accanto alle sue altre impostazioni di bozza. Use B lo copia nel modulo delle impostazioni insieme al resto della bozza.
- A risponde con il modello salvato, a meno che tu non ne scelga un altro in A's model.
Ogni invio in Compare usa i messaggi dei modelli di entrambi i lati, per esempio due con due modelli da un messaggio. Per un lato il cui modello non è incluso nel tuo piano o non è configurato risponde GPT-6 Luna, e quel lato usa un messaggio. La riga sopra le chat mostra il numero.
Ovunque risponda il tuo agente
Il modello dell'agente scrive ogni risposta che ricevono i visitatori: nel widget di chat, nell'iframe incorporato e nel link alla chat, nella Help Page, in Slack, via email, nella REST API, nel server MCP e nei test con clienti simulati. In un test, solo le risposte del tuo agente usano il suo modello; il cliente simulato e il giudice non usano i tuoi messaggi.
Il lavoro di IA che intoCHAT svolge dietro le quinte usa sempre il suo modello standard di OpenAI e non dipende dalla tua scelta: la ricerca nella tua conoscenza, l'analisi degli argomenti, i controlli antispam, il copilot, le domande sulle tue conversazioni, la traduzione dal vivo e il controllo delle informazioni contraddittorie.
La REST API restituisce il modello dell'agente come model su un agente, e il modello che ha scritto ogni risposta come model sui messaggi di una conversazione. Vedi REST API.
File e foto
Tutti i modelli dell'elenco leggono le immagini allegate dai visitatori. I PDF vengono letti solo dai modelli di OpenAI: con un modello di Anthropic o di Google, all'agente viene detto che è stato allegato un PDF ma non può aprirlo, e risponde in base a ciò che ha scritto il visitatore.
Privacy
I messaggi del visitatore, la conversazione fino a quel momento, le tue istruzioni e gli estratti di conoscenza usati per la risposta vengono inviati al fornitore del modello che la scrive: OpenAI, Anthropic o Google. Con Auto può essere uno qualsiasi dei tre, a seconda del modello scelto per ogni messaggio. Quando risponde invece GPT-6 Luna dopo un problema del fornitore, anche la richiesta della risposta va a OpenAI.
Il lavoro di IA che intoCHAT svolge dietro le quinte, come la ricerca nella tua conoscenza, i controlli antispam e l'analisi degli argomenti, usa sempre OpenAI, quindi i messaggi dei visitatori arrivano anche a OpenAI qualunque modello tu scelga. Se la tua informativa sulla privacy nomina le aziende che trattano i messaggi della chat, elenca OpenAI e i fornitori dei modelli che usi.
Utilizzo per modello
Per il proprietario dell'account, Settings, Billing mostra quante risposte ha scritto ogni modello nel periodo di fatturazione in corso, sotto Replies by model this period. Conta le risposte salvate nelle conversazioni, quindi le chat temporanee e i test non sono inclusi. Il conteggio dei messaggi del tuo piano, sopra, è il numero che conta per il tuo limite.
Limiti
- Un modello per agente. Agenti diversi possono usare modelli diversi.
- Una risposta già in streaming quando un fornitore ha un problema non può cambiare modello; il visitatore può vedere la risposta interrompersi a metà. I modelli di riserva entrano in gioco prima che venga mostrato qualsiasi testo.
- Le risposte differiscono tra i modelli per stile e lunghezza. Prova un modello nel Playground prima di cambiarlo su un agente molto usato.
- I modelli più grandi di solito impiegano più tempo a rispondere di GPT-6 Luna e dei modelli veloci, soprattutto nelle risposte che eseguono azioni. intoCHAT aspetta fino a 25 secondi che Anthropic o Google rispondano prima che risponda invece GPT-6 Luna, quindi un fornitore lento può allungare ancora di più i tempi di una risposta.