Aller au contenu
Documentation

Choisir le modèle d'IA avec lequel votre agent répond

Choisissez le modèle d'IA qui rédige les réponses de votre agent intoCHAT : modèles d'OpenAI, d'Anthropic et de Google, nombre de messages utilisés par réponse, offres qui les incluent, Auto, modèles de secours, tests dans le Playground et destination des messages des visiteurs.

Chaque agent rédige ses réponses avec un modèle d'IA. Par défaut, il s'agit de GPT-6 Luna d'OpenAI, qui convient à la plupart des conversations de support. Avec une offre payante, vous pouvez choisir un autre modèle pour chaque agent, chez OpenAI, Anthropic ou Google, ou laisser Auto en choisir un pour chaque message.

Les modèles plus puissants utilisent davantage de messages de votre offre par réponse. Le reste de votre agent ne change pas, quel que soit le modèle : ses connaissances, ses instructions, ses garde-fous, ses actions, ses formulaires et ses procédures.

Choisir un modèle

  1. Ouvrez votre agent et allez dans l'onglet Setup. La carte Model se trouve sous Reply language.
  2. Choisissez un modèle, ou Auto. Chaque modèle affiche son fournisseur, sa catégorie, le nombre de messages qu'il utilise par réponse et l'offre la moins chère qui l'inclut.
  3. Cliquez sur Save changes dans l'en-tête.

Les modèles que votre offre n'inclut pas sont affichés mais grisés, avec l'offre nécessaire, par exemple Needs Pro. Un modèle n'apparaît que si intoCHAT l'a configuré ; si un fournisseur n'est pas configuré, ses modèles ne sont pas listés.

Le choix est enregistré avec les autres réglages de l'agent : il apparaît donc dans l'Historique des réglages sous Model et peut être restauré depuis là.

Modèles et coût

ModèleFournisseurCatégorieMessages par réponseOffres
GPT-6 Luna (par défaut)OpenAIStandard1Toutes les offres
Claude Haiku 4.5AnthropicFast1Starter et au-delà
Gemini FlashGoogleFast1Starter et au-delà
Claude Sonnet 5.5AnthropicAdvanced2Pro et au-delà
Gemini ProGoogleAdvanced2Pro et au-delà
Claude Opus 5.5AnthropicPremium5Pro et au-delà
AutoChoisit pour chaque message1Starter et au-delà

« Messages par réponse » indique combien des messages mensuels de votre offre une réponse utilise. Avec Claude Opus 5.5, par exemple, 10 réponses utilisent 50 messages. Une réponse qui exécute des actions ou une recherche web ne compte toujours qu'une fois, au tarif de son modèle. Le plafond mensuel de messages de chaque agent compte de la même façon.

Auto

Avec Auto, intoCHAT choisit un modèle pour chaque message du visiteur, parmi les modèles de la liste que votre offre inclut. Le choix dépend du message, de la longueur de la conversation, de la présence de fichiers joints et des actions proposées.

  • Chaque réponse avec Auto utilise un message, quel que soit le modèle qui la rédige.
  • Auto est disponible à partir de Starter. Avec Free, il est grisé.
  • Auto ne choisit jamais un modèle que votre offre n'inclut pas, ni un modèle qui n'est pas configuré.

Comment Auto choisit

  • Auto utilise un message par réponse : il ne choisit donc qu'entre les modèles qui utilisent un message, Claude Haiku 4.5, Gemini Flash et GPT-6 Luna (le modèle par défaut).
  • Aucun modèle n'est sollicité pour décider. Le choix est fait instantanément à partir de règles simples portant sur le message du visiteur : il n'ajoute donc aucun délai et n'utilise aucun message.
  • Un message avec une image ou un fichier va à un modèle capable de lire les images, GPT-6 Luna en priorité.
  • Les messages complexes vont à GPT-6 Luna :
    • une demande d'action, comme une commande, un remboursement, une réservation, une annulation, une modification, un suivi ou un retour, ou un message contenant un numéro de commande comme #1234, quand l'agent peut faire quelque chose dans cette conversation (actions, formulaires, procédures, réservation, commandes, transfert ou recherche web, par exemple) ;
    • une question en plusieurs parties, ou une liste de points ;
    • un message de plus de 400 caractères ;
    • une demande de code ou de tableau ;
    • une comparaison ;
    • tout message dès que la conversation compte plus de 12 messages précédents.
  • Tout le reste, comme les salutations, les remerciements, les réponses par oui ou par non, les échanges informels et les questions courtes, va au modèle le plus rapide disponible : Claude Haiku 4.5, puis Gemini Flash, puis GPT-6 Luna.
  • Seuls les modèles configurés sur intoCHAT et inclus dans votre offre sont pris en compte. Si aucun ne convient, c'est GPT-6 Luna qui répond.
  • La langue ne change pas le choix : tous ces modèles sont multilingues, et les règles comprennent l'anglais, l'allemand, le français, l'italien et l'espagnol.

Vous pouvez voir quels modèles ont rédigé les réponses de vos agents sur le Dashboard, sous Outcomes, dans la carte Models used, pour la période et l'agent que vous choisissez. Avec Auto, elle indique le modèle choisi pour chaque réponse, ou GPT-6 Luna quand il a répondu à la place après un problème chez un fournisseur.

Modèles de secours

Vos visiteurs reçoivent toujours une réponse. Le modèle par défaut, GPT-6 Luna, répond à la place du modèle de l'agent quand :

  • L'offre n'inclut plus le modèle, par exemple après un passage de Pro à Starter. La carte Model indique alors que les réponses utilisent GPT-6 Luna jusqu'à ce que vous passiez à une offre supérieure ou choisissiez un autre modèle. Rien n'est modifié dans vos réglages, et l'enregistrement des autres réglages fonctionne toujours.
  • Le modèle n'est plus configuré sur intoCHAT.
  • Il reste ce mois-ci moins de messages que le modèle n'en utilise, mais au moins un. La réponse utilise alors un message. Quand il ne reste plus aucun message, vos agents cessent de répondre comme d'habitude ; voir Offres et limites.
  • Le fournisseur rencontre un problème avant le début de la réponse, par exemple une panne. intoCHAT essaie alors une fois GPT-6 Luna à la place, et le reste de cette réponse est rédigé avec lui. La réponse utilise alors un message, comme toute réponse de GPT-6 Luna : les messages supplémentaires d'un modèle plus puissant sont restitués.

Pour savoir quel modèle a rédigé une réponse, ouvrez Why this answer sous celle-ci dans l'onglet Conversations. La ligne Model nomme le modèle, indique si Auto l'a choisi et pourquoi, et précise si le modèle par défaut a répondu à la place et pour quelle raison. Voir Conversations et stats.

Essayer des modèles dans le Playground

Le Playground utilise le modèle affiché à l'écran, enregistré ou non, comme pour les instructions et les garde-fous. Choisissez un modèle dans la carte Model, puis discutez dans le Playground pour l'essayer avant d'enregistrer. Seules les personnes autorisées à modifier l'agent peuvent essayer un modèle non enregistré ; les autres obtiennent le modèle enregistré.

Dans Compare, chaque côté peut utiliser son propre modèle :

  • B dispose d'un sélecteur Model à côté de ses autres réglages de brouillon. Use B le copie dans le formulaire des réglages avec le reste du brouillon.
  • A répond avec le modèle enregistré, sauf si vous en choisissez un autre sous A's model.

Chaque envoi dans Compare utilise les messages des modèles des deux côtés, par exemple deux avec deux modèles à un message. Pour un côté dont votre offre n'inclut pas le modèle, ou dont le modèle n'est pas configuré, c'est GPT-6 Luna qui répond, avec un message. La ligne au-dessus des chats indique le nombre.

Partout où votre agent répond

Le modèle de l'agent rédige toutes les réponses que reçoivent les visiteurs : dans le widget de chat, l'iframe intégrée et le lien de chat, la page d'aide, Slack, l'e-mail, l'API REST, le serveur MCP et les tests avec clients simulés. Dans un test, seules les réponses de votre agent utilisent son modèle ; le client simulé et le juge n'utilisent pas vos messages.

Le travail d'IA qu'intoCHAT effectue en coulisses utilise toujours son modèle OpenAI standard et ne dépend pas de votre choix : la recherche dans vos connaissances, l'analyse des thèmes, les contrôles anti-spam, le copilote, les questions sur vos conversations, la traduction en direct et la vérification des informations contradictoires.

L'API REST renvoie le modèle de l'agent dans le champ model d'un agent, et le modèle qui a rédigé chaque réponse dans le champ model des messages d'une conversation. Voir API REST.

Fichiers et photos

Tous les modèles listés lisent les images que les visiteurs joignent. Les PDF ne sont lus que par les modèles d'OpenAI : avec un modèle d'Anthropic ou de Google, l'agent est informé qu'un PDF a été joint mais ne peut pas l'ouvrir, et répond à partir de ce que le visiteur a écrit.

Confidentialité

Les messages du visiteur, la conversation jusque-là, vos instructions et les extraits de connaissances utilisés pour la réponse sont envoyés au fournisseur du modèle qui la rédige : OpenAI, Anthropic ou Google. Avec Auto, il peut s'agir de n'importe lequel des trois, selon le modèle choisi pour chaque message. Quand GPT-6 Luna répond à la place après un problème chez le fournisseur, la requête de la réponse est aussi envoyée à OpenAI.

Le travail d'IA qu'intoCHAT effectue en coulisses, comme la recherche dans vos connaissances, les contrôles anti-spam et l'analyse des thèmes, utilise toujours OpenAI : les messages des visiteurs parviennent donc aussi à OpenAI, quel que soit le modèle choisi. Si votre politique de confidentialité nomme les entreprises qui traitent les messages de chat, indiquez OpenAI et les fournisseurs des modèles que vous utilisez.

Utilisation par modèle

Pour le propriétaire du compte, Settings, Billing indique combien de réponses chaque modèle a rédigées pendant la période de facturation en cours, sous Replies by model this period. Le décompte porte sur les réponses enregistrées dans les conversations : les chats temporaires et les tests n'y figurent donc pas. Le nombre de messages de votre offre, affiché au-dessus, est celui qui compte pour votre limite.

Limites

  • Un modèle par agent. Des agents différents peuvent utiliser des modèles différents.
  • Une réponse déjà en cours d'affichage quand un fournisseur tombe en panne ne peut pas changer de modèle ; le visiteur peut voir la réponse s'interrompre. Les modèles de secours interviennent avant qu'un texte ne s'affiche.
  • Les réponses diffèrent d'un modèle à l'autre par leur style et leur longueur. Essayez un modèle dans le Playground avant d'en changer sur un agent très sollicité.
  • Les modèles plus puissants mettent généralement plus de temps à répondre que GPT-6 Luna et les modèles rapides, surtout dans les réponses qui exécutent des actions. intoCHAT attend jusqu'à 25 secondes la réponse d'Anthropic ou de Google avant que GPT-6 Luna ne réponde à la place : un fournisseur lent peut donc allonger encore le délai d'une réponse.

Voir en Markdown