# Elige el modelo de IA con el que responde tu agente

> Elige el modelo de IA que redacta las respuestas de tu agente de intoCHAT: modelos de OpenAI, Anthropic y Google, cuántos mensajes usa cada respuesta, qué planes los incluyen, Auto, alternativas, pruebas en el Playground y adónde van los mensajes de los visitantes.

Cada agente redacta sus respuestas con un modelo de IA. Por defecto es GPT-6 Luna, de OpenAI, que va bien para la mayoría de las conversaciones de soporte. En un plan de pago puedes elegir otro modelo para cada agente, de OpenAI, Anthropic o Google, o dejar que **Auto** elija uno para cada mensaje.

Los modelos más grandes usan más mensajes de tu plan por respuesta. El resto de tu agente sigue igual con cualquier modelo: su conocimiento, sus instrucciones, sus guardrails, sus acciones, sus formularios y sus procedimientos.

## Elegir un modelo

1. Abre tu agente y ve a la pestaña **Setup**. La tarjeta **Model** está debajo de **Reply language**.
2. Elige un modelo, o **Auto**. Cada modelo muestra su proveedor, su categoría, cuántos mensajes usa por respuesta y el plan más barato que lo incluye.
3. Haz clic en **Save changes** en la cabecera.

Los modelos que tu plan no incluye aparecen en la lista, pero en gris, con el plan que necesitan, por ejemplo **Needs Pro**. Un modelo solo aparece cuando intoCHAT lo tiene configurado; si un proveedor no está configurado, sus modelos no aparecen.

La elección se guarda con los demás ajustes del agente, así que aparece en el [Historial de ajustes](/es/docs/settings-history) como **Model** y se puede restaurar desde allí.

## Modelos y lo que cuestan

| Modelo | Proveedor | Categoría | Mensajes por respuesta | Planes |
| --- | --- | --- | --- | --- |
| GPT-6 Luna (por defecto) | OpenAI | Estándar | 1 | Todos los planes |
| Claude Haiku 4.5 | Anthropic | Rápido | 1 | Starter y superiores |
| Gemini Flash | Google | Rápido | 1 | Starter y superiores |
| Claude Sonnet 5.5 | Anthropic | Avanzado | 2 | Pro y superiores |
| Gemini Pro | Google | Avanzado | 2 | Pro y superiores |
| Claude Opus 5.5 | Anthropic | Premium | 5 | Pro y superiores |
| Auto | Elige para cada mensaje | | 1 | Starter y superiores |

«Mensajes por respuesta» es cuántos de los mensajes mensuales de tu plan usa una respuesta. Con Claude Opus 5.5, por ejemplo, 10 respuestas usan 50 mensajes. Una respuesta que ejecuta acciones o una búsqueda web sigue contando una sola vez, según la tarifa de su modelo. El [tope mensual de mensajes](/es/docs/limits-and-access#tope-mensual-de-mensajes) de cada agente cuenta de la misma forma.

## Auto

Con **Auto**, intoCHAT elige un modelo para cada mensaje del visitante, entre los modelos de la lista que incluye tu plan. La elección se basa en el mensaje, en la longitud de la conversación, en si hay archivos adjuntos y en si se ofrecen acciones.

- Cada respuesta con Auto usa un mensaje, sea cual sea el modelo que la redacta.
- Auto está disponible a partir de Starter. En Free aparece en gris.
- Auto nunca elige un modelo que tu plan no incluye ni uno que no está configurado.

## Cómo elige Auto

- Auto usa un mensaje por respuesta, así que solo elige entre los modelos que usan un mensaje: Claude Haiku 4.5, Gemini Flash y GPT-6 Luna (el modelo por defecto).
- No se le pide a ningún modelo que decida. La elección se hace al instante con reglas sencillas sobre el mensaje del visitante, así que no añade retraso ni usa mensajes.
- Un mensaje con una imagen o un archivo va a un modelo que puede leer imágenes, en primer lugar GPT-6 Luna.
- Los mensajes complejos van a GPT-6 Luna:
  - una petición de hacer algo, como un pedido, un reembolso, una reserva, una cancelación, un cambio, un seguimiento o una devolución, o un mensaje con un número de pedido como #1234, cuando el agente tiene algo que puede hacer en esa conversación (por ejemplo, acciones, formularios, procedimientos, reservas, pedidos, traspaso o búsqueda web);
  - una pregunta en varias partes, o una lista de puntos;
  - un mensaje de más de 400 caracteres;
  - una petición de código o de una tabla;
  - una comparación;
  - cualquier mensaje cuando la conversación ya tiene más de 12 mensajes anteriores.
- Todo lo demás, como saludos, agradecimientos, respuestas de sí o no, charla trivial y preguntas cortas, va al modelo más rápido disponible: Claude Haiku 4.5, después Gemini Flash y después GPT-6 Luna.
- Solo se tienen en cuenta los modelos configurados en intoCHAT que incluye tu plan. Si ninguno encaja, responde GPT-6 Luna.
- El idioma no cambia la elección: todos estos modelos son multilingües, y las reglas entienden inglés, alemán, francés, italiano y español.

Puedes ver qué modelos redactaron las respuestas de tus agentes en el **Dashboard**, en **Outcomes**, en la tarjeta **Models used**, para el periodo y el agente que elijas. Con Auto, muestra el modelo elegido para cada respuesta, o GPT-6 Luna cuando respondió en su lugar tras un problema del proveedor.

## Alternativas

Tus visitantes siempre reciben una respuesta. El modelo por defecto, GPT-6 Luna, responde en lugar del modelo del agente cuando:

- **El plan ya no incluye el modelo**, por ejemplo después de bajar de Pro a Starter. La tarjeta **Model** indica entonces que las respuestas usan GPT-6 Luna hasta que mejores tu plan o elijas otro modelo. No se cambia nada en tus ajustes, y guardar otros ajustes sigue funcionando.
- **El modelo ya no está configurado** en intoCHAT.
- **Quedan este mes menos mensajes de los que usa el modelo**, pero al menos uno. La respuesta usa entonces un mensaje. Cuando no queda ningún mensaje, tus agentes dejan de responder como siempre; consulta [Planes y límites](/es/docs/plans-and-limits#que-cuenta-como-mensaje).
- **El proveedor tiene un problema** antes de que empiece la respuesta, por ejemplo una caída del servicio. intoCHAT prueba una vez con GPT-6 Luna en su lugar, y el resto de esa respuesta sigue con él. La respuesta usa entonces un mensaje, como cualquier respuesta de GPT-6 Luna: se devuelven los mensajes adicionales de un modelo más grande.

Para ver qué modelo redactó una respuesta, abre **Why this answer** debajo de ella en la pestaña **Conversations**. La línea **Model** nombra el modelo, indica cuándo lo eligió Auto y por qué, e indica cuándo respondió en su lugar el modelo por defecto y el motivo. Consulta [Conversaciones y datos](/es/docs/conversations-and-dashboard#why-this-answer).

## Probar modelos en el Playground

El **Playground** usa el modelo que hay en pantalla, esté guardado o no, igual que las instrucciones y los guardrails. Elige un modelo en la tarjeta **Model** y luego chatea en el Playground para probarlo antes de guardar. Solo las personas que pueden editar el agente pueden probar un modelo sin guardar; los demás usan el guardado.

En **Compare**, cada lado puede usar su propio modelo:

- **B** tiene un selector **Model** junto a sus demás ajustes de borrador. **Use B** lo copia en el formulario de ajustes con el resto del borrador.
- **A** responde con el modelo guardado, salvo que elijas otro en **A's model**.

Cada envío en Compare usa los mensajes de los modelos de los dos lados, por ejemplo dos con dos modelos de un mensaje. Si tu plan no incluye el modelo de un lado, o ese modelo no está configurado, ese lado lo responde GPT-6 Luna y usa un mensaje. La línea encima de los chats muestra el número.

## En todos los sitios donde responde tu agente

El modelo del agente redacta todas las respuestas que reciben los visitantes: en el widget del chat, el iframe integrado y el enlace del chat, la página de ayuda, [Slack](/es/docs/slack-agent), el [correo](/es/docs/email-agent), la [API REST](/es/docs/rest-api), el [servidor MCP](/es/docs/mcp-server) y las [pruebas con clientes simulados](/es/docs/agent-tests). En una prueba, solo las respuestas de tu agente usan su modelo; el cliente simulado y el juez no usan tus mensajes.

El trabajo de IA que intoCHAT hace por su cuenta entre bastidores usa siempre su modelo estándar de OpenAI y no depende de tu elección: buscar en tu conocimiento, el análisis de temas, las comprobaciones de spam, el copilot, las preguntas sobre tus conversaciones, la traducción en directo y la comprobación de datos contradictorios.

La API REST devuelve el modelo del agente como `model` en un agente, y el modelo que redactó cada respuesta como `model` en los mensajes de una conversación. Consulta [API REST](/es/docs/rest-api).

## Archivos y fotos

Todos los modelos de la lista leen las imágenes que adjuntan los visitantes. Los PDF solo los leen los modelos de OpenAI: con un modelo de Anthropic o de Google, al agente se le indica que se adjuntó un PDF, pero no puede abrirlo, y responde a partir de lo que escribió el visitante.

## Privacidad

Los mensajes del visitante, la conversación hasta ese momento, tus instrucciones y los fragmentos de conocimiento usados para la respuesta van al proveedor del modelo que la redacta: OpenAI, Anthropic o Google. Con Auto, puede ser cualquiera de los tres, según el modelo elegido para cada mensaje. Cuando GPT-6 Luna responde en su lugar tras un problema del proveedor, la petición de la respuesta también va a OpenAI.

El trabajo de IA que intoCHAT hace por su cuenta entre bastidores, como buscar en tu conocimiento, las comprobaciones de spam y el análisis de temas, usa siempre OpenAI, así que los mensajes de los visitantes también llegan a OpenAI sea cual sea el modelo que elijas. Si tu política de privacidad nombra las empresas que procesan los mensajes del chat, incluye a OpenAI y a los proveedores de los modelos que usas.

## Uso por modelo

Para el propietario de la cuenta, **Settings**, **Billing** muestra cuántas respuestas redactó cada modelo en el periodo de facturación actual, en **Replies by model this period**. Cuenta las respuestas guardadas en conversaciones, así que no incluye los chats temporales ni las pruebas. El recuento de mensajes de tu plan, que aparece encima, es el número que cuenta para tu límite.

## Límites

- Un modelo por agente. Agentes distintos pueden usar modelos distintos.
- Una respuesta que ya se está mostrando cuando falla un proveedor no puede cambiar de modelo; puede que el visitante vea que la respuesta se corta. Las alternativas se aplican antes de que se muestre ningún texto.
- Las respuestas cambian de un modelo a otro en estilo y longitud. Prueba un modelo en el Playground antes de cambiar el de un agente con mucho tráfico.
- Los modelos más grandes suelen tardar más en responder que GPT-6 Luna y los modelos rápidos, sobre todo en respuestas que ejecutan acciones. intoCHAT espera hasta 25 segundos a que Anthropic o Google respondan antes de que GPT-6 Luna responda en su lugar, así que un proveedor lento puede hacer que una respuesta tarde todavía más.
