Sube archivos para entrenar a tu agente de IA
Sube archivos PDF, Word, PowerPoint, Excel, CSV, EPUB, de texto y Markdown a un agente de intoCHAT. Límites de tamaño y caracteres, qué se extrae y consejos.
Sube los documentos que tu web no cubre, como listas de precios, manuales, fichas de producto o condiciones generales. intoCHAT extrae el texto y cada archivo se convierte en una fuente propia.
Subir archivos
- Abre la pestaña Knowledge (conocimiento) del agente y elige Files (archivos) en Add knowledge.
- Arrastra los archivos a la zona de subida o haz clic en ella para elegirlos. Puedes seleccionar varios a la vez; se leen uno detrás de otro.
- Cuando los archivos aparezcan como añadidos, haz clic en Train agent en la parte superior de la pestaña.
Los archivos de más de 4 MB se suben primero, con una barra de progreso, y después se leen.
Formatos admitidos
| Tipo | Extensiones |
|---|---|
.pdf | |
| Word | .doc, .docx, .docm |
| PowerPoint | .ppt, .pptx, .pptm, .pps, .ppsx, .ppsm, .pot |
| Excel | .xls, .xlsx, .xlsm, .xlsb |
| OpenDocument | .odt, .ods, .odp |
| Otros documentos | .rtf, .epub, .csv |
| Texto plano | .txt, .md, .markdown |
Límites
- Tamaño de archivo: hasta 50 MB por archivo.
- Texto por archivo: hasta 4 MB de texto extraído. Un archivo mayor falla con un mensaje que te pide dividirlo.
- Caracteres por agente: todas las fuentes de un agente juntas pueden sumar hasta 100K caracteres en el plan Free, 500K en Starter y 1M en Pro. Si un archivo supera el límite, la subida se detiene ahí y los archivos restantes no se añaden.
Cuenta la longitud del texto extraído, no el tamaño del archivo. Un PDF grande lleno de fotos puede tener solo unos pocos miles de caracteres, mientras que una hoja de cálculo pequeña puede tener muchos más.
Qué se extrae
Los documentos se convierten a Markdown. Se conservan los títulos, párrafos, listas y tablas, lo que ayuda a intoCHAT a dividirlos en fragmentos con sentido. Los archivos de texto y Markdown se leen tal cual.
No se extrae:
- Escaneos e imágenes. No hay reconocimiento de texto (OCR). Un PDF escaneado sin capa de texto falla con un mensaje que lo indica. Pásalo antes por un programa de OCR o pega el texto como texto.
- El texto dentro de imágenes, como gráficos, diagramas o capturas de pantalla.
- Los archivos protegidos con contraseña. Quita la contraseña y vuelve a subir el archivo.
intoCHAT guarda el texto extraído, no el archivo original. Las subidas grandes se borran del almacenamiento temporal en cuanto se han leído.
Actualizar un archivo
Para actualizar un archivo, sube la nueva versión con el mismo nombre de archivo. No hace falta eliminar antes la fuente antigua:
- El contenido cambió: el texto nuevo sustituye al anterior de esa fuente y ves «Updated» con el nombre del archivo. Haz clic en Train agent para usarlo. Hasta entonces, el agente responde con la versión anterior.
- El archivo es idéntico: se omite con «Skipped 1 unchanged file» (archivo sin cambios omitido).
Un archivo con otro nombre se añade como fuente nueva, así que elimina tú la versión desfasada. Consulta Gestionar fuentes.
Consejos
- Revisa el texto extraído. Abre la vista previa del archivo con el icono del ojo en la lista de fuentes. Si ahí falta algo, el agente no puede saberlo. Las tablas y los diseños a varias columnas merecen un vistazo.
- Usa nombres de archivo descriptivos. El nombre del archivo se convierte en el título de la fuente y se indexa con cada fragmento:
gastos-envio-2026.pdfayuda más quescan_0042.pdf. - Divide los documentos largos por temas. Los archivos separados son más fáciles de actualizar, priorizar o eliminar de uno en uno.
- Mantén estables los nombres de archivo. Volver a subir
precios.pdfactualiza la fuente existente, mientras queprecios-v2.pdfse añade junto a ella. Dos versiones de la misma lista de precios dan respuestas incoherentes, así que elimina las antiguas. - Mejor el documento original que un PDF exportado. Un archivo de Word o Excel suele conservar las tablas más limpias que un PDF generado a partir de él.