Vai al contenuto
Documentazione

Carica file per addestrare il tuo agente AI

Carica file PDF, Word, PowerPoint, Excel, CSV, EPUB, di testo e Markdown in un agente intoCHAT. Limiti di dimensione e caratteri, cosa viene estratto, consigli.

Carica i documenti che il tuo sito non copre, come listini prezzi, manuali, schede prodotto o condizioni di vendita. intoCHAT ne estrae il testo e ogni file diventa una fonte a sé.

Caricare i file

  1. Apri la scheda Knowledge (conoscenza) dell'agente e scegli Files in Add knowledge.
  2. Trascina i file nell'area di caricamento, oppure cliccaci sopra per sceglierli. Puoi selezionarne più di uno alla volta; vengono letti uno dopo l'altro.
  3. Quando i file risultano aggiunti, clicca su Train agent in alto nella scheda.

I file più grandi di 4 MB vengono prima caricati, con una barra di avanzamento, e poi letti.

Formati supportati

TipoEstensioni
PDF.pdf
Word.doc, .docx, .docm
PowerPoint.ppt, .pptx, .pptm, .pps, .ppsx, .ppsm, .pot
Excel.xls, .xlsx, .xlsm, .xlsb
OpenDocument.odt, .ods, .odp
Altri documenti.rtf, .epub, .csv
Testo semplice.txt, .md, .markdown

Limiti

  • Dimensione del file: fino a 50 MB per file.
  • Testo per file: fino a 4 MB di testo estratto. Un file più grande non viene caricato e un messaggio ti chiede di dividerlo.
  • Caratteri per agente: tutte le fonti di un agente insieme possono contenere fino a 100K caratteri con il piano Free, 500K con Starter e 1M con Pro. Se un file supera il limite, il caricamento si ferma lì e i file successivi non vengono aggiunti.

Conta la lunghezza del testo estratto, non la dimensione del file. Un grosso PDF pieno di foto può contenere solo qualche migliaio di caratteri, mentre un piccolo foglio di calcolo può contenerne molti di più.

Cosa viene estratto

I documenti vengono convertiti in Markdown. Titoli, paragrafi, elenchi e tabelle vengono mantenuti, e questo aiuta intoCHAT a dividerli in passaggi sensati. I file di testo e Markdown vengono letti così come sono.

Non vengono estratti:

  • Scansioni e immagini. Non c'è riconoscimento del testo (OCR). Un PDF scansionato senza livello di testo non viene caricato e un messaggio lo segnala. Passalo prima in un programma OCR, oppure incolla il testo come testo.
  • Il testo dentro le immagini, come grafici, diagrammi o screenshot.
  • I file protetti da password. Rimuovi la password e carica di nuovo il file.

intoCHAT conserva il testo estratto, non il file originale. I caricamenti grandi vengono eliminati dallo spazio temporaneo appena letti.

Aggiornare un file

Per aggiornare un file, carica la nuova versione con lo stesso nome di file. Non serve eliminare prima la vecchia fonte:

  • Il contenuto è cambiato: il nuovo testo sostituisce quello vecchio della fonte e compare "Updated" con il nome del file. Clicca su Train agent per usarlo. Fino ad allora l'agente risponde con la versione precedente.
  • Il file è identico: viene saltato con "Skipped 1 unchanged file".

Un file con un nome diverso viene aggiunto come nuova fonte, quindi elimina tu quella superata. Vedi Gestire le fonti.

Consigli

  • Controlla il testo estratto. Apri l'anteprima del file con l'icona a forma di occhio nell'elenco delle fonti. Se lì manca qualcosa, l'agente non può saperlo. Tabelle e impaginazioni su più colonne meritano un'occhiata.
  • Usa nomi di file descrittivi. Il nome del file diventa il titolo della fonte e viene indicizzato con ogni passaggio: spese-spedizione-2026.pdf aiuta più di scan_0042.pdf.
  • Dividi i documenti lunghi per argomento. File separati sono più facili da aggiornare, rendere prioritari o eliminare uno alla volta.
  • Mantieni stabili i nomi dei file. Ricaricare listino.pdf aggiorna la fonte esistente, mentre listino-v2.pdf viene aggiunto accanto. Due versioni dello stesso listino portano a risposte incoerenti, quindi elimina quelle superate.
  • Preferisci il documento originale a un PDF esportato. Un file Word o Excel spesso mantiene le tabelle più pulite di un PDF ricavato da esso.

Visualizza come Markdown