# Importer des fichiers pour entraîner votre agent IA

> Importez des fichiers PDF, Word, PowerPoint, Excel, CSV, EPUB, texte et Markdown dans un agent intoCHAT : limites de taille et de caractères, extraction.

Importez les documents que votre site ne couvre pas, comme des grilles tarifaires, des manuels, des fiches produit ou des conditions générales. intoCHAT en extrait le texte, et chaque fichier devient une source à part entière.

## Importer des fichiers

1. Ouvrez l'onglet **Knowledge** (connaissances) de l'agent et choisissez **Files** (fichiers) sous **Add knowledge**.
2. Déposez des fichiers sur la zone d'import, ou cliquez dessus pour les choisir. Vous pouvez en sélectionner plusieurs à la fois ; ils sont lus l'un après l'autre.
3. Une fois les fichiers ajoutés, cliquez sur **Train agent** en haut de l'onglet.

Les fichiers de plus de 4 Mo sont d'abord envoyés, avec une barre de progression, puis lus.

## Formats pris en charge

| Type | Extensions |
|---|---|
| PDF | `.pdf` |
| Word | `.doc`, `.docx`, `.docm` |
| PowerPoint | `.ppt`, `.pptx`, `.pptm`, `.pps`, `.ppsx`, `.ppsm`, `.pot` |
| Excel | `.xls`, `.xlsx`, `.xlsm`, `.xlsb` |
| OpenDocument | `.odt`, `.ods`, `.odp` |
| Autres documents | `.rtf`, `.epub`, `.csv` |
| Texte brut | `.txt`, `.md`, `.markdown` |

## Limites

- **Taille de fichier** : jusqu'à 50 Mo par fichier.
- **Texte par fichier** : jusqu'à 4 Mo de texte extrait. Un fichier plus volumineux échoue avec un message vous invitant à le diviser.
- **Caractères par agent** : l'ensemble des sources d'un agent peut contenir jusqu'à 100K caractères avec l'offre Free, 500K avec Starter et 1M avec Pro. Si un fichier dépasse la limite, l'import s'arrête là et les fichiers suivants ne sont pas ajoutés.

C'est la longueur du texte extrait qui compte, pas la taille du fichier. Un gros PDF rempli de photos peut ne contenir que quelques milliers de caractères, alors qu'un petit tableur peut en contenir bien plus.

## Ce qui est extrait

Les documents sont convertis en Markdown. Les titres, paragraphes, listes et tableaux sont conservés, ce qui aide intoCHAT à les découper en passages cohérents. Les fichiers texte et Markdown sont lus tels quels.

Ne sont pas extraits :

- **Les scans et les images.** Il n'y a pas de reconnaissance de texte (OCR). Un PDF scanné sans couche de texte échoue avec un message qui l'indique. Passez-le d'abord dans un logiciel d'OCR, ou collez le texte comme [extrait de texte](/fr/docs/text-and-qa).
- **Le texte contenu dans des images**, comme les graphiques, schémas ou captures d'écran.
- **Les fichiers protégés par mot de passe.** Retirez le mot de passe et importez de nouveau le fichier.

intoCHAT conserve le texte extrait, pas le fichier d'origine. Les fichiers volumineux sont supprimés du stockage temporaire dès qu'ils ont été lus.

## Mettre à jour un fichier

Pour mettre à jour un fichier, importez la nouvelle version sous le même nom de fichier. Inutile de supprimer d'abord l'ancienne source :

- **Le contenu a changé** : le nouveau texte remplace l'ancien texte de cette source, et vous voyez « Updated » suivi du nom du fichier. Cliquez sur **Train agent** pour l'utiliser. D'ici là, l'agent répond à partir de la version précédente.
- **Le fichier est identique** : il est ignoré avec le message « Skipped 1 unchanged file ».

Un fichier portant un autre nom est ajouté comme nouvelle source : supprimez vous-même l'ancienne. Voir [Gérer les sources](/fr/docs/managing-sources).

> Tout ce qui figure dans les connaissances de l'agent peut se retrouver dans une réponse. Écartez les notes internes, les données personnelles et tout ce que vous ne publieriez pas sur votre site.

## Conseils

- **Vérifiez le texte extrait.** Ouvrez l'aperçu du fichier avec l'icône en forme d'œil dans la liste des sources. Ce qui manque là, l'agent ne peut pas le savoir. Les tableaux et les mises en page sur plusieurs colonnes méritent un coup d'œil.
- **Donnez des noms de fichiers parlants.** Le nom du fichier devient le titre de la source et est indexé avec chaque passage : `tarifs-livraison-2026.pdf` aide plus que `scan_0042.pdf`.
- **Découpez les longs documents par thème.** Des fichiers séparés se mettent à jour, se priorisent ou se suppriment plus facilement un par un.
- **Gardez des noms de fichiers stables.** Importer de nouveau `tarifs.pdf` met à jour la source existante, alors que `tarifs-v2.pdf` s'ajoute à côté. Deux versions d'une même grille tarifaire donnent des réponses incohérentes : supprimez les versions obsolètes.
- **Préférez le document d'origine à un export PDF.** Un fichier Word ou Excel conserve souvent mieux les tableaux qu'un PDF qui en est issu.
