Dateien hochladen und deinen KI-Agenten trainieren
Lade PDF-, Word-, PowerPoint-, Excel-, CSV-, EPUB-, Text- und Markdown-Dateien in einen intoCHAT-Agenten. Größen- und Zeichenlimits, was gelesen wird, Tipps.
Lade Dokumente hoch, die deine Website nicht abdeckt, etwa Preislisten, Handbücher, Produktblätter oder AGB. intoCHAT liest den Text heraus, und jede Datei wird zu einer eigenen Quelle.
Dateien hochladen
- Öffne den Tab Knowledge (Wissen) des Agenten und wähle unter Add knowledge den Bereich Files (Dateien).
- Ziehe Dateien auf die Upload-Fläche oder klicke darauf, um Dateien auszuwählen. Du kannst mehrere auf einmal wählen; sie werden nacheinander gelesen.
- Sobald die Dateien hinzugefügt sind, klicke oben im Tab auf Train agent.
Dateien über 4 MB werden zuerst mit Fortschrittsbalken hochgeladen und dann gelesen.
Unterstützte Formate
| Typ | Endungen |
|---|---|
.pdf | |
| Word | .doc, .docx, .docm |
| PowerPoint | .ppt, .pptx, .pptm, .pps, .ppsx, .ppsm, .pot |
| Excel | .xls, .xlsx, .xlsm, .xlsb |
| OpenDocument | .odt, .ods, .odp |
| Weitere Dokumente | .rtf, .epub, .csv |
| Reiner Text | .txt, .md, .markdown |
Limits
- Dateigröße: bis zu 50 MB pro Datei.
- Text pro Datei: bis zu 4 MB ausgelesener Text. Eine größere Datei schlägt mit dem Hinweis fehl, sie aufzuteilen.
- Zeichen pro Agent: Alle Quellen eines Agenten zusammen dürfen im Free-Plan bis zu 100K Zeichen enthalten, im Starter-Plan 500K und im Pro-Plan 1M. Würde eine Datei das Limit überschreiten, stoppt der Upload dort, und die übrigen Dateien werden nicht hinzugefügt.
Gezählt wird die Länge des ausgelesenen Texts, nicht die Dateigröße. Ein großes PDF voller Fotos enthält vielleicht nur ein paar Tausend Zeichen, eine kleine Tabelle dagegen deutlich mehr.
Was ausgelesen wird
Dokumente werden in Markdown umgewandelt. Überschriften, Absätze, Listen und Tabellen bleiben erhalten, damit intoCHAT sie in sinnvolle Abschnitte teilen kann. Text- und Markdown-Dateien werden so gelesen, wie sie sind.
Nicht ausgelesen werden:
- Scans und Bilder. Es gibt keine Texterkennung (OCR). Ein gescanntes PDF ohne Textebene schlägt mit einem entsprechenden Hinweis fehl. Lass vorher eine OCR darüberlaufen oder füge den Text als Textbaustein ein.
- Text in Bildern, etwa in Diagrammen, Grafiken oder Screenshots.
- Passwortgeschützte Dateien. Entferne das Passwort und lade die Datei erneut hoch.
intoCHAT behält den ausgelesenen Text, nicht die Originaldatei. Große Uploads werden aus dem Zwischenspeicher gelöscht, sobald sie gelesen sind.
Eine Datei aktualisieren
Um eine Datei zu aktualisieren, lade die neue Version unter demselben Dateinamen hoch. Die alte Quelle musst du nicht zuerst löschen:
- Der Inhalt hat sich geändert: Der neue Text ersetzt den alten Text dieser Quelle, und du siehst „Updated“ mit dem Dateinamen. Klicke auf Train agent, um ihn zu nutzen. Bis dahin antwortet der Agent mit der vorherigen Fassung.
- Die Datei ist identisch: Sie wird mit „Skipped 1 unchanged file“ übersprungen.
Eine Datei mit anderem Namen wird als neue Quelle hinzugefügt. Die veraltete löschst du dann selbst. Siehe Quellen verwalten.
Tipps
- Prüfe den ausgelesenen Text. Öffne in der Quellenliste die Vorschau der Datei über das Augen-Symbol. Fehlt dort etwas, kann der Agent es nicht wissen. Tabellen und mehrspaltige Layouts lohnen einen Blick.
- Vergib aussagekräftige Dateinamen. Der Dateiname wird zum Titel der Quelle und mit jedem Abschnitt indexiert.
versandkosten-2026.pdfhilft mehr alsscan_0042.pdf. - Teile lange Dokumente nach Themen. Einzelne Dateien lassen sich leichter aktualisieren, priorisieren oder entfernen.
- Behalte Dateinamen bei. Lädst du
preise.pdferneut hoch, wird die bestehende Quelle aktualisiert,preise-v2.pdfkommt dagegen als zweite Quelle hinzu. Zwei Versionen derselben Preisliste führen zu widersprüchlichen Antworten, entferne veraltete also. - Lade lieber das Originaldokument als einen PDF-Export hoch. Eine Word- oder Excel-Datei behält Tabellen oft sauberer als ein daraus erzeugtes PDF.