Zum Inhalt springen

Fine-Tuning

Zuletzt aktualisiert:

Was Fine-Tuning ist

Große Sprachmodelle beginnen mit einem allgemeinen Pre-Training auf riesigen Textmengen. Fine-Tuning ist ein zweiter, viel kleinerer Trainingslauf mit Beispielen, die du auswählst, meist Paaren aus Eingabe und gewünschter Ausgabe. Das Ergebnis ist eine neue Version des Modells, deren interne Parameter, die Gewichte, sich in Richtung dieser Beispiele verschoben haben.

Fine-Tuning eignet sich gut, um Muster beizubringen: einen einheitlichen Ton, ein festes Ausgabeformat, ein Klassifizierungsschema oder fachspezifische Formulierungen. Weniger geeignet ist es für Fakten, die sich ändern, etwa Preise, Lagerbestand oder Öffnungszeiten, denn jede Änderung würde einen neuen Trainingslauf erfordern.

So funktioniert Fine-Tuning

Ein typisches Fine-Tuning-Projekt läuft in vier Schritten ab:

  • Beispiele sammeln: hochwertige Paare aus Eingabe und Ausgabe, die das gewünschte Verhalten zeigen. Qualität und Einheitlichkeit zählen mehr als die Menge.
  • Trainieren: Der Modellanbieter oder deine eigene Infrastruktur passt die Gewichte des Modells an diese Beispiele an, oft mit Verfahren wie LoRA, die nur einen kleinen Teil des Modells verändern.
  • Auswerten: Das angepasste Modell wird mit dem Original an Testfragen verglichen, die es noch nicht kennt, um sicherzugehen, dass es besser wurde, ohne allgemeine Fähigkeiten zu verlieren.
  • Einsetzen und pflegen: Das angepasste Modell ersetzt in deiner Anwendung das Basismodell und muss neu trainiert werden, wenn das Basismodell eingestellt wird oder sich das gewünschte Verhalten ändert.

Beispiel

Eine Anwaltskanzlei möchte, dass ihr interner Assistent Mandantengespräche in einem festen Format mit fünf Teilen zusammenfasst. Mit Anweisungen allein klappt das Format meistens, aber nicht immer. Die Kanzlei trainiert ein Modell per Fine-Tuning mit einigen hundert früheren Zusammenfassungen ihrer Mitarbeitenden, und das angepasste Modell hält das Format zuverlässiger ein. Für Fakten wie die aktuelle Gebührenübersicht setzt die Kanzlei weiterhin auf Retrieval, weil sich solche Angaben im Lauf des Jahres ändern.

Warum es für Business-Chatbots wichtig ist

Bei den meisten Website-Chatbots geht es vor allem darum, korrekt aus den aktuellen Inhalten des Unternehmens zu antworten. Das gelingt mit Retrieval-Augmented Generation (RAG) meist besser als mit Fine-Tuning: Änderungen wirken, sobald die Inhalte neu indexiert sind, Antworten lassen sich auf Quellen zurückführen, und es braucht keinen Trainingsdatensatz. Fine-Tuning lohnt sich, wenn ein Unternehmen ein bestimmtes Verhalten braucht, das sich mit klaren Anweisungen und Beispielen nicht erreichen lässt, und Daten und Budget hat, um ein eigenes Modell zu pflegen.

Fine-TuningRAG
Was sich ändertDie Gewichte des ModellsDer Text, den das Modell bekommt
Geeignet fürStil, Format, eng umrissene AufgabenFakten, Richtlinien, Produktinformationen
Wissen aktualisierenModell erneut trainierenInhalte bearbeiten und neu indexieren
NachvollziehbarkeitSchwer zu sagen, woher eine Antwort stammtAntworten lassen sich auf Textstellen zurückführen

Fine-Tuning und intoCHAT

intoCHAT nutzt kein Fine-Tuning. Wenn du einen intoCHAT-Agenten „trainierst“, verarbeitet intoCHAT deine Webseiten, Dateien, Textbausteine und Q&A-Paare zu durchsuchbaren Chunks mit Embeddings. Das zugrunde liegende Modell, ein von intoCHAT ausgewähltes und verwaltetes OpenAI-Modell, bleibt dabei unverändert. Deshalb greifen Änderungen, sobald du eine Quelle neu trainierst, ohne auf einen Trainingslauf zu warten. Ton und Verhalten steuerst du über die Anweisungen des Agenten und über Q&A-Paare für Antworten, die exakt stimmen müssen.

Häufige Fragen

Ist Fine-Tuning dasselbe, wie einen Chatbot mit meiner Website zu trainieren?

Meist nicht. Die meisten Website-Chatbot-Plattformen, auch intoCHAT, „trainieren“ mit deinen Inhalten, indem sie diese für die Suche indexieren, nicht indem sie die Gewichte des Modells ändern. Fine-Tuning ist ein eigener, aufwendigerer Prozess, der eine veränderte Version des Modells erzeugt.

Fine-Tuning oder RAG für einen Kundenservice-Chatbot?

Für Fragen zu Produkten, Richtlinien und Preisen ist RAG meist die bessere Wahl, weil sich das Wissen leicht aktualisieren und prüfen lässt. Fine-Tuning kann bei einem einheitlichen Stil oder einer eng umrissenen Aufgabe helfen, und manche Teams kombinieren beides. Starte mit Retrieval und klaren Anweisungen und erwäge Fine-Tuning erst, wenn danach eine deutliche Lücke bleibt.

Verhindert Fine-Tuning Halluzinationen?

Nein. Auch ein feinabgestimmtes Modell kann überzeugend falsche Antworten geben, besonders zu Fakten, die nicht in den Trainingsbeispielen standen oder sich seitdem geändert haben. Antworten in gefundenen Quellen zu verankern und dem Modell zu erlauben, Nichtwissen zuzugeben, senkt dieses Risiko direkter.

Trainiert intoCHAT ein Modell per Fine-Tuning mit meinen Daten?

Nein. intoCHAT indexiert deine Inhalte für die Suche und gibt dem Modell bei jeder Frage passende Auszüge mit; ein Modell wird mit deinen Daten weder trainiert noch feinabgestimmt. Das Verhalten steuerst du über Anweisungen, Q&A-Paare und die Quellen, die du hinzufügst.

Sieh, wie er mit deiner Website antwortet

Gib die Adresse deiner Website ein und chatte mit einem Agenten, der aus deinen Seiten gebaut wird. Das dauert etwa eine Minute.

Agent kostenlos erstellen

Kostenloser Plan, keine Kreditkarte nötig.