Fine-tuning

Stil, Struktur und Urteil mit Beispielen trainieren.

Knowledge trainiert Fakten. Fine-tuning trainiert Verhalten.

Trainingsbeispiele
Canvas, in dem Beispiele mit Modell verbunden sind.

Beispiele müssen freigegeben sein. Keine rohen Quellen als Beispiele verwenden.

Nutzen, wenn

  • Fakten stimmen, Ton nicht
  • stabiles Format nötig ist
  • Assistent gute Antworten nachahmen soll
  • ähnliche Prompts uneinheitlich beantwortet werden

Workflow

  1. Echte Prompts und freigegebene Antworten sammeln.
  2. Widersprüchliche Beispiele entfernen.
  3. Generierte Beispiele vor Training prüfen.
  4. Training starten.
  5. Vorher/nachher im Playground vergleichen.

Weiterlesen

Playground und Tests

Auf dieser Seite