Fine-tuning
Stil, Struktur und Urteil mit Beispielen trainieren.
Knowledge trainiert Fakten. Fine-tuning trainiert Verhalten.
Beispiele müssen freigegeben sein. Keine rohen Quellen als Beispiele verwenden.
Nutzen, wenn
- Fakten stimmen, Ton nicht
- stabiles Format nötig ist
- Assistent gute Antworten nachahmen soll
- ähnliche Prompts uneinheitlich beantwortet werden
Workflow
- Echte Prompts und freigegebene Antworten sammeln.
- Widersprüchliche Beispiele entfernen.
- Generierte Beispiele vor Training prüfen.
- Training starten.
- Vorher/nachher im Playground vergleichen.
