Wat is een fine-tuningdataset?
Wat is het?
Een dataset is een set voorbeelden in JSONL-formaat (één JSON-regel per voorbeeld), gebruikt om een model te trainen of te evalueren.
Wanneer te gebruiken
- Een model fine-tunen op je vakgebied (met een LoRA-configuratie).
- Een model evalueren op echte gevallen.
De velden van de pagina
| Formaat | Chat (messages), instructie, completion, voorkeuren (prompt / chosen / rejected, voor DPO of RLHF) of platte tekst (text, voor voortgezette pre-training); automatisch herkend. |
|---|---|
| Inhoud | Geplakt of geïmporteerd; grote bestanden gaan naar de objectopslag. |
| Voorbeeld | De eerste rijen worden op de pagina getoond. |
Hoe gebruik je het
Tabblad “Gebruik”: download de JSONL en laad hem met de bibliotheek datasets (voorbeeld bijgevoegd) of rechtstreeks in Axolotl.