Gedeelde SFT-lessen uit alignment, modelorganismen en speelgoedmodellen
Alignment-training, modelorganismen en speelgoedmodellen worden doorgaans als aparte onderzoeksgebieden behandeld, maar projecten in alledrie gebruiken vaak supervised fine-tuning voor dezelfde onderliggende doelen — en wanneer projecten een doel delen, zouden we moeten toetsen of lessen uit het ene gebied overdraagbaar zijn naar de andere; de onderzoekers bestuderen drie zulke overdrachten, waarbij telkens een les uit één SFT-context in een andere wordt getest.
🔗 lees originele bron