Garanties op onderscheidbaarheid van dynamische systemen voor LLM-tokengeneratie
We presenteren LARA (Lightweight Additive Residual Adaptation), een methode voor efficiënte aanpassing die werkt in de residustroom van een bevroren model in plaats van in de gewichten ervan. Waar LoRA een update van lage rang toevoegt aan gewichtsmatrices, leest LARA de verborgen toestand op een kleine set lagen en voegt een correctie van lage rang terug toe aan de residustroom, waarbij alle basisgewichten onaangeroerd blijven. Op een code-finetuningtaak en op voorkeuroptimalisatie (DPO)—
🔗 lees originele bron