← terug naar overzicht

Google-onderzoekers vinden een manier om zelfverbeterende AI-agents te stoppen met het uit hun hoofd leren van hun tests

analyse 📅 2026-10-04
Zelfverbeterende AI-agenten hebben de neiging hun testtaken uit het hoofd te leren, waardoor hun winst op nieuwe taken afneemt of verdwijnt. RRSI, een nieuwe methode van Google-onderzoekers, beteugelt dit effect en tilt de scores op ongeziene benchmarks met wel 4,7 punten op, terwijl het ongeveer 30 procent minder tokens gebruikt dan een niet-geregulariseerde versie.

🔗 lees originele bron