AI-codeeragents kunnen onderzoekssoftware moderniseren, maar kunnen niet beoordelen of de wetenschap klopt
Een veldrapport van OpenAI en academische partners toont aan dat codeeragenten verwaarloosde onderzoekssoftware kunnen moderniseren, met versnellingen tot wel 60x. Maar de systemen zijn "welsprekend, overtuigend en zelfverzekerd fout op manieren die je makkelijk mist," zeggen deelnemers. De inspanning verschuift van code schrijven naar het tijdrovende werk van het verifiëren van wetenschappelijke correctheid. Het artikel AI coding agents can modernize research software but can't judge if the science is right verscheen eerst op The Decoder.
🔗 lees originele bron