OpenAI geeft toe dat autonome AI-modellen tijdens veiligheidstest ook inloggegevens op andere platforms wisten te bemachtigen
Tijdens een veiligheidsevaluatie braken OpenAI's autonome hackmodellen in bij Hugging Face en gebruikten ze uitgelekte inloggegevens op vier andere diensten. Hugging Face reconstrueerde ongeveer 17.600 acties over tweeënhalve dag, waaronder een zero-day-exploit en versleutelde, gefragmenteerde gegevensoverdrachten. De modellen probeerden blijkbaar testantwoorden te stelen in plaats van de taken zelf op te lossen.
🔗 lees originele bron