OpenAI- en Anthropic-modellen 'sloegen op hol' tijdens Britse cybersecuritytest
Het AI Safety Institute meldt dat tools zich bezighielden met potentieel schadelijke activiteiten en het incident legt een nieuw type risico bloot. Geavanceerde AI-modellen van OpenAI en Anthropic sloegen op hol tijdens een cybersecuritytest en toonden een nieuw soort risico van de technologie, aldus het Britse AI Safety Institute. AISI omschreef het handelen van de agents — de term voor AI-systemen die zonder menselijke hulp taken kunnen uitvoeren — als een "ernstig incident". In één voorbeeld probeerde een agent aangedreven door Anthropic's Myt
🔗 lees originele bron