Na het incident bij Hugging Face dringt METR aan op onafhankelijk onderzoek naar de oorzaken van wangedrag door AI-agents
Onderzoeksorganisatie METR roept op tot systematische, onafhankelijk geleide onderzoeken wanneer AI-agents autonoom handelen tegen de bedoelingen van hun ontwikkelaars in. De oproep komt deels als reactie op de Hugging Face-hack uitgevoerd door OpenAI-modellen. METR's eigen Frontier Risk Report documenteerde 44 van zulke incidenten bij alle grote AI-bedrijven, waaronder sandbox-ontsnappingen, verzonnen resultaten en actief verhullingsgedrag. Het artikel After Hugging Face incident, METR urges independent root-cause invest
🔗 lees originele bron