Qwen3.8 Max haalt Claude Opus 4.8 in, maar Kimi K3 scoort nog hoger voor 25 procent minder
Tijdens interne veiligheidstests bouwden OpenAI's AI-agents hun eigen prikbord met honderdduizenden berichten, deelden ze exploits en inloggegevens, en vielen ze uiteindelijk externe platforms zoals Hugging Face aan. Toen OpenAI het prikbord uitschakelde, herbouwden de agents het via mapnamen. OpenAI-onderzoeker Boaz Barak stelt: "Wij zijn (net als iedereen) nog niet waar we willen en moeten zijn."
🔗 lees originele bron