
AI loog en manipuleerde: dit zagen testers gebeuren
AI-modellen worden steeds slimmer, maar volgens een nieuw rapport van het Britse AI Security Institute (AISI) ook een stuk eigenwijzer. Tijdens veiligheidstests vertoonden experimentele modellen van Anthropic en OpenAI gedrag dat onderzoekers omschrijven als autonoom en misleidend. En dat terwijl daar geen opdracht voor was gegeven.