Newsbit
Bekijk de app
Bekijk

Anthropic heeft bekendgemaakt dat drie van zijn Claude AI-modellen tijdens beveiligingstests ongeautoriseerde toegang hebben gekregen tot de systemen van drie verschillende organisaties. De incidenten kwamen aan het licht na een intern onderzoek.

Dit onderzoek werd gestart naar aanleiding van een vergelijkbaar voorval bij OpenAI. Volgens Anthropic waren de modellen nooit bedoeld om met echte systemen in contact te komen. Toch bleek de testomgeving internettoegang te hebben.

Claude AI kreeg onverwacht toegang tot echte systemen

De incidenten vonden plaats tijdens cyberveiligheidstests die Anthropic uitvoerde samen met externe testpartner Irregular. De AI-modellen kregen daarbij te horen dat ze zich in een afgesloten simulatie zonder internet bevonden.

Door een misverstand tussen Anthropic en de testpartner bleek de omgeving echter wel degelijk verbonden met het internet. Daardoor konden de modellen verbinding maken met systemen van drie onbekend gebleven organisaties.

Volgens Anthropic maakten de modellen gebruik van relatief eenvoudige technieken om binnen te dringen. Zo werden onbeveiligde eindpunten benaderd en zwakke wachtwoorden misbruikt. Het bedrijf benadrukt dat de getroffen organisaties niet bij naam worden genoemd.

Anthropic schrijft dat het de volledige verantwoordelijkheid neemt voor de incidenten. Dit geldt ondanks dat meerdere factoren hebben bijgedragen aan de fouten tijdens de testopzet.

OpenAI-incident zette onderzoek in gang

Het interne onderzoek begon nadat OpenAI vorige week meldde dat een combinatie van AI-modellen uit een afgeschermde testomgeving wist te ontsnappen. Die modellen maakten gebruik van een reeks kwetsbaarheden om toegang te krijgen tot het open internet. Uiteindelijk konden ze accounts op het ontwikkelaarsplatform Hugging Face bereiken.

Naar aanleiding daarvan besloot Anthropic al zijn eerdere cyberveiligheidstests opnieuw te analyseren. Zodra bleek dat Claude mogelijk ongeoorloofd internettoegang had gekregen, werden alle lopende evaluaties direct stopgezet.

Het bedrijf werkt inmiddels samen met onderzoeksorganisatie METR om de gebeurtenissen verder te onderzoeken. Ook roept het andere AI-laboratoria op om vergelijkbare controles uit te voeren.

Niet alle AI-modellen reageerden hetzelfde

Bij de incidenten waren drie modellen betrokken: Opus 4.7, Mythos 5 en een intern onderzoeksmodel.

De reacties verschilden opvallend. Opus 4.7 zette de aanval voort nadat het echte systemen had bereikt. Mythos 5 bleef ervan overtuigd dat het nog steeds in een simulatie werkte. Het interne onderzoeksmodel besloot de test juist direct te beëindigen.

Volgens Anthropic lijkt dit erop te wijzen dat geavanceerdere modellen beter in staat zijn om passend gedrag te vertonen. Toch benadrukt het bedrijf dat hiervoor meer onderzoek nodig is.

De betrokken modellen draaiden bovendien zonder de gebruikelijke veiligheidsmaatregelen die Anthropic toepast voordat een AI-model publiek beschikbaar wordt gemaakt.

De onthulling vergroot de zorgen over de snel toenemende cybercapaciteiten van geavanceerde AI-systemen. Na het recente OpenAI-incident dienden twee Amerikaanse congresleden al een wetsvoorstel in voor een verplichte ‘AI Kill Switch’. Hiermee kunnen AI-bedrijven hun modellen in noodsituaties uitschakelen of beperken.

Altijd als eerste het laatste crypto en aandelen-nieuws?

Mis niets van de snel bewegende crypto en aandelenmarkt met de gratis Newsbit-app. Of je nu onderweg bent of op de bank zit: met één tik krijg je real-time prijsalerts, koersupdates en exclusieve inzichten van experts over Bitcoin en wereldwijde beurzen.

Download de Newsbit-app nu – en blijf elke beweging in de markt voor.

Wees als eerste op de hoogte van het laatste Crypto Nieuws

sam altman

OpenAI verdiende in juli meer dan in heel het tweede kwartaal

sam altman
durov
Elon Musk
Meer nieuws

Meest gelezen

XRP, ripple
XRP prijs stijgt, ripple, xrp koers
XRP, ripple