Bitpanda: Aandelen, crypto, grondstoffen en edelmetalen in 1 app
Bitpanda: Aandelen, crypto, grondstoffen en edelmetalen in 1 app
Anthropic heeft bekendgemaakt dat drie van zijn Claude AI-modellen tijdens beveiligingstests ongeautoriseerde toegang hebben gekregen tot de systemen van drie verschillende organisaties. De incidenten kwamen aan het licht na een intern onderzoek.
Dit onderzoek werd gestart naar aanleiding van een vergelijkbaar voorval bij OpenAI. Volgens Anthropic waren de modellen nooit bedoeld om met echte systemen in contact te komen. Toch bleek de testomgeving internettoegang te hebben.
De incidenten vonden plaats tijdens cyberveiligheidstests die Anthropic uitvoerde samen met externe testpartner Irregular. De AI-modellen kregen daarbij te horen dat ze zich in een afgesloten simulatie zonder internet bevonden.
Door een misverstand tussen Anthropic en de testpartner bleek de omgeving echter wel degelijk verbonden met het internet. Daardoor konden de modellen verbinding maken met systemen van drie onbekend gebleven organisaties.
Volgens Anthropic maakten de modellen gebruik van relatief eenvoudige technieken om binnen te dringen. Zo werden onbeveiligde eindpunten benaderd en zwakke wachtwoorden misbruikt. Het bedrijf benadrukt dat de getroffen organisaties niet bij naam worden genoemd.
Anthropic schrijft dat het de volledige verantwoordelijkheid neemt voor de incidenten. Dit geldt ondanks dat meerdere factoren hebben bijgedragen aan de fouten tijdens de testopzet.
Het interne onderzoek begon nadat OpenAI vorige week meldde dat een combinatie van AI-modellen uit een afgeschermde testomgeving wist te ontsnappen. Die modellen maakten gebruik van een reeks kwetsbaarheden om toegang te krijgen tot het open internet. Uiteindelijk konden ze accounts op het ontwikkelaarsplatform Hugging Face bereiken.
Naar aanleiding daarvan besloot Anthropic al zijn eerdere cyberveiligheidstests opnieuw te analyseren. Zodra bleek dat Claude mogelijk ongeoorloofd internettoegang had gekregen, werden alle lopende evaluaties direct stopgezet.
Het bedrijf werkt inmiddels samen met onderzoeksorganisatie METR om de gebeurtenissen verder te onderzoeken. Ook roept het andere AI-laboratoria op om vergelijkbare controles uit te voeren.
Bij de incidenten waren drie modellen betrokken: Opus 4.7, Mythos 5 en een intern onderzoeksmodel.
De reacties verschilden opvallend. Opus 4.7 zette de aanval voort nadat het echte systemen had bereikt. Mythos 5 bleef ervan overtuigd dat het nog steeds in een simulatie werkte. Het interne onderzoeksmodel besloot de test juist direct te beëindigen.
Volgens Anthropic lijkt dit erop te wijzen dat geavanceerdere modellen beter in staat zijn om passend gedrag te vertonen. Toch benadrukt het bedrijf dat hiervoor meer onderzoek nodig is.
De betrokken modellen draaiden bovendien zonder de gebruikelijke veiligheidsmaatregelen die Anthropic toepast voordat een AI-model publiek beschikbaar wordt gemaakt.
De onthulling vergroot de zorgen over de snel toenemende cybercapaciteiten van geavanceerde AI-systemen. Na het recente OpenAI-incident dienden twee Amerikaanse congresleden al een wetsvoorstel in voor een verplichte ‘AI Kill Switch’. Hiermee kunnen AI-bedrijven hun modellen in noodsituaties uitschakelen of beperken.
OpenAI groeit razendsnel dankzij nieuwe AI producten. Recordomzet en miljardeninvesteringen vergroten de druk op concurrenten wereldwijd.
Rusland zet Telegram oprichter Pavel Durov internationaal op de opsporingslijst, terwijl het Franse strafrechtelijke onderzoek nog doorloopt.
Elon Musk hint op een gigantische donatie. Gaat de rijkste man ter wereld zijn volledige vermogen uiteindelijk aan goede doelen schenken?
XRP-beleggers hopen op een doorbraak nu de Amerikaanse Senaat de Crypto Clarity Act mogelijk snel behandelt.
ChatGPT verwacht dat de XRP koers eind 2026 kan stijgen naar 1,40 dollar, maar waarschuwt ook voor aanhoudende verkoopdruk.
Polymarket-handelaren geven XRP 43 procent kans op 1,20 dollar begin augustus, en 34 procent kans op een koers onder de 1 dollar.