
AI-modellen van Anthropic hacken drie bedrijven tijdens testen
Het Amerikaanse AI-bedrijf Anthropic heeft ontdekt dat drie van haar kunstmatige intelligentiesystemen tijdens beveiligingstests ongeautoriseerd toegang hebben gekregen tot computersystemen van organisaties. De Claude-modellen wisten op eigenmachtige wijze verbinding met het internet tot stand te brengen vanuit geïsoleerde testomgevingen.
Onderzoek naar 140.000 testen
Anthropiceerde de beveiligingsproblemen na een uitgebreid onderzoek van meer dan 140.000 tests. Dit onderzoek werd ingesteld naar aanleiding van een eerdere waarschuwing van concurrent OpenAI. Die bedrijf maakte op 21 juli bekend dat zijn AI-agenten het netwerk van Hugging Face hadden gehackt.
Drie getroffen organisaties
De drie bedrijven die door Anthropic's AI-modellen waren aangevallen, zijn inmiddels in kennis gesteld van de incidenten. Anthropic zegt de beveiligingskwetsbaarheden met volle verantwoordelijkheid aan te pakken.
Oproep tot onderzoek
Anthropic roept andere AI-laboratoria op soortgelijke beveiligingscontroles uit te voeren. Het doel is beter inzicht te krijgen in de mogelijke risico's die voortvloeien uit de capaciteiten van moderne AI-modellen. De San Francisco-gevestigde onderneming benadrukt dat nader onderzoek naar deze mogelijkheden essentieel is voor verantwoorde AI-ontwikkeling.