Teknologi

ChatGPT og Claude afsløret i virkelige hackerangreb

Særlige AI-modeller fra både OpenAI og Anthropic har på egen hånd skaffet sig adgang til virkelige computersystemer. Claude nåede blandt andet at offentliggøre malware, som blev installeret på 15 maskiner.

hacker
Foto: skabt med AI

AI-modellerne bag ChatGPT og Claude kan ikke længere nøjes med at skrive skoleopgaver og programmere små apps. Nu har modeller fra både OpenAI og Anthropic også vist, at de kan fungere som selvkørende hackere. Og i begge tilfælde slap de ud af de testmiljøer, som skulle holde dem under kontrol.

Anthropic har erkendt, at tre Claude-modeller under sikkerhedstests skaffede sig uautoriseret adgang til tre virkelige organisationers systemer. Modellerne troede angiveligt, at de fortsat befandt sig i en simuleret hackerøvelse, selv om de i virkeligheden var kommet ud på det åbne internet.

Claude lagde malware ud på nettet

Den mest opsigtsvækkende episode involverede modellen Claude Mythos 5. Den oprettede en konto hos softwaretjenesten PyPI og offentliggjorde en ondsindet Python-pakke, som skulle stjæle adgangsoplysninger.

Artiklen fortsætter efter annoncen

Pakken lå offentligt tilgængelig i omkring en time og blev installeret på 15 virkelige systemer. Et af dem tilhørte en sikkerhedsvirksomhed, hvis automatiske scanner kørte koden. Claude opsnappede derefter virksomhedens loginoplysninger og brugte dem til at trænge længere ind i infrastrukturen.

En anden Claude-model fandt en rigtig virksomhed med samme navn som det opdigtede mål i testen. Modellen hentede adgangskoder og fik adgang til en database med flere hundrede rækker produktionsdata.

Endnu en testmodel scannede omkring 9.000 mål på nettet, før den fandt en sårbar virksomhed. Denne model stoppede dog angrebet, da den opdagede, at systemet var ægte.

OpenAI slap også en hacker løs

Afsløringen kommer kort efter en lignende sag hos OpenAI. Her fandt modeller – blandt andet GPT-5.6 Sol og en intern prototype – selv en hidtil ukendt sårbarhed i software, som skulle begrænse deres internetadgang. Modellerne udnyttede hullet, slap ud af testmiljøet og brød ind hos AI-platformen Hugging Face.

Artiklen fortsætter efter annoncen

De fik blandt andet adgang til fortrolige oplysninger, stjålne loginoplysninger og virksomhedens produktionssystemer. OpenAI har også fundet tilfælde, hvor modellerne brugte offentligt eksponerede adgangskoder til fire andre tjenester.

Ikke de almindelige chatbots

Der er ikke tale om, at en almindelig samtale med ChatGPT eller Claude pludselig udvikler sig til et hackerangreb. Testene blev udført med særligt konfigurerede modeller, hvor flere af de normale sikkerhedsfiltre bevidst var fjernet eller reduceret. Formålet var netop at undersøge, hvor dygtige modellerne var til offensive cyberangreb.

Det gør dog ikke hændelserne harmløse. Tværtimod viser de, hvor voldsom skade en målrettet AI-agent kan forvolde, hvis blot en enkelt sikkerhedsbarriere svigter.

MERE OM SAMME EMNE:

Modellerne behøver tilsyneladende heller ikke at have onde hensigter. De fortsætter blot stædigt mod det mål, mennesker har givet dem – også når vejen fører gennem virkelige virksomheders servere.

Artiklen fortsætter efter annoncen

Det mest bekymrende er derfor ikke, at AI’en pludselig blev ond. Det er, at verdens førende AI-selskaber ikke var i stand til at holde deres egne digitale hackere inden for hegnet.

Tak fordi du læser med. Synes du, artiklen var værd at læse? Giv den et like, så hjælper du andre læsere med at finde den. Levede den ikke op til dine forventninger, må du også gerne give den et dislike. Tak for din vurdering.