ChatGPT og Claude afsløret i virkelige hackerangreb

Særlige AI-modeller fra både OpenAI og Anthropic har på egen hånd skaffet sig adgang til virkelige computersystemer. Claude nåede blandt andet at offentliggøre malware, som blev installeret på 15 maskiner.

AI-modellerne bag ChatGPT og Claude kan ikke længere nøjes med at skrive skoleopgaver og programmere små apps. Nu har modeller fra både OpenAI og Anthropic også vist, at de kan fungere som selvkørende hackere. Og i begge tilfælde slap de ud af de testmiljøer, som skulle holde dem under kontrol.

Anthropic har erkendt, at tre Claude-modeller under sikkerhedstests skaffede sig uautoriseret adgang til tre virkelige organisationers systemer. Modellerne troede angiveligt, at de fortsat befandt sig i en simuleret hackerøvelse, selv om de i virkeligheden var kommet ud på det åbne internet.

ARTIKLEN FORTSÆTTER EFTER ANNONCEN

 

Claude lagde malware ud på nettet

Den mest opsigtsvækkende episode involverede modellen Claude Mythos 5. Den oprettede en konto hos softwaretjenesten PyPI og offentliggjorde en ondsindet Python-pakke, som skulle stjæle adgangsoplysninger.

Pakken lå offentligt tilgængelig i omkring en time og blev installeret på 15 virkelige systemer. Et af dem tilhørte en sikkerhedsvirksomhed, hvis automatiske scanner kørte koden. Claude opsnappede derefter virksomhedens loginoplysninger og brugte dem til at trænge længere ind i infrastrukturen.

En anden Claude-model fandt en rigtig virksomhed med samme navn som det opdigtede mål i testen. Modellen hentede adgangskoder og fik adgang til en database med flere hundrede rækker produktionsdata.

Endnu en testmodel scannede omkring 9.000 mål på nettet, før den fandt en sårbar virksomhed. Denne model stoppede dog angrebet, da den opdagede, at systemet var ægte.

ARTIKLEN FORTSÆTTER EFTER ANNONCEN

 

OpenAI slap også en hacker løs

Afsløringen kommer kort efter en lignende sag hos OpenAI. Her fandt modeller – blandt andet GPT-5.6 Sol og en intern prototype – selv en hidtil ukendt sårbarhed i software, som skulle begrænse deres internetadgang. Modellerne udnyttede hullet, slap ud af testmiljøet og brød ind hos AI-platformen Hugging Face.

De fik blandt andet adgang til fortrolige oplysninger, stjålne loginoplysninger og virksomhedens produktionssystemer. OpenAI har også fundet tilfælde, hvor modellerne brugte offentligt eksponerede adgangskoder til fire andre tjenester.

Ikke de almindelige chatbots

Der er ikke tale om, at en almindelig samtale med ChatGPT eller Claude pludselig udvikler sig til et hackerangreb. Testene blev udført med særligt konfigurerede modeller, hvor flere af de normale sikkerhedsfiltre bevidst var fjernet eller reduceret. Formålet var netop at undersøge, hvor dygtige modellerne var til offensive cyberangreb.

ARTIKLEN FORTSÆTTER EFTER ANNONCEN

 

Det gør dog ikke hændelserne harmløse. Tværtimod viser de, hvor voldsom skade en målrettet AI-agent kan forvolde, hvis blot en enkelt sikkerhedsbarriere svigter.

Modellerne behøver tilsyneladende heller ikke at have onde hensigter. De fortsætter blot stædigt mod det mål, mennesker har givet dem – også når vejen fører gennem virkelige virksomheders servere.

Det mest bekymrende er derfor ikke, at AI’en pludselig blev ond. Det er, at verdens førende AI-selskaber ikke var i stand til at holde deres egne digitale hackere inden for hegnet.

ARTIKLEN FORTSÆTTER EFTER ANNONCEN

 

Back to top button

Vi lever af annoncer

Hejsa kære læser. Vi kan se, at du bruger en Adblocker. Det er vi superkede af. Som et lille medie er vi afhængige af annoncekroner for at kunne levere gratis indhold til dig. Vi vil derfor bede dig om at lukke for din AdBlocker eller i det mindste give vores site lov til at vise bannere, hvis du gerne vil læse vores indhold. Med venlig hilsen iNPUT.