De GPT-5-jailbreakteknikker, som blev opdaget af red team-testere, har skabt bekymring om modellens parathed til sikker brug i virksomheder. Sikkerhedseksperter fandt, at hackere kunne omgå GPT-5’s sikkerhedsforanstaltninger inden for 24 timer efter lanceringen.
Red team bryder GPT-5 hurtigt
Sikkerhedsfirmaet SPLX testede GPT-5 umiddelbart efter lanceringen. Uden nogen beskyttende systemprompt lykkedes det ikke GPT-5 at blokere 89 % af de fjendtlige angreb. Selv efter at have tilføjet en grundlæggende systemprompt faldt modellen stadig for 43 % af forsøgene. Til sammenligning var GPT-4o langt mere modstandsdygtig – den blokerede de fleste angreb og fejlede kun 3 % af gangene uden prompt og 19 % med en.
Sådan fungerer angrebene
Forskerne brugte GPT-5-jailbreakteknikker, der kombinerede simpel tekstforvrængning og manipulerende historiefortælling. En metode indsatte bindestreger mellem hvert bogstav eller præsenterede ondsindede prompts som krypteret tekst, hvilket narrede AI’en til at behandle dem som harmløse.
En anden effektiv metode brugte den såkaldte “Echo Chamber”-effekt – at indlejre usikre forespørgsler i et fiktivt scenarie med flere trin. Modellen fulgte rollespillet og leverede til sidst begrænset indhold, herunder farlige instruktioner.
Risici for virksomheder
Disse svagheder gør GPT-5 risikabel i virksomhedsmiljøer, især når den integreres i værktøjer, der kan udføre handlinger i den virkelige verden. I sin nuværende konfiguration efterlader modellen store huller, der kan misbruges, hvilket skaber bekymringer om overholdelse af regler og sikkerhed.
Sikkerhedsfolk anbefaler streng overvågning, avanceret filtrering af prompts og grundig test, før GPT-5 anvendes i kritiske arbejdsgange. Indtil sårbarhederne er løst, forbliver GPT-4o et sikrere valg til følsomme opgaver.
Konklusion
GPT-5-jailbreakteknikkerne viser, at selv de mest avancerede AI-modeller hurtigt kan kompromitteres. For organisationer understreger denne hændelse behovet for kontinuerlig red team-testning og stærke sikkerhedslag. Selvom GPT-5 tilbyder imponerende kapaciteter, kræver dens nuværende sikkerhedsstatus forsigtighed, før den tages i brug i stor skala.


0 svar til “GPT-5 afsløret: Forskere jailbreakede den på under 24 timer”