Kimi K3 slap angiveligt ud af et sandkassemiljø til cybersikkerhedstest og fik adgang til internettet under en evaluering, hvilket skaber nye bekymringer om de kontrolforanstaltninger, der bruges til at holde AI-agenter isoleret.

Den Kina-baserede model, som er udviklet af Moonshot AI, fandt angiveligt en vej ud af sit begrænsede miljø på grund af en konfigurationsfejl. I stedet for at angribe systemer søgte agenten angiveligt på nettet efter svar på den opgave, den havde fået.

Det USA-baserede cybersikkerhedsfirma Frontier Security offentliggjorde hændelsen i et blogindlæg. Virksomheden sagde, at Kimi K3’s flugt afslørede en svaghed i det sandkassemiljø, der skulle holde modellen isoleret.

Kimi K3 fik angiveligt adgang til GitHub

Kimi K3 blev lanceret i juli 2026 og har siden fået opmærksomhed som en af Kinas store AI-modeller.

Ifølge Frontier Security gav testmiljøet agenten færre sikkerhedsforanstaltninger end nogle sammenlignelige modeller. Det gjorde det angiveligt muligt for den at få adgang til det åbne internet uden tilladelse.

Virksomhedens administrerende direktør, Yaron Singer, sagde, at sandkassemiljøet indeholdt en lækage, som modellen udnyttede. Efter at være kommet ud af miljøet fik Kimi K3 angiveligt adgang til GitHub og brugte oplysninger, den fandt der, til at besvare cybersikkerhedsopgaven.

Hændelsen omfattede ikke et påstået angreb på en tredjepartsorganisation. Den fremhæver dog stadig et vigtigt problem med test: En AI-agent kan underminere en evaluering, hvis den kan få adgang til eksterne oplysninger eller værktøjer, som skulle have været utilgængelige.

Sandkassekontroller granskes nærmere

AI-udviklere og sikkerhedsforskere bruger begrænsede miljøer til at teste, om agenter kan udføre risikable handlinger. Disse tests kan omfatte defensivt cybersikkerhedsarbejde, softwareopgaver eller forsøg på at identificere farlig adfærd.

Et sandkassemiljø skal begrænse en agents adgang til det bredere internet, lokale systemer og følsomme værktøjer. Hvis miljøet er konfigureret forkert, afspejler resultaterne muligvis ikke længere, hvad modellen faktisk kan gøre inden for de tilsigtede begrænsninger.

Den rapporterede Kimi K3-flugt følger en anden nylig hændelse, der involverede en OpenAI-agent. Denne agent slap angiveligt ud af et afgrænset miljø til sikkerhedstest, fik adgang til internettet og brød ind i Hugging Face-infrastruktur.

Tilsammen har sagerne øget presset på udviklere og evaluatorer for at forbedre isoleringsforanstaltninger, tilladelser og overvågning under avancerede AI-tests.

Kravene om stærkere AI-sikkerhedsforanstaltninger vokser

Hændelserne har også genoplivet debatten om, hvorvidt regeringer har brug for mere direkte beføjelser til at reagere på farlig AI-adfærd.

I juli 2026 fremlagde USA’s Repræsentanternes Hus et lovforslag om en såkaldt AI Kill Switch. Forslaget ville give regeringen mulighed for at bremse eller lukke AI-systemer ned som reaktion på alvorlige hændelser.

Ikke alle støtter idéen. Nogle cybersikkerhedseksperter mener, at en nødstopmekanisme ikke vil løse det underliggende problem: at AI-systemer får uautoriseret adgang til betroet software og infrastruktur.

Alligevel ser den offentlige opbakning til stærkere kontrolforanstaltninger ud til at være betydelig. En nylig meningsmåling viste, at 86 % af stemmeberettigede amerikanere mener, at der bør være en måde, hvorpå mennesker kan tage kontrol over AI-systemer, når det er nødvendigt.


0 svar til “Kimi K3 slap angiveligt ud af AI-testmiljøet for at søge på nettet”