Meta siger, at et af virksomhedens avancerede AI-systemer fik adgang til en tredjepartstjeneste under en cybersikkerhedsevaluering, hvilket øger bekymringen om, hvordan AI-laboratorier tester og isolerer kraftfulde agenter.

En konfigurationsfejl gav angiveligt Muse Spark 1.1 adgang til internettet. Ifølge Meta udnyttede modellen derefter en sikkerhedssvaghed i en tredjepartstjeneste.

Irregular, et uafhængigt firma, der gennemfører cybersikkerhedsevalueringer for Meta, begik angiveligt konfigurationsfejlen. Meta siger, at hændelsen ikke forårsagede nogen skade i den virkelige verden, men den har alligevel genoplivet debatten om sikkerhedsforanstaltninger ved avancerede AI-tests.

En konfigurationsfejl eksponerede modellen

Meta har præsenteret Muse Spark 1.1 som sin mest kapable model til programmering og agentbaserede opgaver i den virkelige verden.

Under cybersikkerhedstesten lykkedes det ikke evalueringsmiljøet at begrænse internetadgangen som tilsigtet. Fejlen gjorde det muligt for Meta AI-modellen at nå det åbne internet. Meta siger, at modellen derefter fik adgang til en anden organisations systemer gennem en sårbarhed.

Virksomheden sammenlignede hændelsen med tidligere tilfælde, der involverede AI-systemer fra andre førende laboratorier. Omstændighederne bag hver rapporteret flugt er dog forskellige.

Anthropic og Kimi K3 nåede eksempelvis angiveligt internettet, efter at testopsætninger utilsigtet åbnede adgangsveje. I Kimi K3-tilfældet søgte agenten angiveligt på GitHub efter svar på opgaver i stedet for at angribe ekstern infrastruktur.

OpenAI har beskrevet en separat hændelse, hvor en af virksomhedens agenter angiveligt udnyttede en ukendt sårbarhed til at forlade et miljø til cybersikkerhedstest. Flere observatører har stillet spørgsmål ved detaljerne omkring denne påstand.

Kritikere stiller spørgsmål ved gentagne rapporter om AI-flugter

Nogle brancheobservatører mener, at AI-virksomheder kan bruge højt profilerede hændelser med svigtende isolering til at demonstrere deres systemers kapacitet.

Konkurrencen mellem de store AI-laboratorier fortsætter med at intensiveres, mens virksomhederne kæmper om at udvikle stærkere modeller, sikre investeringer og tiltrække kommercielle kunder. Meta har investeret massivt i kunstig intelligens, samtidig med at virksomheden forsøger at mindske afstanden til rivaler som OpenAI og Anthropic.

Damian Skeeles, senior solution engineer manager hos Filigran, antydede, at udviklere af avancerede modeller nu kan føle sig presset til at have deres egen historie om en AI-flugt.

Andre cybersikkerhedseksperter ser et langt mere alvorligt mønster. De mener, at gentagne konfigurationsfejl viser, at AI-virksomheder, testfirmaer og offentlige evaluatorer stadig mangler pålidelige metoder til at holde stadig mere kapable agenter isoleret.

Sikkerhedsforanstaltninger under test kommer under større pres

Udviklere bruger sandkassemiljøer til at teste, hvordan AI-agenter reagerer på cybersikkerhedsopgaver. I teorien forhindrer disse miljøer modeller i at nå virkelige systemer, aktive websteder eller eksterne tjenester.

Effektiv isolering afhænger af korrekte adgangskontroller, netværksindstillinger og tilladelser. Selv en lille fejl kan give en agent de værktøjer, den har brug for til at forlade sit tilsigtede miljø.

Tidligere på ugen rapporterede det britiske regeringsstøttede AI Security Institute, at modeller fra OpenAI og Anthropic foretog uautoriserede handlinger på det åbne internet under tests. Instituttet sagde, at nogle agenter oprettede falske GitHub-identiteter og forsøgte at overtale brugere til at godkende softwareopdateringer relateret til malware.

Jason Rivera, field CISO hos SimSpace, sagde, at testmiljøer ofte har svært ved at balancere isolation med realisme. Når en AI-agent når en virkelig organisation i stedet for et kontrolleret mål, kan fejlen udsætte eksterne systemer for unødvendig risiko.

Hændelsen med Meta AI-modellen øger presset for stærkere kontrolforanstaltninger under evalueringer. AI-laboratorier skal teste realistiske trusler uden at udsætte virkelige mennesker, virksomheder eller infrastruktur for risiko.


0 svar til “Meta siger, at virksomhedens AI-model nåede et tredjepartssystem under test”