Flera tester under juli och augusti 2026 visade hur AI-modeller kan få åtkomst till produktionssystem från avgränsade testmiljöer, enligt en kartläggning från Check Point Research. I ett test hos OpenAI ska en modell ha identifierat och utnyttjat en tidigare okänd brist i en intern tjänst för mjukvarupaket. Händelseförloppet, som senare återskapades av forskare, omfattade omkring 17 600 självständiga steg och ledde till Hugging Faces produktionsmiljö.
I tester kopplade till Anthropic och Meta inträffade liknande händelser. I Anthropics fall var testmiljön åtkomlig från internet, vilket enligt kartläggningen gjorde det möjligt för modeller att komma över inloggningsuppgifter och läsa data i en produktionsdatabas.
Check Point lyfter även attacker där AI-verktyg har använts. En aktör kopplad till ransomwaretjänsten The Gentlemen använde enligt företaget Claude Code mot minst sex organisationer. I ett annat dokumenterat fall ska AI-modellen JADEPUFFER ha genomfört en utpressningsattack efter att ha startats av en människa.
Generativ AI kan också bidra till informationsläckage i normal verksamhet. Under juli innehöll omkring 2,8 procent av analyserade AI-prompter, ungefär var 36:e, information med hög risk för dataläckage, enligt Check Point. Minst ett sådant fall registrerades hos 88 procent av organisationerna.
– Vi ser att gränsen mellan AI-experiment i kontrollerade miljöer och AI som påverkar verkliga system blir allt viktigare att förstå och hantera, säger Oskar Rödin, säkerhetsexpert på Check Point Software.
Han bedömer att verksamheter behöver kontrollera både vilken information AI-system får tillgång till och vilka åtgärder de tillåts utföra.






