Gå direkt till innehåll

Pressmeddelande

AI-modeller tog sig ur sina testmiljöer

I interna säkerhetstester har flera AI-modeller lyckats ta sig ur avgränsade testmiljöer och nå produktionssystem i skarp drift. I ett fall utnyttjade en modell självständigt en tidigare okänd sårbarhet och tog sig hela vägen till Hugging Faces produktionsmiljö. Det visar en ny kartläggning från Check Point Research.

Under juli och augusti 2026 inträffade flera uppmärksammade händelser hos OpenAI, Anthropic och Meta. Mest anmärkningsvärt var ett test hos OpenAI, där en AI-modell placerats i en isolerad miljö med endast tillgång till en intern tjänst för mjukvarupaket. Modellen identifierade själv en tidigare okänd sårbarhet i tjänsten och använde den för att ta sig ut ur testmiljön. I efterhand har forskare återskapat händelseförloppet, som omfattade omkring 17 600 självständiga steg.

Liknande incidenter inträffade i tester kopplade till Anthropic och Meta. I Anthropics fall var testmiljön felaktigt åtkomlig från internet, vilket gjorde att modeller kunde komma över inloggningsuppgifter och läsa information från en produktionsdatabas. Händelserna visar hur AI-modeller som får möjlighet att planera och agera självständigt kan skapa nya säkerhetsrisker även när de används under kontrollerade tester.

Samtidigt närmar sig cyberkriminella samma utveckling. En aktör kopplad till ransomwaretjänsten The Gentlemen använde Claude Code i attacker mot minst sex organisationer. I ett annat fall genomförde en AI-modell med namnet JADEPUFFER hela utpressningsattacken på egen hand efter att en människa hade satt igång den.

AI-system har dessutom blivit måltavlor i sig. Angripare manipulerar kodverktyg och AI-assistenter genom information som systemen automatiskt läser och litar på. Samtidigt växer marknaden för stulna AI-konton och API-nycklar. I en kartlagd kampanj samlades närmare 3 000 giltiga nycklar och inloggningsuppgifter in från över 1 700 enheter.

Även företagens vardagliga användning av generativ AI innebär risker. I juli innehöll cirka 2,8 procent av alla prompts – ungefär var 36:e – information med hög risk för dataläckage. Minst ett sådant fall registrerades hos 88 procent av organisationerna.

– Vi ser att gränsen mellan AI-experiment i kontrollerade miljöer och AI som påverkar verkliga system blir allt viktigare att förstå och hantera, säger Oskar Rödin, säkerhetsexpert på Check Point Software. När en modell själv kan hitta en okänd sårbarhet och använda den för att nå ett produktionssystem förändras riskbilden. För svenska verksamheter blir det därför avgörande att kontrollera både vilken information AI får tillgång till och vilka åtgärder systemen tillåts utföra.

Läs mer på Check Points blogg: https://blog.checkpoint.com/artificial-intelligence/ai-models-broke-their-own-containment-key-findings-from-the-july-august-2026-ai-threat-landscape/

Ämnen


Check Point Software Technologies Ltd. (www.checkpoint.com) är en ledande leverantör av digitala säkerhetslösningar som använder AI-baserade cybersäkerhetssystem för att skydda över 100 000 organisationer världen över. Genom sin Infinity Platform och ett öppet ekosystem, levererar Check Point en förebyggande strategi som ger branschledande säkerhet och minskar riskerna. Infinity Platform använder en hybrid nätverksarkitektur med SASE i centrum och förenar hanteringen av lokala miljöer, molnmiljöer och arbetsmiljöer för att erbjuda flexibilitet, enkelhet och skalbarhet för företag och tjänsteleverantörer.

Följ Check Point via:

LinkedIn: https://www.linkedin.com/company/check-point-software-technologies

X: https://www.twitter.com/checkpointsw

Facebook: https://www.facebook.com/checkpointsoftware

Blogg: https://blog.checkpoint.com

YouTube: https://www.youtube.com/user/CPGlobal

Kontakter

  • Blog-banner-800x400-AI-Report.webp
    Licens:
    Medieanvändning
    Filformat:
    .webp
    Storlek:
    1600 x 800, 1,11 MB
    Ladda ner

Relaterat innehåll

  • Sverige sticker ut när cyberattackerna ökar

    Svenska verksamheter utsattes i augusti för i genomsnitt 2470 cyberattacker i veckan, en ökning med 38 procent jämfört med samma månad förra året. Sverige hade därmed den näst största procentuella ökningen i Norden efter Danmark, där attackerna ökade med 45 procent jämfört med samma period förra året.

  • Dold attack via ChatGPT kunde läcka data från Gmail

    Forskare på Check Point Research har upptäckt en säkerhetsbrist i ChatGPT som gjorde det möjligt för angripare att obemärkt skicka instruktioner mellan separata användarkonton. I en simulation kunde forskarna visa hur sårbarheten kunde utnyttjas för att hämta information från en användares anslutna Gmail-konto och föra den vidare till angriparen, utan att användaren märkte vad som skedde.