En rivaliserande AI-modell gjorde det mesta av jobbet vid ett intrång mot OpenAI. Forskare hos Hacktron AI använde Anthropics Claude för att skriva fungerande attackkod.
Hela intrånget tog mindre än 72 timmar. OpenAI betalade till slut en belöning på 6 500 USD när teamet visade att de nått deras privata källkod.
Hur en bilduppladdning blev ett fullständigt intrång
Attacken började med något enkelt: en funktion för att ladda upp bilder på OpenAIs forum, som använder tredjepartsprogramvaran Discourse.
Ett säkerhetsfilter skulle kontrollera uppladdade filer. Det kände dock inte igen vissa bildformat, så dessa filer gick igenom utan kontroll. De filerna hamnade sedan i ett separat bildbehandlingsbibliotek med ett känt minnesfel.
Hacktrons team på tre personer, Harsh Jaiswal, Mohan Pedhapati och Rahul Maini, försökte utnyttja felet i slutet av juli.
Tidigare Claudemodeller hade problem med ett säkerhetsskydd som slumpade minnesplatser.
Några timmar senare skapade den nya modellen fungerande attackkod och anpassade den för forumets inställningar.
Följ oss på X för att få de senaste nyheterna direkt.
Det gav bara tillgång till forumets servrar, inte till OpenAI själv. Men en till, separat brist i OpenAIs single sign-on-lösning förändrade detta.
Forumets inloggningar fungerade även som inlogg för ChatGPT och Codex. Därför kunde hackarna, genom att kapa en anställds session, få direkt tillgång till OpenAIs privata kodregister.
Discourse rättade bildfelet några dagar senare och bedömde allvaret till 8,8 av 10. OpenAI åtgärdade inloggningsfelet ungefär 14 timmar efter att de fick rapporten via sitt bug bounty-program.
Varför AI-laboratorier fortsätter att drabbas av egna skapelser
Det här var inte en isolerad händelse. OpenAI hade redan berättat om ett annat tillfälle i juli där interna modeller tog sig ut ur testsystemet och nådde andra system.
Anthropic medgav också att Claude kom åt riktiga företag under säkerhetstester som oväntat gav tillgång till internet.
Microsofts AI-chef, Mustafa Suleyman, nämnde samma våg av obehöriga agenter den här veckan. Han varnade offentligt för att alltmer självständiga modeller blir svårare att kontrollera.
“Det är en varningssignal… Nu är det tydligt dags att samarbeta mellan laboratorier så att vi kan försäkra oss om kontroll över denna teknik,” sa Suleyman till Reuters.
Det ovanliga i Hacktron-fallet är inte något nytt. Säkerhetsforskare har kedjat programvarufel i många år.
Men det som förändrats är hastigheten: en uppgift som tidigare krävde specialkunskap gjordes nu på en kväll tack vare en kapabel AI-modell.
Prenumerera på vår YouTube-kanal för att se ledare och journalister ge expertinsikter.









