Forskare tjänade 6 500 USD genom att hacka OpenAI med Anthropics Claude

  • Forskare på Hacktron AI använde Anthropic's Claude Opus 5 för att skriva fungerande exploitkod mot OpenAI:s infrastruktur.
  • En bildbehandlingsbugg på OpenAIs communityforum, tillsammans med en separat inloggningsbrist, gav tillgång till privat kod.
  • OpenAI betalade en hittelön på 6 500 USD den 1 september efter att de bekräftat sårbarheten i sina system.

En rivaliserande AI-modell gjorde det mesta av jobbet vid ett intrång mot OpenAI. Forskare hos Hacktron AI använde Anthropics Claude för att skriva fungerande attackkod.

Hela intrånget tog mindre än 72 timmar. OpenAI betalade till slut en belöning på 6 500 USD när teamet visade att de nått deras privata källkod.

Hur en bilduppladdning blev ett fullständigt intrång

Attacken började med något enkelt: en funktion för att ladda upp bilder på OpenAIs forum, som använder tredjepartsprogramvaran Discourse.

Ett säkerhetsfilter skulle kontrollera uppladdade filer. Det kände dock inte igen vissa bildformat, så dessa filer gick igenom utan kontroll. De filerna hamnade sedan i ett separat bildbehandlingsbibliotek med ett känt minnesfel.

Hacktrons team på tre personer, Harsh Jaiswal, Mohan Pedhapati och Rahul Maini, försökte utnyttja felet i slutet av juli.

Tidigare Claudemodeller hade problem med ett säkerhetsskydd som slumpade minnesplatser.

Några timmar senare skapade den nya modellen fungerande attackkod och anpassade den för forumets inställningar.

Följ oss på X för att få de senaste nyheterna direkt.

Hur Claude hjälpte forskare att tjäna 6 500 USD genom att bryta sig in i OpenAI. Källa: Hacktron AI
Hur Claude hjälpte forskare att tjäna 6 500 USD genom att bryta sig in i OpenAI. Källa: Hacktron AI

Det gav bara tillgång till forumets servrar, inte till OpenAI själv. Men en till, separat brist i OpenAIs single sign-on-lösning förändrade detta.

Forumets inloggningar fungerade även som inlogg för ChatGPT och Codex. Därför kunde hackarna, genom att kapa en anställds session, få direkt tillgång till OpenAIs privata kodregister.

Discourse rättade bildfelet några dagar senare och bedömde allvaret till 8,8 av 10. OpenAI åtgärdade inloggningsfelet ungefär 14 timmar efter att de fick rapporten via sitt bug bounty-program.

Varför AI-laboratorier fortsätter att drabbas av egna skapelser

Det här var inte en isolerad händelse. OpenAI hade redan berättat om ett annat tillfälle i juli där interna modeller tog sig ut ur testsystemet och nådde andra system.

Anthropic medgav också att Claude kom åt riktiga företag under säkerhetstester som oväntat gav tillgång till internet.

Microsofts AI-chef, Mustafa Suleyman, nämnde samma våg av obehöriga agenter den här veckan. Han varnade offentligt för att alltmer självständiga modeller blir svårare att kontrollera.

“Det är en varningssignal… Nu är det tydligt dags att samarbeta mellan laboratorier så att vi kan försäkra oss om kontroll över denna teknik,” sa Suleyman till Reuters.

Det ovanliga i Hacktron-fallet är inte något nytt. Säkerhetsforskare har kedjat programvarufel i många år.

Men det som förändrats är hastigheten: en uppgift som tidigare krävde specialkunskap gjordes nu på en kväll tack vare en kapabel AI-modell.

Prenumerera på vår YouTube-kanal för att se ledare och journalister ge expertinsikter.

Ansvarsfriskrivning

BeInCrypto har åtagit sig att tillhandahålla opartisk och transparent rapportering. Denna nyhetsartikel syftar till att ge korrekt och aktuell information. Läsare uppmanas dock att verifiera fakta på egen hand och att rådgöra med en fackman innan de fattar några beslut baserade på detta innehåll. Observera att våra Allmänna villkor, vår Integritetspolicy och våra Ansvarsfriskrivningar har uppdaterats.