Relaterat till detta ämneRådet för Framtidsteknik och AI

Mythos är tillbaka: Anthropic visar att Fable 5 inte var unikt riskabel

  • Tester visar att Opus 4,8, GPT-5,5 och Kimi K2,7 kan identifiera samma sårbarheter.
  • Claude Fable 5 kommer tillbaka globalt med bättre skydd den 2 juli.
  • Fable 5:s nya klassificerare markerar fler oskyldiga kodnings- och felsökningsuppgifter.

Anthropic säger att interna tester visade att Claude Fable 5 inte utgjorde någon unik cybersäkerhetsrisk, medan Claude Mythos 5 kommer tillbaka globalt den 2 juli.

Detta meddelande kommer samtidigt som Fable 5 lanseras på nytt globalt efter att ha varit avstängd i 18 dagar på grund av amerikanska exportregler sedan 12 juni. Anthropic testade konkurrenternas modeller för att undersöka det verkliga hotet bakom restriktionen.

Varför Anthropic stängde av Fable 5

Fable 5 och Mythos 5 lanserades den 9 juni och använde samma kärnmodell, men Fable 5 var öppen för allmänheten. Mythos 5 hölls begränsad till ett fåtal betrodda Project Glasswing-partner för defensivt cybersäkerhetsarbete.

Exportreglerna infördes efter att forskare på Amazon hittade ett sätt att kringgå Fable 5:s skydd. Metoden gjorde att modellen identifierade mjukvarusårbarheter och visade ett exempel på en exploatering.

Anthropics tester visade att även Claude Opus 4,8, GPT-5,5 och Kimi K2,7 kunde identifiera samma sårbarheter som Fable 5 pekade ut i Amazons rapport. Alla testade modeller kunde också återskapa det enda visade exemplet på exploatering.

Resultatet visade att myndigheternas åtgärd gällde en risk som fanns hos hela branschen, inte bara Fable. Anthropic byggde ändå en starkare klassificerare för att stoppa tekniken, som nu också markerar fler vanliga förfrågningar om kodning och felsökning.

Så fungerar skydden i praktiken

Fable 5 hade det starkaste säkerhetsskyddet som Anthropic har lagt in i en modell. Klassificerarna blockerar förfrågningar som verkar minsta möjliga riskabla, inte bara uppenbart skadliga. Den nya klassificeraren, tränad efter Amazons rapport, blockerar den rapporterade tekniken i över 99 % av fallen enligt Anthropic. Blockerade förfrågningar skickas nu automatiskt vidare till Opus 4,8.

Det säkerhetsmarginalen har ett pris. Anthropic säger att klassificeraren nu också stoppar fler ofarliga förfrågningar om kodning och felsökning, men de kommer att fortsätta justera den för att minska falska positiva resultat. Mythos 5, som har färre sådana skydd, öppnades åter endast för Mythos 5-institutioner godkända av regeringen den 26 juni.

Anthropics egna data väcker en svårare fråga. Om svagare modeller redan kan det som Fable 5 förbjöds för, vilket krav kommer tillsynsmyndigheter att ställa nästa gång en ny avancerad modell lanseras?

Ansvarsfriskrivning

BeInCrypto har åtagit sig att tillhandahålla opartisk och transparent rapportering. Denna nyhetsartikel syftar till att ge korrekt och aktuell information. Läsare uppmanas dock att verifiera fakta på egen hand och att rådgöra med en fackman innan de fattar några beslut baserade på detta innehåll. Observera att våra Allmänna villkor, vår Integritetspolicy och våra Ansvarsfriskrivningar har uppdaterats.