USA:s cybersäkerhetsbedömning visar att Kimi K3 ligger efter de främsta amerikanska AI-modellerna: Fakta eller politik?

  • USA:s regeringstester visar att Kimi K3 ligger efter de bästa amerikanska AI-modellerna på hacking.
  • Men amerikanska modeller testades utan säkerhetsfilter, till skillnad från Kimi K3.
  • Dess skydd tillåter ändå hjälp med hacking strax före en offentlig lansering.

USA:s regering testade Kinas senaste AI-modell med ett hackningstest. De upptäckte att Moonshot AI:s Kimi K3 är mycket sämre än de bästa amerikanska modellerna.

Center for AI Standards and Innovation (CAISI), en amerikansk myndighet, gjorde testen tillsammans med en brittisk partner. Resultaten kom bara en dag efter att Washington anklagade Moonshot för att ha utvecklat Kimi K3 med stulen amerikansk teknik.

Kimi K3 klarar inte amerikanska cybersäkerhetskrav

Handelsdepartementet presenterade resultaten på torsdagen. De sa att Kimi K3 fick mycket lägre poäng än USA:s toppmodeller, enligt ett gemensamt test med brittiska experter.

Moonshot släppte Kimi K3 den 16 juli. Efterfrågan blev så hög att de behövde pausa nya registreringar redan efter två dagar.

Lanseringen påverkade USA:s chipaktier och ökade oron om USA:s AI-ledning.

Ett test, ExploitBench, använder riktiga Chrome-buggar från Carnegie Mellon University. Kimi K3 fick 32 %. Det var bättre än Kinas GLM-5.2 som fick 24 %. Men de bästa amerikanska modellerna låg runt 76 %.

Test av exploit-utvecklingskapacitet
Test av exploit-utvecklingskapacitet. Källa: NIST

Det svåraste steget är att ta full kontroll över en dator. Kimi K3 klarade det inte i något av de 41 testen. De bästa amerikanska modellerna lyckades med det i 20 fall.

Ett annat test, The Last Ones, är en låtsad attack mot ett företagsnätverk med 32 steg. En mänsklig expert behöver cirka 20 timmar för att klara det. Kimi K3 nådde steg 17 i genomsnitt. De bästa amerikanska modellerna nådde steg 28,5. Kimi K3 klarade hela testet bara en gång av tio.

De bästa amerikanska systemen lyckades med det sex eller sju gånger.

Men skillnaden kan se större ut än den är

Men siffrorna visar inte allt. Det finns flera viktiga detaljer i rapporten.

För det första testade man de amerikanska modellerna utan säkerhetsfilter. Då får de visa sin fulla kraft. De publika versionerna har filtren påslagna. Alltså visar de amerikanska resultaten bästa möjliga fall, inte verkligheten.

Teamet kallade också arbetet tidigt och begränsat. De testade Kimi K3 bara i ett test och utförde bara en del av hela testuppsättningen. Så poängen är osäker. Vissa tester är också privata, så utomstående kan inte granska resultaten.

Det finns även en grundläggande skillnad. Kimi K3 är en öppen modell som alla kan ladda ner. USA:s modeller är låsta, privata system. Brittiska institutet fann att öppna modeller brukar ligga fyra till sju månader bakom stängda modeller. De ska testa Kimi K3 mer när Moonshot gör modellen tillgänglig för alla.

Dessa tester är inte heller riktiga attacker. Nätverket saknade mänskliga försvarare och hade inga larm som kunde gå igång. Trots det slog Kimi K3 den tidigare bästa öppna modellen. Och den lyckades göra hela attacken en gång.

Tidpunkten och källan väcker också frågor. CAISI var tidigare US AI Safety Institute. Trump-administrationen döpte om institutet i juni 2025. CAISI ingår i samma departement som begränsar USA:s chipförsäljning till Kina. Rapporten om en kinesisk konkurrent kom bara en dag efter stöldanklagelsen.

Svaga skydd ökar ändå riskerna

Låga poäng betyder ändå inte att Kimi K3 är säker. Testet visade att dess skydd inte hindrade den från att försöka bygga hack eller attackera system.

Det är viktigt för vad som händer nu. Moonshot planerar att släppa hela modellen den 27 juli. När den är ute går den inte att ta tillbaka. Alla kan då ladda ner den och ta bort säkerhetsfilter.

Testet kommer också efter en stöldanklagelse. Washington säger att Moonshot skapade Kimi K3 med stulen amerikansk AI-teknik. Vita husets teknikchef Michael Kratsios hävdade att företaget kopierade Anthropic:s Claude Fable 5 i hemlighet. Tricket kallas distillation och innebär att man tränar en ny modell på en starkare modells svar.

Anthropic stöder anklagelsen. I februari spårade de över 3,4 miljoner Claude-chattar till Moonshot via hundratals falska konton. De varnade för att kopierade modeller tappar ursprungsmodellens säkerhetskontroller. Det är samma svaghet som testet nu visade.

USA satsar ändå 23 gånger mer på AI än Kina. Men kinesiska labb minskar snabbt skillnaden. Den verkliga prövningen sker när Kimi K3 blir tillgänglig för alla och oberoende experter kan granska påståendena själva.


För att läsa den senaste marknadsanalysen av kryptovalutor från BeInCrypto, klicka här.

Ansvarsfriskrivning

All information på vår webbplats publiceras i god tro och endast för allmän information. Varje åtgärd som läsaren vidtar baserat på informationen på vår webbplats sker strikt på egen risk.