Google och Meta släppte sina AI-modeller med bara några timmars mellanrum. Ingen vann: Vem leder?

  • Google och Meta lanserade konkurrerande avancerade AI-modeller den 2 september.
  • Gemini 3.8 Flash kostar 0,75 USD per 1 miljon inmatade token.
  • Muse Spark 1.3 xhigh får 61 på Artificial Analysis Intelligence Index.

Google och Meta släppte sina senaste avancerade AI-modeller med bara några timmars mellanrum på onsdagen. Google lanserade Gemini 3,8 Flash tillsammans med en cybersäkerhetsvariant, medan Meta presenterade Muse Spark 1,3.

De två lanseringarna gör att man lätt kan jämföra modellerna. Oberoende testning från Artificial Analysis visar delade resultat. Meta leder när det gäller kunskapsarbete med agenter och vetenskaplig resonemang, men Google är bättre på faktabaserad information och terminalkodning.

Två avancerade lanseringar sker samma dag

Gemini 3,8 Flash är Googles tredje Flash-lansering på sex veckor. Modellen kostar 0,75 USD per 1 000 000 input-tokens och 3,75 USD per 1 000 000 output-tokens.

Följ oss på X för att få de senaste nyheterna direkt

Detta introduktionspris gäller till och med 31 december 2026. Efter det dubblas priserna till 1,50 USD och 7,50 USD per 1 000 000 tokens.

Google släppte även Gemini 3,8 Flash Cyber, en generell modell. Endast utvalda försvarare får tillgång. Den fick 86,2% på CyberGym, ett test för att hitta sårbarheter.

Cybersäkerhetsvarianten nådde även 47,2% på CWE-Bench, som testar patchning. Google säger att modellen producerade 2,6 gånger fler korrekta patchar för Chrome-sårbarheter än större kommersiella modeller.

Tillgången styrs av Fairwind Program, som bara tillåter myndigheter och viktiga samhällsaktörer att använda modellen. OpenAI satte en liknande gräns dagen innan för Astra, sin första modell vid en kritisk tröskel för cybersäkerhet.

Samtidigt lanserade Meta Muse Spark 1,3 via Muse Code och Meta Model API. Företagets ingenjörer mätte cirka 20% färre verktygskopplingar än med version 1,2.

Gemini 3,8 Flash vs Muse Spark 1,3: Opartiska tester ger olika resultat

Artificial Analysis testade modellerna och resultaten visar hur de placerar sig. Muse Spark 1,3 i max-läge fick 1 754 Elo på GDPval-AA v2. Gemini 3,8 Flash (high) fick 1 545.

Meta var också bäst på Sierra Research-bankagenttestet (52,4% mot 44,9%) och CritPt-fysiktestet. Gemini 3,8 Flash lyckades bäst på Terminal-Bench 2,1 med 87,6%, AA-LCR långt sammanhang med 81% och AA-Omniscience noggrannhet med 55%.

Gemini 3,8 Flash fick högst GPQA Diamond-poäng bland testade modeller, hela 95%. Modellerna låg nära varandra på Humanity’s Last Exam.

Muse bäst presterande variant finns inte tillgänglig idag. Företaget säger att max-reasoning släpps först efter mer säkerhetstestning, därför finns bara xhigh-varianten nu.

Den versionen fick 61 poäng på Artificial Analysis Intelligence Index, fyra poäng mer än Muse Spark 1,2. Den ligger dock efter Claude Fable 5,1 på 66 och Claude Opus 5 på 63.

Flera lanseringar väntar redan. Elon Musk har sagt att Grok 4,7 släpps snart, vilket innebär fyra större AI-lanseringar på två veckor.

Prenumerera på vår YouTube-kanal för att se ledare och journalister ge experters insikter


För att läsa den senaste marknadsanalysen av kryptovalutor från BeInCrypto, klicka här.

Ansvarsfriskrivning

All information på vår webbplats publiceras i god tro och endast för allmän information. Varje åtgärd som läsaren vidtar baserat på informationen på vår webbplats sker strikt på egen risk.