Relaterat till detta ämneRådet för Framtidsteknik och AI

Anthropic och OpenAI tar sin AI-kamp in i vetenskaplig forskning

  • Anthropic lanserade Claude Science, en AI-arbetsbänk kopplad till över 60 vetenskapliga databaser.
  • OpenAI har släppt GeneBench-Pro, ett riktmärke för AI-bedömning inom beräkningsbiologi.
  • OpenAI:s bästa modell klarade bara 28,7 % av GeneBench-Pro:s biologiuppgifter.

Anthropic och OpenAI ökade sin konkurrens på tisdagen, nu med fokus på vetenskaplig forskning. Anthropic lanserade Claude Science, en AI-app för forskare, medan OpenAI släppte GeneBench-Pro, en mätning för beräkningsbiologi.

De två lanseringarna samma dag visar att AI-tävlingen utvecklas bortom chattbotar och kodning, och nu når labbarbetet. Ett företag lanserade ett verktyg som forskare kan använda direkt. Det andra byggde ett sätt att mäta hur långt tekniken har kvar.

Vad Claude Science från Anthropic gör

Claude Science samlar databaser, kod och datorkraft som forskare brukar använda i en och samma app. Appen kopplar ihop över 60 vetenskapliga databaser från områden som genomik, proteomik och keminformatik.

Claude Science är en app, inte en ny AI-modell. Den släpps medan Anthropic fortfarande begränsar sina kraftigaste Fable 5 och Mythos 5-modeller på grund av amerikanska exportregler. Alla resultat kan granskas och spåras till den kod som skapade dem.

Appen bygger vidare på Anthropics satsning på life science som startade i oktober 2025. Under testperioden kunde Allen Institutes Jérôme Lecoq använda appen för att korta ner granskningar som tidigare tog upp till två år.

Anthropic kommer även att ge stöd till upp till 50 forskningsprojekt, med upp till 30 000 USD i krediter per projekt.

OpenAI höjer ribban med GeneBench-Pro

Kort efter lanseringen av Claude Science från Anthropic släppte OpenAI GeneBench-Pro. Den testar om AI kan fatta de beslut som forskning inom biologi kräver.

Mätningen innehåller 129 problem från genomik, kvantitativ biologi och translationell medicin.

OpenAI:s starkaste modell, GPT-5,6 Sol, löste 28,7 % av problemen på sin högsta nivå för resonemang. Andelen steg till 31,5 % i Pro-läge. Företaget släppte tidigare den stegvisa GPT-5,6-lanseringen efter begäran från Washington.

GPT-5 nådde under 5 % på ursprungliga GeneBench, medan Anthropics Opus 4,8 klarade 16 % på det svårare testet.

Följ oss på X för att få senaste nytt direkt

Två strategier, ett mål

Uppdelningen visar två vägar mot samma mål. Anthropic lanserar en produkt för labbet varje dag. OpenAI mäter hur säkert modellerna kan tolka svår data.

Båda lanseringarna sker när kinesiska AI-modeller går framåt inom forskningen. OpenAI:s siffror dämpar uppmärksamheten eftersom deras bästa modell fortfarande misslyckas med de flesta GeneBench-Pro-uppgifter.

Både politik och vetenskap ökar pressen. Begränsningar för export i USA har redan fått Anthropic att överväga nya länder för sina modeller.

Experter tror att en människa skulle behöva 20 till 40 timmar för varje GeneBench-Pro-problem, vilket kostar flera tusen USD. OpenAI säger deras modell gör samma analys för några få USD.

Aubrey de Grey, biomedicinsk gerontolog, tror att AI rensar bort forskningshinder även om större framsteg tar tid.

“Vi kommer att se mycket snart att AI tar bort vissa hinder, särskilt inom läkemedelsutveckling,” säger Aubrey de Grey, president och vetenskaplig chef för Longevity Escape Velocity Foundation, i en BeInCrypto-podcast.

De Grey säger att snabbare forskning ändå kräver reglering och att allmänheten accepterar risker innan behandlingen godkänns.

Forskare tror på snabbare användning

Vissa experter menar att förändringen redan sker. Dr. Derya Unutmaz, professor i immunologi, sa i samma panel på BeInCrypto att AI nu överträffar honom själv.

“Jag personligen litar mer på AI än på mina egna idéer efter 35 år i min bransch.”

Han tror att detta snabbt kommer att spridas inom sjukvården.

“Det är oetiskt, och jag tror att det snart blir felbehandling att inte använda AI i medicin.”

Den optimismen ligger fortfarande före verkligheten på mätningarna. De kommande månaderna visar om forskare tar till sig dessa verktyg och om resultaten för GeneBench-Pro börjar stiga.

Ansvarsfriskrivning

BeInCrypto har åtagit sig att tillhandahålla opartisk och transparent rapportering. Denna nyhetsartikel syftar till att ge korrekt och aktuell information. Läsare uppmanas dock att verifiera fakta på egen hand och att rådgöra med en fackman innan de fattar några beslut baserade på detta innehåll. Observera att våra Allmänna villkor, vår Integritetspolicy och våra Ansvarsfriskrivningar har uppdaterats.