Relaterat till detta ämneRådet för Framtidsteknik och AI

ChatGPT-vattenmärke kommer till EU och OpenAI har en detektor redo

  • OpenAI lägger till ett osynligt vattenmärke i ChatGPT-text inom EU.
  • Bytte ut 25 % av orden mot synonymer minskade upptäckten till 17 %.
  • Endast godkända forskare kan använda OpenAI:s textdetektor just nu.

OpenAI lägger till en osynlig ChatGPT-vattenstämpel på chatbot-text och Codex-kodutdata i hela Europeiska unionen. Men deras egna tester visar att om man byter ut en fjärdedel av orden mot synonymer, så sjunker igenkänningsgraden till bara 17%.

Beslutet är ett svar på EU:s AI Act, regelverket som kräver maskinläsbara märkningar på AI-genererad text. Trots det erkänner OpenAI att tekniken fortfarande är omogen, därför låter företaget inte allmänheten använda detektorn ännu.

Hur stark är ChatGPT-vattenstämpeln när någon redigerar texten?

Enligt tillkännagivandet kallas systemet textGrain och styr modellens ordförråd för att skapa ett dolt statistiskt mönster. En separat detektor analyserar texten för att hitta detta mönster.

Vattenstämpeln sitter i formuleringarna, förklarar OpenAI på sin FAQ-sida. Den lägger inte till några dolda tecken, osynliga mellanslag eller konstiga skiljetecken. Därför kan vanliga knep för att ta bort dolda tecken inte användas här.

Längden spelar stor roll. OpenAI mäter text i tokens, alltså ordfragment som AI-modeller använder. En token motsvarar ungefär tre fjärdedelar av ett engelskt ord.

I OpenAI:s tester hittade detektorn cirka 66% av oredigerade svar med ungefär 150 ord. Vid cirka 300 ord steg träffsäkerheten till ungefär 92%.

Lättare redigering gör ChatGPT-vattenstämpeln svagare. I texter med 300 ord räckte det att byta ut ett ord av tio mot en synonym för att sänkja träffsäkerheten från 92% till 66%. Om man bytte ut ett ord av fyra sjönk det till bara 17%.

Andelen upptäckta ChatGPT-vattenstämplar minskar när fler ord byts ut
Upptäcktsfrekvens för ChatGPT-vattenstämpel efter redigeringar. Källa: OpenAI

Vattenstämpeln påverkade nästan inte några benchmarkresultat för OpenAI:s GPT-6 Astra, företagets senaste modell.

Varför får inte allmänheten använda OpenAIs detektor?

Istället för ett verktyg för allmänheten tar OpenAI emot ansökningar från godkända forskare och expertorganisationer. Företaget säger att ett positivt resultat inte visar användare, prompt eller konversation.

Ett negativt resultat ger heller inga tydliga svar. Kort, redigerad eller översatt text kan undgå detektorn, och AI-text från konkurrenter kan också slippa igenom.

Om man inte hittar en vattenstämpel betyder det inte att en människa har skrivit texten.

Källa: OpenAI

Bilder och ljud fungerar annorlunda. Alla kan ladda upp sådana filer till OpenAIs offentliga verify-verktyg och kontrollera om SynthID-vattenstämpeln finns där.

Utanför Europa är ChatGPT-vattenstämpeln avstängd som standard. Men API-kunder runt om i världen kan nu välja till det för vissa modeller i projekt- eller organisationsinställningarna.

Lanseringen sker efter att EU började kräva transparens enligt AI Act i augusti. När det gäller krypto är riskerna tydliga, eftersom kriminell AI-användning har ökat med 40% på ett år enligt TRM Labs.

Därför kommer skillnaden mellan vad regleringar kräver och vad detektorer faktiskt kan visa troligen att påverka hur alla stora AI-labb följer reglerna.

Ansvarsfriskrivning

BeInCrypto har åtagit sig att tillhandahålla opartisk och transparent rapportering. Denna nyhetsartikel syftar till att ge korrekt och aktuell information. Läsare uppmanas dock att verifiera fakta på egen hand och att rådgöra med en fackman innan de fattar några beslut baserade på detta innehåll. Observera att våra Allmänna villkor, vår Integritetspolicy och våra Ansvarsfriskrivningar har uppdaterats.