OpenAI lägger till en osynlig ChatGPT-vattenstämpel på chatbot-text och Codex-kodutdata i hela Europeiska unionen. Men deras egna tester visar att om man byter ut en fjärdedel av orden mot synonymer, så sjunker igenkänningsgraden till bara 17%.
Beslutet är ett svar på EU:s AI Act, regelverket som kräver maskinläsbara märkningar på AI-genererad text. Trots det erkänner OpenAI att tekniken fortfarande är omogen, därför låter företaget inte allmänheten använda detektorn ännu.
Hur stark är ChatGPT-vattenstämpeln när någon redigerar texten?
Enligt tillkännagivandet kallas systemet textGrain och styr modellens ordförråd för att skapa ett dolt statistiskt mönster. En separat detektor analyserar texten för att hitta detta mönster.
Vattenstämpeln sitter i formuleringarna, förklarar OpenAI på sin FAQ-sida. Den lägger inte till några dolda tecken, osynliga mellanslag eller konstiga skiljetecken. Därför kan vanliga knep för att ta bort dolda tecken inte användas här.
Längden spelar stor roll. OpenAI mäter text i tokens, alltså ordfragment som AI-modeller använder. En token motsvarar ungefär tre fjärdedelar av ett engelskt ord.
I OpenAI:s tester hittade detektorn cirka 66% av oredigerade svar med ungefär 150 ord. Vid cirka 300 ord steg träffsäkerheten till ungefär 92%.
Lättare redigering gör ChatGPT-vattenstämpeln svagare. I texter med 300 ord räckte det att byta ut ett ord av tio mot en synonym för att sänkja träffsäkerheten från 92% till 66%. Om man bytte ut ett ord av fyra sjönk det till bara 17%.
Vattenstämpeln påverkade nästan inte några benchmarkresultat för OpenAI:s GPT-6 Astra, företagets senaste modell.
Varför får inte allmänheten använda OpenAIs detektor?
Istället för ett verktyg för allmänheten tar OpenAI emot ansökningar från godkända forskare och expertorganisationer. Företaget säger att ett positivt resultat inte visar användare, prompt eller konversation.
Ett negativt resultat ger heller inga tydliga svar. Kort, redigerad eller översatt text kan undgå detektorn, och AI-text från konkurrenter kan också slippa igenom.
Om man inte hittar en vattenstämpel betyder det inte att en människa har skrivit texten.
Källa: OpenAI
Bilder och ljud fungerar annorlunda. Alla kan ladda upp sådana filer till OpenAIs offentliga verify-verktyg och kontrollera om SynthID-vattenstämpeln finns där.
Utanför Europa är ChatGPT-vattenstämpeln avstängd som standard. Men API-kunder runt om i världen kan nu välja till det för vissa modeller i projekt- eller organisationsinställningarna.
Lanseringen sker efter att EU började kräva transparens enligt AI Act i augusti. När det gäller krypto är riskerna tydliga, eftersom kriminell AI-användning har ökat med 40% på ett år enligt TRM Labs.
Därför kommer skillnaden mellan vad regleringar kräver och vad detektorer faktiskt kan visa troligen att påverka hur alla stora AI-labb följer reglerna.









