Teknologi

ChatGPT får usynligt vandmærke i EU, det værktøj OpenAI holdt tilbage i 2024

Adrian Kessler
Tilføj os på Google

OpenAI har længe offentligt forklaret, hvorfor virksomheden ikke ville sætte et vandmærke på ChatGPTs tekster. Nu gør den det alligevel. Det skyldes ikke, at teknologien har fået OpenAI til at skifte mening. Det skyldes en lov med en deadline og en bøde som konsekvens.

Virksomheden siger, at tekster, som ChatGPT og Codex genererer til brugere i EU, får et usynligt statistisk fingeraftryk, der indføres gradvist over de kommende uger på alle abonnementer. Alle andre steder findes det samme mærke kun som en indstilling i udviklernes API, og den er som standard slået fra. Den grænse, OpenAI har trukket, følger jurisdiktionens grænse for, hvor virksomheden kan blive straffet.

Sådan fungerer ChatGPTs vandmærke

Metoden, der kaldes textGrain, sætter ikke noget synligt præg på resultatet. Når flere næste ord passer omtrent lige godt ind i en sætning, tipper en hemmelig nøgle valget i retning af et af dem. Et enkelt lille skub betyder ingenting. Men hundredvis af dem i en tekst danner et mønster, som en detektor med adgang til nøglen kan lede efter. Og fordi signalet ligger i selve ordene, overlever det kopiering og indsættelse. OpenAI har skrevet den tekniske rapport sammen med forskere fra University of Pennsylvania og Yale. Rapporten finder ingen nævneværdig forringelse af kvaliteten: På Artificial Analysis Intelligence Index fik vandmærkede svar 49,76 point mod 49,57 uden mærket.

Værktøjet, OpenAI allerede havde

Intet af dette er nyt hos OpenAI. I sommeren 2024 skrev The Wall Street Journal, at virksomheden havde et fungerende tekstvandmærke, som ifølge interne dokumenter var 99,9 % effektivt, men holdt det tilbage. OpenAI svarede, at virksomheden indtog »en bevidst tilgang«. Begrundelserne var både tekniske og sociale: Metoden kunne »let omgås af personer med ondsindede hensigter« ved at oversætte teksten eller omformulere den med en anden model, og den kunne stigmatisere AI som skrivehjælp for personer, der ikke har engelsk som modersmål. TechCrunch, der skrev om ugens annoncering, minder om en tredje begrundelse fra den periode: frygten for, at brugerne ville skifte til konkurrenter, der ikke vandmærkede deres tekster.

Set i lyset af den historik viser den nye udrulning, hvilke af bekymringerne OpenAI faktisk har håndteret. Problemet med at omgå mærket består stadig, også ifølge virksomhedens egne tal. Den kommercielle bekymring er blevet begrænset til ét marked.

OpenAIs tal – ikke kritikernes

Under gode forhold og med en falsk positiv-rate på 1 % finder detektoren omkring 80 % af vandmærkede tekststykker på 200 tokens og cirka 95 % af dem på 400 tokens. Hvis 10 % af ordene udskiftes med synonymer, falder træfsikkerheden fra 92 % til 66 %. Udskiftes en fjerdedel, falder den til 17 %. Korte svar, matematik og oversat tekst er i det hele taget svære at fange. OpenAI advarer selv om, at gode resultater under ideelle forhold »ikke garanterer pålidelig detektion i daglig brug«, og at et manglende vandmærke ikke beviser, at en tekst er skrevet af et menneske. Virksomheden siger også, at mærket ikke identificerer brugeren.

Det gør textGrain til et brugbart signal mod dovne kopieringer og indsættelser, men et svagt værn mod enhver, der er villig til at bruge et minut på at redigere teksten. I en sammenslutning, hvor man læser og skriver på mange sprog, er problemet med oversættelser ikke en uvæsentlig detalje.

Hvorfor EU – og hvorfor nu?

Den juridiske drivkraft er artikel 50 i AI Act, hvis regler om gennemsigtighed trådte i kraft den 2. august. Den kræver, at udbydere af generative systemer mærker syntetisk tekst, lyd, billeder og video på en maskinlæsbar måde og stiller en mekanisme til at opdage dem til rådighed. Systemer, der allerede var på markedet før denne dato, heriblandt ChatGPT, har frem til den 2. december til at efterleve reglerne. Overtrædelser kan ifølge en analyse fra advokatfirmaet Cooley koste op til 15 millioner euro eller 3 % af den globale årsomsætning – alt efter hvilket beløb der er højest.

To detaljer viser, hvor tæt udrulningen følger forpligtelsen snarere end et princip. Den første er detektoren. Loven kræver en mekanisme til at opdage mærket; OpenAI har udviklet en og kun givet godkendte forskere og ekspertorganisationer adgang til den, efter at de har ansøgt. Virksomheden siger, at den vil give bredere adgang »når vi mener, at resultaterne kan fortolkes ansvarligt«, skriver The Decoder, men har ikke angivet nogen tidsplan. En lærer eller redaktør i Lissabon eller Warszawa, der sidder med en mistænkelig tekst, kan ikke undersøge den i dag.

Den anden detalje er kortet. Anthropic, der begyndte at vandmærke Claudes tekster i august, sætter mærket på globalt, uanset hvordan folk tilgår virksomhedens modeller, og fik kritik fra nogle brugere for det. OpenAI valgte det modsatte: Mærket er slået til som standard dér, hvor en tilsynsmyndighed kan udstede en bøde, mens udviklere andre steder selv kan vælge det til. Der er altså ingen global standardindstilling ved lanceringen. Hvis den gamle frygt for, at brugerne ville søge over til konkurrenter uden vandmærker, var forsvundet, ville der være ringe grund til at trække grænsen på den måde.

Hvad sker der nu?

OpenAI siger, at textGrain bliver open source, og at metoden matcher eller overgår tilgange som Googles SynthID. Begge påstande kan efterprøves, når koden bliver offentlig. Spørgsmålet for Bruxelles er mere afgrænset: Om et mærke, der svækkes af let redigering, og som aflæses af en detektor, næsten ingen kan bruge, lever op til en regel, der skal gøre det muligt for andre systemer at genkende AI-tekst.

Efter den 2. december er det kun de ChatGPT-brugere, hvis tilsynsmyndighed kan sende regningen, der som standard får OpenAIs fingeraftryk på deres ord.

Tags: , , , ,

Tilføj os på Google

Debat

Der er 0 kommentarer.