Teknologi

ChatGPT får usynlig vannmerking i EU, verktøyet OpenAI holdt tilbake i 2024

Adrian Kessler
Legg oss til på Google

OpenAI brukte lang tid på å forklare offentlig hvorfor selskapet ikke ville legge et vannmerke på teksten fra ChatGPT. Nå gjør det det likevel. Det er ikke teknologien som har fått selskapet til å ombestemme seg. Det er en lov med en frist – og en bot knyttet til den.

Selskapet sier at tekst ChatGPT og Codex lager for brukere i EU, får en usynlig statistisk signatur. Den skal innføres gradvis i løpet av de kommende ukene og gjelde alle abonnementene. Alle andre steder finnes det samme merket bare som en bryter i utvikler-API-et, og den står avslått som standard. Grensen OpenAI har trukket, følger jurisdiksjonen som kan ilegge selskapet bøter.

Slik fungerer vannmerket i ChatGPT

Metoden, som kalles textGrain, setter ingen synlige merker på teksten. Når flere neste ord passer omtrent like godt inn i en setning, styrer en hemmelig nøkkel valget i retning av ett av dem. Ett lite dytt betyr ingenting. Men hundrevis av slike dytt gjennom en tekst danner et mønster som en detektor med tilgang til nøkkelen kan teste for. Fordi signalet ligger i selve ordene, overlever det kopiering og innliming. OpenAI skrev den tekniske rapporten sammen med forskere fra University of Pennsylvania og Yale. Ifølge rapporten går det ikke merkbart ut over kvaliteten: På Artificial Analysis Intelligence Index fikk vannmerket tekst 49,76 poeng, mot 49,57 uten merket.

Verktøyet OpenAI allerede hadde

Ingenting av dette er nytt internt i OpenAI. Sommeren 2024 skrev Wall Street Journal at selskapet hadde et fungerende tekstvannmerke, vurdert til å være 99,9 prosent effektivt i interne dokumenter, men holdt det tilbake. OpenAI svarte at selskapet hadde valgt «en bevisst tilnærming». Begrunnelsene var både tekniske og samfunnsmessige: Metoden var «lett for ondsinnede aktører å omgå» ved å oversette teksten eller skrive den om med en annen modell, og den kunne stigmatisere AI som skrivehjelp for personer som ikke har engelsk som morsmål. TechCrunch, som omtaler kunngjøringen denne uken, trekker fram en tredje grunn fra den perioden: frykten for at brukerne skulle gå over til konkurrenter som ikke vannmerket tekst.

Sett opp mot denne historikken viser den nye utrullingen hvilke av bekymringene OpenAI faktisk har håndtert. Problemet med å omgå merkingen er fortsatt der, ifølge selskapets egne tall. Den kommersielle bekymringen er avgrenset til ett marked.

OpenAIs tall – ikke kritikernes

Under gode forhold, med en andel falske positiver på 1 prosent, fanger detektoren opp omtrent 80 prosent av vannmerkede tekstutdrag på 200 tokens og rundt 95 prosent ved 400. Hvis 10 prosent av ordene byttes ut med synonymer, faller treffsikkerheten fra 92 til 66 prosent. Byttes en fjerdedel ut, synker den til 17 prosent. Korte svar, matematikk og oversatt tekst er svært vanskelige å fange opp. OpenAI advarer selv om at gode resultater under ideelle forhold «ikke garanterer pålitelig deteksjon i vanlig bruk», og at et manglende vannmerke ikke beviser at teksten er skrevet av et menneske. Selskapet sier også at merket ikke identifiserer brukeren.

Dermed er textGrain et brukbart signal mot lat kopiering og innliming, men et svakt vern mot alle som er villige til å bruke et minutt på å redigere teksten. I en union der folk leser og skriver på mange språk, er svakheten ved oversettelser ingen liten detalj.

Hvorfor EU, og hvorfor nå?

Det juridiske grunnlaget er artikkel 50 i AI Act, der åpenhetsreglene trådte i kraft 2. august. Den krever at leverandører av generative systemer merker syntetisk tekst, lyd, bilder og video på en maskinlesbar måte, og stiller en deteksjonsmekanisme til rådighet. Systemer som allerede var på markedet før denne datoen, deriblant ChatGPT, har fram til 2. desember på å oppfylle kravene. Brudd kan koste opptil 15 millioner euro eller 3 prosent av den globale årsomsetningen, avhengig av hvilket beløp som er høyest, ifølge en analyse fra advokatfirmaet Cooley.

To detaljer viser hvor tett utrullingen følger plikten, snarere enn et prinsipp. Den første er detektoren. Loven krever en deteksjonsmekanisme; OpenAI har utviklet en og bare gitt den til godkjente forskere og ekspertorganisasjoner, som må søke om tilgang. Selskapet sier at det vil åpne for flere «når vi mener resultatene kan tolkes på en ansvarlig måte», skriver The Decoder, men har ikke oppgitt noen tidsplan. En lærer eller redaktør i Lisboa eller Warszawa kan ikke undersøke en mistenkelig tekst i dag.

Den andre detaljen er hvor vannmerket brukes. Anthropic begynte å vannmerke tekst fra Claude i august, og bruker merket globalt, uavhengig av hvordan folk får tilgang til modellene. Det førte til kritikk fra enkelte brukere. OpenAI valgte motsatt løsning: på som standard der en tilsynsmyndighet kan ilegge bøter, valgfritt for utviklere andre steder og ingen global standardinnstilling ved lanseringen. Hvis den gamle frykten for at brukerne skulle gå over til konkurrenter uten vannmerker var borte, ville det vært liten grunn til å trekke grensen slik.

Hva skjer videre?

OpenAI sier at textGrain skal frigis som åpen kildekode, og at metoden matcher eller overgår løsninger som Googles SynthID. Begge påstandene kan testes når koden blir offentlig. Spørsmålet for Brussel er snevrere: om et merke som svekkes av lett redigering, og som nesten ingen kan bruke en detektor til å finne, oppfyller en regel som skal gjøre det mulig for andre systemer å gjenkjenne AI-tekst.

Etter 2. desember er det bare ChatGPT-brukerne som har en tilsynsmyndighet som kan sende regningen, som får OpenAIs signatur på teksten sin som standard.

Tagger: , , , ,

Legg oss til på Google

Diskusjon

Det er 0 kommentarer.