OpenAI inför osynlig textvattenmärkning för ChatGPT i EU för att följa AI-förordningen

Bild: TechCrunch · Källa
OpenAI kommer att införa osynliga vattenstämplar i ChatGPT- och Codex-utdata inom EU, vilket möjliggör identifiering av AI-innehåll enligt nya regler, samtidigt som selektiv upptäckt tillåts och begränsningar erkänns vid redigering eller förkortning.
OpenAI implementerar en teknik för osynlig vattenmärkning av text som genereras av dess ChatGPT- och Codex-modeller inom Europeiska unionen för att följa EU:s AI-förordnings transparenskrav som trädde i kraft i augusti 2026. Denna lagstiftning kräver att AI-företag märker AI-genererat innehåll på ett sätt som andra system kan upptäcka.
Vattenmärkningen kommer att införas gradvis för berättigade användare av ChatGPT och Codex på alla prenumerationsnivåer men uteslutande inom EU-regionen. Samtidigt kan utvecklare som använder OpenAI:s API globalt aktivera vattenmärkning på utvalda modeller omedelbart, även om det som standard är avstängt globalt. OpenAI har för närvarande inga planer på att tvinga igenom vattenmärkning globalt.
Till skillnad från vanliga synliga märken införs vattenstämpeln genom att subtilt påverka AI:ns ordvalsmönster. Detta skapar en omärklig signatur i själva texten som gör det möjligt för detektionsverktyg att identifiera AI-genererade avsnitt även efter kopiering eller inklistring. OpenAI betonar att vattenstämpeln inte spårar användaridentiteter och inte märkbart påverkar modellens outputkvalitet.
För att stödja transparens publicerade OpenAI en teknisk rapport som beskriver deras vattenmärkningsmetod, kallad textGrain. Metoden, utvecklad i samarbete med forskare från University of Pennsylvania och Yale, använder en hemlig nyckel för att omordna nästa ords sannolikheter och infogar mönster genom hela texten. Detektion bygger enbart på texten och denna hemliga nyckel.
OpenAI erkänner dock begränsningar: redigering kan minska vattenmärkningens upptäckbarhet. Till exempel sjönk upptäcktsnoggrannheten från cirka 92 % till 66 % när 10 % av orden ersattes med synonymer. Dessutom utgör kortare textsegment, matematiska svar och översatt innehåll utmaningar för detektering. Av dessa skäl är tillgång till vattenmärkningens detektion inledningsvis begränsad till godkända forskare och expertorgan för att säkerställa ansvarsfull utvärdering.
OpenAI poängterar att avsaknad av vattenmärkning inte bekräftar mänskligt författarskap eftersom innehåll kan ha redigerats kraftigt, vara för kort eller genererats av andra AI-leverantörer. Vattenstämpeln signalerar endast att ett OpenAI-system varit involverat i att producera eller bearbeta texten, inte graden av mänskligt bidrag eller kreativitet.
Detta initiativ följer en liknande åtgärd från Anthropic, som började använda vattenmärkning på AI-modellen Claude globalt i augusti 2026, även om den satsningen mötte kritik från användare som framhöll sin roll i att ge instruktioner och kontext. OpenAI utvecklade tidigare vattenmärkning men fördröjde lanseringen delvis på grund av oro för att användare skulle migrera till konkurrenter utan vattenmärkning.
Branschledare som Anthropic, Google, Meta, Microsoft och OpenAI har lovat att följa EU:s uppförandekod för AI-genererat innehåll, i linje med ökande krav på transparens och ansvarstagande för AI.

Källor och ursprunglig rapportering
Läs den ursprungliga källan ↗

Kommentarer (0)
Inga kommentarer ännu. Börja diskussionen.
Skriv en kommentar
Kommentarer publiceras efter granskning. Ditt namn och kommentar syns offentligt. Konto