Wie ChatGPT gebruikt om een sollicitatiebrief, schooltaak of dat bijzonder overtuigende mailtje naar de baas te schrijven, krijgt er binnenkort iets gratis bij: een onzichtbare handtekening. OpenAI gaat in Europa teksten uit ChatGPT en Codex voorzien van een digitaal watermerk.
Europa wil graag weten wanneer iets door artificiële intelligentie is gemaakt. Begrijpelijk: inmiddels kan AI foto's maken, stemmen nabootsen en teksten produceren waarvan zelfs je collega die nog steeds twee spaties na een punt zet zegt: “Amai, goed geschreven.”
Daarom begint OpenAI de komende weken in de Europese Unie met textGrain. Dat is een techniek die teksten uit ChatGPT en Codex herkenbaar moet maken als AI-product.
Geen geheim tekentje
Wie nu denkt dat ergens tussen je letters een verborgen stempel met MADE BY CHATGPT wordt geplakt: zo werkt het niet.
TextGrain verandert heel subtiel de manier waarop ChatGPT woorden kiest. Daardoor ontstaat over een langere tekst een statistisch patroon dat door software kan herkend worden. Voor een mens blijft de tekst er gewoon uitzien als tekst. Geen watermerk in de hoek, geen mysterieuze code en ook geen kleine Sam Altman-handtekening onderaan.
Het systeem wordt ingevoerd vanwege de transparantieverplichtingen van de Europese AI Act en zal gelden voor geschikte tekst die via ChatGPT en Codex in de EU wordt gegenereerd.
Alleen is de perfecte misdaad vrij eenvoudig
Interessanter is wat er gebeurt wanneer iemand de tekst achteraf bewerkt. OpenAI testte dat zelf. Bij teksten van ongeveer 300 woorden werd aanvankelijk ongeveer 92 procent van de watermerken herkend. Wanneer slechts 10 procent van de woorden door synoniemen werd vervangen, zakte dat naar ongeveer 66 procent. Bij 25 procent vervangen bleef nog ongeveer 17 procent over.
Met andere woorden: ChatGPT laat voortaan kruimeltjes achter, maar wie daarna stevig met de tekst aan de slag gaat, veegt een groot deel ervan alweer van tafel.
Korte teksten zijn sowieso moeilijker. Wie ChatGPT vraagt om “Proficiat met je verjaardag, makker!” even te herschrijven, hoeft dus niet te vrezen dat Europol morgen aanbelt.
Betrapt!
Ook belangrijk voor studenten, journalisten en iedereen die binnenkort zenuwachtig naar een AI-detector kijkt: een gevonden watermerk bewijst niet dat iemand gewoon op Ctrl+C, Ctrl+V heeft gedrukt.
Het systeem kan niet vertellen wie de tekst genereerde, welke prompt daarvoor werd gebruikt of hoeveel een mens er nadien zelf aan veranderde. Omgekeerd betekent het ontbreken van een herkenbaar watermerk evenmin dat een tekst gegarandeerd door een mens is geschreven.
OpenAI maakt de detector daarom voorlopig ook niet zomaar voor iedereen beschikbaar. Eerst krijgen geselecteerde onderzoekers en gespecialiseerde organisaties toegang.
Een leraar kan dus nog niet na iedere opsteltoets de grote rode knop VANG DE CHATGPT-CHEATER indrukken.
De ironie
En daar zit meteen het vreemde aan het hele systeem. Europa wil AI-teksten herkenbaar maken, maar hoe meer een mens zo'n tekst herschrijft, corrigeert en naar zijn eigen hand zet, hoe moeilijker de AI-oorsprong te herkennen wordt.
Eigenlijk niet eens zo gek. Op een bepaald moment wordt de vraag immers filosofisch: als ChatGPT een eerste versie schrijft en jij de helft schrapt, woorden vervangt, zinnen omgooit, grappen toevoegt en de conclusie herschrijft, wiens tekst is het dan nog? Daar mag Europa zich nu over buigen.
Wij hebben intussen vooral slecht nieuws voor iedereen die dacht eindelijk een feilloze ChatGPT-leugendetector te krijgen. Zelfs artificiële intelligentie blijkt haar handtekening niet te kunnen zetten zonder dat iemand ze achteraf kan uitgommen.