»Denne roman er skrevet af et menneske«. Sådan indleder jeg min nyeste roman, ’Menneskeskabt’. Denne indledende konstatering er egentlig tænkt som en metakommentar, da romanen handler om kunst genereret af kunstig intelligens – men i lyset af de seneste dages hændelser i den europæiske litterære sfære er jeg pludselig lettet over at have valgt at begynde min historie sådan.
I fredags fjernede akademiet bag den prestigefulde franske litteraturpris, Goncourt, romanen ’C’était ça ou mourir’ (Det var det eller dø) fra deres longlist, efter anklager om brug af kunstig intelligens. Romanen har allerede vundet den franske pris Prix du Roman Fnac, er planlagt til oversættelse til over 20 sprog og er solgt i knap 35.000 eksemplarer.
Blandt beviserne er resultater fra den amerikanske ai-detektor Pangram, der vurderer, at romanen med 95 procents sandsynlighed er skrevet af kunstig intelligens – og ikke, som ellers angivet, af den canadisk-haitianske forfatter Thélyson Orélien.
Akademiet begrundede deres valg med, at prisens formål er at ære menneskeskabt litteratur. Som både forfatter og menneske, virker dette ved første øjekast som en sejr for alle os, der har brugt fire år på at skrive vores 500 sider lange roman selv.
Alligevel skabte avisoverskrifterne uro i mit hoved: Sagen om tilblivelsen af Oréliens roman er en af de hidtil mest opsigtsvækkende sager, hvor en anklage om brug af kunstig intelligens har fået store institutionelle konsekvenser for en forfatter – og en sag, der meget vel kan blive en europæisk prøvesag på, hvordan vi, der elsker litteraturen, forholder os til værker genereret af kunstig intelligens – og ikke mindst, hvordan vi afgør, hvorvidt dette overhovedet er tilfældet.
I 1950 definerede den britiske datalog Alan Turing en test for maskinintelligens. Testen går ud på, at en forsøgsperson fører en skriftlig samtale med både et andet menneske og en maskine. Hvis forsøgspersonen efter samtalen er ude af stand til at vurdere, hvem der er menneske, og hvem der er maskine, består maskinen denne såkaldte Turing-test.
Siden har datalogisk forskning været drevet af idéen om denne maskine, der kan foregive at være et menneske. Og nu er det åbenbart vores tur til at bestå en ny form for omvendt Turing-test: Nu skal vi mennesker bevise, at vi ikke er maskiner. Og ligesom vi bedømte, om maskinerne var menneskelige nok, er det nu åbenbart maskinerne, der skal bedømme, om vi minder for meget om dem.
Opgaven med at afgøre, om en teksts ophavsmand er maskinel eller menneskelig, har man tidligere forsøgt at løse ved at måle en teksts forudsigelighed; modeller skriver stilrent, og mennesker skriver kaotisk – men dette har ikke ledt til tilfredsstillende resultater.
Pangram opnår derimod sin imponerende træfsikkerhed ved at have lært at genkende de statistiske sproglige mønstre, der kendetegner henholdsvis menneskeskabte og maskinskrevne tekster. Ifølge forskerne bag blev kun et ud af 24.300 menneskeskrevne dokumenter i deres testdata fejlagtigt vurderet til at være skrevet af en ai.
Et af de sproglige gennemgående mønstre, der har antændt ai-alarmen i Oréliens tekst, er en systematisk brug af konstruktionen ’ikke X, ikke Y, men Z’ – en struktur, som vi vist er mange, der genkender, fra når de store sprogmodeller møjsommeligt møver sig uden om en konklusion.
Orélien påpeger selv, at disse ai-lignende konstruktioner skyldes, at han skriver på canadisk fransk inspireret af haitianske sproglige rytmer. Det er ganske rigtigt et velkendt problem inden for sprogteknologi, at en sprogmodel kan klare sig fremragende gennemsnitligt, men inden for sproglige ydertilfælde, såsom små sprog, særlige dialekter eller etnolekter, kan have markant dårligere nøjagtighed.
Pangram hævder, at detektoren bevarer samme vanvittige nøjagtighed på fransk. Men selv hvis Pangram aldrig tager fejl på sit franske testmateriale, fortæller det ikke nødvendigvis, hvor sjældent den tager fejl, når den klassificerer canadisk-haitianske forfattere, der skriver på fransk. Denne sproglige gruppe er så sjælden, at den formodentligt forekommer få gange eller overhovedet ikke i testmaterialet – og dermed har denne sproglige gruppe måske haft minimal eller ingen indflydelse på den generelle fejlrate. En model kan altså sagtens have en meget lav fejlrate og samtidig systematisk misforstå bestemte sproglige mønstre.
Som udvikler af kunstig intelligens mener jeg derfor, at en statistisk models bedømmelse aldrig bør tolkes uden en grundig undersøgelse af modellens bias og faldgruber, og at bedømmelsen altid bør indgå som et perspektiv i en større menneskelig vurdering. Som forfatter tænker jeg, om det ikke er en smule ironisk at skrinlægge et spirende forfatterskab på baggrund af en anklage om kunstig intelligens, når et af anklagens væsentligste vidner selv er en kunstig intelligens?
Hvorvidt Orélien rent faktisk har skrevet sin bog selv eller ej, skal jeg ikke – modsat så mange andre, forsøge at konkludere – og det langt vigtigere spørgsmål er i mine øjne: Hvilke konsekvenser har denne nye type anklager for fremtidens litteratur?
Selv er jeg lettet over, at jeg debuterede før kunstig intelligens – det er vel en slags bevis på, at jeg altså godt kunne skrive, før maskinerne lærte det. Alligevel sneg frygten for de falske anklager sig ind i tilblivelsesprocessen til min nyeste roman, ’Menneskeskabt’, da jeg i mit naturlige sprog har en forkærlighed for at bruge bindestreg. I processen blev jeg opmærksom på, at jeg deler denne forkærlighed med ChatGPT, og jeg bevidnede, hvordan folk på sociale medier drev heksejagt på de arme (eller måske ai-skyldige) sjæle, der kom til at bruge tegnet.
Panisk spurgte jeg min redaktør, om jeg skulle eliminere mine bindestreger, men hun holdt fast: Selvfølgelig skulle jeg som menneske ikke ændre min skrivestil for at afvige fra en maskine. For vi må huske, hvordan disse maskiner overhovedet har lært at skrive bøger: Det har de ved at læse vores!
Hvis vi lader ai-detektorer være fremtidens sandsigere, risikerer vi, at forfattere fremover aktivt skal skrive anderledes for at afvige fra de maskiner, der har lært at efterligne os. Dermed bevæger vi os ud i en mærkelig dans, hvor maskinerne med buldrende hastighed nærmer sig os, og vi dermed fjerner os fra det, vi plejede at være, fordi vi for alt i verden ikke vil minde om dem.
At blive beskyldt for at bruge kunstig intelligens er en dødsdom for et forfatterskab – som min slags nu åbenbart også skal bruge energi på både at frygte og undvige. Samtidig kan jeg ikke lade være med at tænke på, hvilken dødsdom der er størst for litteraturen: At en maskinskrevet roman vinder en litterær pris. Eller at det skal være den nye realitet, at man som forfatter kan få ødelagt alt, hvad man har bygget op, fordi en maskine fejlagtigt har vurderet, at man ikke skriver menneskeligt nok.
Dette er et debatindlæg. Indlægget er udtryk for skribentens holdning. Alle holdninger, som kan udtrykkes inden for straffelovens og presseetikkens rammer, er velkomne, og du kan også sende os din mening her.