← Tilbage til bloggen

Lyder din tekst maskinskrevet? Sådan tjekker du det

Spørgsmålet dukker op oftere og oftere, og fra to meget forskellige retninger. Nogle forfattere har arbejdet med en sprogmodel og vil vide, om det kan ses. Andre har aldrig rørt ved en og frygter alligevel, at deres tekst bliver afvist, fordi den »lyder maskinskrevet«. Begge bekymringer er forståelige, for flere og flere forlag, agenter og skrivekonkurrencer kører de indsendte tekster gennem en scanner for automatisk genereret indhold, før et menneske læser dem.

Den dårlige nyhed: Der findes ingen pålidelig og endegyldig test, der én gang for alle siger »det her er skrevet af et menneske«. Den gode nyhed: Så snart du forstår, hvad detektorerne faktisk måler, og hvor upålidelige de kan være, holder du op med at frygte dem og gør det eneste, der virkelig hjælper: skriver, så teksten lyder som dig.

Kort svar: En detektor fastslår ikke »sandheden« om, hvem der har skrevet en tekst. Den måler prosaens statistiske form, og den tager ofte fejl, især af en ren, glat og lidt formel tekst. En dom som »denne tekst lyder maskinskrevet« er ikke et bevis. I stedet for at lede efter en mirakeldetektor skal du selv analysere teksten, finde de passager, der lyder mekaniske, og skrive dem om med din egen stemme.

Hvad »lyder maskinskrevet« egentlig betyder

En detektor forstår ikke din historie. Den ved ikke, om din hovedperson overbeviser, eller om din slutning holder. Den måler prosaens statistiske form: hvor forudsigeligt hvert næste ord er, hvor regelmæssig sætningsrytmen er, hvor ofte du griber til de samme konstruktioner, hvor lidt overraskelse en passage rummer. En maskingenereret tekst er som regel glat, regelmæssig i rytmen og fattig på overraskelser, og detektoren tæller derfor den regelmæssighed som et signal.

Det har to konsekvenser. For det første bedømmer detektoren en stil, ikke ærlighed. Derfor kan din egen omhyggelige og korrekte prosa få en dårlig score, selv om du har skrevet hvert ord selv. For det andet er det, der fremstilles som »kendetegnene ved genereret tekst« (sprogmodellernes yndlingsord, de pænt opstillede opremsninger, de færdigsyede overgange), stilistiske iagttagelser og ikke en pålidelig test. Nogle gange rammer kendetegnene rigtigt, andre gange vildleder de, og de ændrer sig med hver ny version af en model. Behandl dem som fingerpeg, ikke som en dom.

Hvorfor detektorer tager fejl oftere, end du tror

Det er ikke en forsigtig hypotese, men resultatet af fagfællebedømt forskning. Et hold fra Stanford (Liang et al., 2023, i tidsskriftet Patterns fra Cell Press) lod syv populære detektorer vurdere essays skrevet af mennesker, der ikke har engelsk som modersmål. Resultatet burde køle enhver af, der ser værktøjerne som et orakel: Detektorerne klassificerede fejlagtigt de menneskeskrevne essays som maskingenererede i gennemsnit i 61,3 % af tilfældene. Endnu værre: 89 ud af 91 essays, altså 97,8 %, blev markeret som maskintekst af mindst én af de syv detektorer. Til sammenligning var andelen af falske alarmer langt lavere for tekster skrevet af personer med engelsk som modersmål.

Konklusionen er dobbelt. På den ene side har værktøjerne en reel og høj andel af falske positiver. På den anden side er de skævvredne: De rammer hårdest dem, der skriver enklere, mere regelmæssigt og mere »skoleagtigt«, og det er ofte netop folk, der stadig er ved at lære håndværket, eller som skriver på et andet sprog end deres modersmål. Hvis en detektor en dag markerer din tekst, så husk det tal. Dommen fra et enkelt værktøj er ikke et bevis, men et skøn med en stor fejlmargin.

Sådan tjekker du din egen tekst med omtanke

Fordi hver enkelt detektor kan tage fejl, er det metoden, der tæller, ikke troen på ét værktøj.

  1. Se først på helheden for at få et udgangspunkt. Et samlet indtryk af hele bogen fortæller dig, om du har et lokalt problem eller et problem, der er jævnt fordelt.
  2. Gå derefter kapitel for kapitel. Passager, der lyder mekaniske, klumper sig som regel sammen. Et kapitel, der er skrevet i hast eller med hjælp fra et værktøj, stikker ofte ud.
  3. Læs de konkrete sætninger, ikke kun tallet. Et godt værktøj peger på bestemte sætninger. De sætninger er din redigeringsliste, ikke den procentsats, der står øverst på skærmen.
  4. Skriv dem om med dine egne ord. Bryd den alt for regelmæssige rytme, fjern fyldet, og udskift de generelle formuleringer med noget, der er særligt for din historie. Læs så passagen igen, og tjek, at den nu lyder som resten af bogen.
  5. Konkurrer ikke med detektoren. Målet er ikke at »slå« værktøjet, men at sørge for, at teksten virkelig lyder som dig, før en anden afgør det.

Hvad skal du konkret ændre, når en passage lyder mekanisk? Som regel det samme, som du alligevel ville rette, når du redigerer: Variér sætningslængden, fjern passive vendinger og intetsigende verber, og tilføj en konkret detalje, som kun din person kender. Det er ikke at lege med en detektor, det er simpelthen bedre prosa. Det skriver vi om for sig i artiklen om passiv i prosa.

En detektor til romanforfattere, ikke til stile

De fleste detektorer, man finder på nettet, er bygget til stile, artikler og skoleopgaver. De er generelle, beregner ofte deres score ord for ord og behandler en roman på 90 000 ord som én gigantisk tekstblok, der skal indsættes. De er ikke tænkt til fiktion, til opdelingen i kapitler eller til den måde, en romanforfatter faktisk skriver om på.

Skriveprogrammerne har det omvendte problem: De programmer, der er bygget op om at generere tekst, har af indlysende grunde ingen detektor. De fleste forfattere ender derfor med at vælge mellem et værktøj, der hjælper med at skrive, og en separat, generel kontrol, der aldrig er tænkt til bøger. Vellam har detektoren indbygget: Den viser, kapitel for kapitel eller for hele bogen, hvor mekanisk prosaen lyder, og fremhæver de sætninger, der scorer lavest, så du kan skrive dem om med dine egne ord. Men vær opmærksom: Detektoren understøtter endnu ikke dansk. Den fungerer i dag for tekster på polsk, engelsk, tysk, spansk, fransk, italiensk, portugisisk og nederlandsk. For et dansk manuskript gør Vellam i stedet det, der ligger forud for enhver detektor: manuskriptanalysen læser hele bogen kapitel for kapitel på dansk og tjekker konsistensen, og håndværksanalysen viser for hvert kapitel styrker og svagheder med citater fra din tekst, så du kan finde de steder, hvor prosaen bliver flad og generel, altså netop den slags passager, der også kan vække en detektors mistanke. Den regelbaserede stilanalyse findes indtil videre kun på polsk, engelsk, tysk og spansk. Det hele er tænkt som et tjek, der skal berolige dig som forfatter, ikke som en dør, en anden har nøglen til. Vil du vide mere om, hvordan du forbereder et manuskript før indsendelse, så læs den supplerende artikel om at tjekke din roman, før du sender den ind.

Husk én ting: Også en indbygget detektor giver et skøn, ikke et orakel. Scoren alene afgør intet. Værdien ligger ikke i procentsatsen, men i de fremhævede sætninger, du kan arbejde med, og dem kan du også finde selv med metoden ovenfor.

Hvad du hellere skal undgå

Til sidst tre fælder, man let falder i, så snart man frygter, at ens tekst lyder mekanisk.

Skriv ikke hele din bog om for at få en bestemt score

Hvis en detektor giver en høj procentsats, men teksten virkelig er din, ligger problemet i værktøjet, ikke i teksten. Læs de markerede sætninger, og vurder dem selv.

Stol ikke på en enkelt detektor

Med 61 % falske alarmer på menneskelig prosa afgør en enkelt dom intet. Sammenlign i det mindste nogle få detektorer, og læs de konkrete passager.

Forveksl ikke flydende sprog med skyld

En ren og regelmæssig sætning er ikke bevis på en maskine. Nogle gange er det simpelthen en ren sætning. Ret den, fordi den læses upersonligt, ikke fordi et værktøj lyser rødt.

Ofte stillede spørgsmål

Er detektorer for genereret tekst pålidelige?

Kun delvist. Fagfællebedømt forskning fra Stanford, offentliggjort i 2023, viste, at populære detektorer fejlagtigt klassificerede menneskeskrevne essays som maskingenererede i gennemsnit i 61,3 % af tilfældene, og at 97,8 % af teksterne blev markeret af mindst én af de syv detektorer. Dommen fra et enkelt værktøj er et skøn med en stor fejlmargin, ikke et bevis på, hvem forfatteren er.

Hvordan ved man, om en tekst lyder, som om en maskine har skrevet den?

Detektorer reagerer på prosaens statistiske form: høj forudsigelighed i ordvalget, regelmæssig sætningsrytme, gentagne konstruktioner og lidt overraskelse. De såkaldte »kendetegn ved genereret tekst« er stilistiske iagttagelser og ikke en pålidelig test, og de ændrer sig med hver ny version af en model. Se dem som fingerpeg, og bygg din beslutning på, om en passage lyder som dig.

Kan min tekst blive markeret som maskintekst, selv om jeg har skrevet den selv?

Ja, og det sker ofte. Detektorer rammer hårdest dem, der skriver enklere, mere regelmæssigt og mere formelt, blandt andre folk, der er ved at lære håndværket, og forfattere, der ikke skriver på deres modersmål. En falsk markering betyder ikke, at du har gjort noget forkert, men at værktøjet tager fejl.

Hvordan forbedrer man en passage, der lyder mekanisk?

Som regel på samme måde, som du ville forbedre den, når du redigerer: Variér sætningslængden, fjern intetsigende verber og passive vendinger, tilføj en konkret detalje fra din egen historie, og bryd den alt for regelmæssige rytme. Målet er ikke at slå detektoren, men at få sætningen til at lyde som resten af din bog.

Vellam læser din roman kapitel for kapitel på dansk, tjekker konsistensen i hele bogen og viser i håndværksanalysen, med citater, hvor prosaen halter, så du kan skrive de passager om med dine egne ord. De første ca. 5.000 ord er gratis.

Prøv Vellam →

Din tekst forbliver din · Vi træner aldrig modeller på den

Se, hvad manuskriptanalysen finder i hele bogen →