Frågan dyker upp allt oftare, och från två helt olika håll. Vissa författare har arbetat med en språkmodell och vill veta om det märks. Andra har aldrig rört någon och är ändå rädda att deras text ska refuseras för att den ”låter maskinskriven”. Båda farhågorna är begripliga, eftersom allt fler förlag, agenter och skrivartävlingar kör inkomna texter genom en skanner för automatiskt genererat innehåll innan en människa läser dem.
De dåliga nyheterna: det finns inget tillförlitligt och slutgiltigt test som en gång för alla säger ”det här har en människa skrivit”. De goda nyheterna: så snart du förstår vad de här detektorerna faktiskt mäter och hur otillförlitliga de kan vara slutar du vara rädd för dem, och du gör det enda som verkligen hjälper: skriver så att texten låter som du.
Kort svar: en detektor fastställer inte ”sanningen” om vem som skrivit en text, den mäter prosans statistiska form, och den tar ofta fel, särskilt på en ren, slät och lite formell text. Ett utlåtande av typen ”den här texten ser maskinskriven ut” är inget bevis. I stället för att leta efter en mirakeldetektor kan du analysera texten själv, hitta de ställen som låter maskinmässiga och skriva om dem med din egen röst.
Vad ”ser maskinskriven ut” egentligen betyder
En detektor förstår inte din berättelse. Den vet inte om din huvudperson övertygar eller om ditt slut håller. Den mäter prosans statistiska form: hur förutsägbart varje nästa ord är, hur regelbunden meningsrytmen är, hur ofta du tar till samma konstruktioner, hur lite överraskning ett stycke innehåller. En maskingenererad text är i regel slät, regelbunden i rytmen och fattig på överraskningar, och detektorn räknar därför den regelbundenheten som en signal.
Av det följer två saker. För det första bedömer detektorn en stil, inte en ärlighet. Därför kan din egen prosa, omsorgsfull och korrekt, få ett dåligt betyg trots att du har skrivit varje ord själv. För det andra är det som brukar presenteras som ”kännetecknen på genererad text” (språkmodellernas favoritord, prydligt uppradade uppräkningar, färdiga övergångar) stilistiska iakttagelser, inte ett tillförlitligt test. Ibland stämmer kännetecknen, ibland är de vilseledande, och de förändras med varje ny version av en modell. Behandla dem som ledtrådar, inte som en dom.
Varför detektorer tar fel oftare än du tror
Det här är ingen försiktig hypotes, det är resultatet av expertgranskad forskning. Ett team från Stanford (Liang m.fl., 2023, i tidskriften Patterns från Cell Press) lät sju populära detektorer bedöma uppsatser skrivna av personer som inte har engelska som modersmål. Resultatet borde ge alla som ser verktygen som ett orakel en tankeställare: detektorerna klassade felaktigt de mänskliga uppsatserna som automatiskt genererade i genomsnitt i 61,3 % av fallen. Ännu värre: 89 uppsatser av 91, alltså 97,8 %, flaggades som maskintext av minst en av de sju detektorerna. Som jämförelse var andelen falsklarm betydligt lägre för texter av skribenter med engelska som modersmål.
Slutsatsen är dubbel. Å ena sidan har verktygen en verklig och hög andel falska positiva. Å andra sidan är de snedvridna: de slår hårdast mot dem som skriver enklare, mer regelbundet, mer ”skolmässigt”, och det är ofta just personer som fortfarande lär sig hantverket eller som skriver på ett annat språk än sitt modersmål. Om en detektor någon gång flaggar din text, kom ihåg den siffran. Utlåtandet från ett enda verktyg är inget bevis, det är en uppskattning med stor felmarginal.
Så kontrollerar du din egen text med omdöme
Eftersom varje enskild detektor kan ta fel är det metoden som räknas, inte tron på ett enda verktyg.
- Analysera först helheten för att få en utgångspunkt. En siffra för hela boken säger dig om du har ett avgränsat problem eller ett som är jämnt utspritt.
- Gå sedan igenom kapitel för kapitel. Ställen som låter maskinmässiga ligger i regel samlade. Ett kapitel som skrivits i all hast, eller med hjälp av ett verktyg, sticker ofta ut.
- Läs meningarna med lägst betyg, inte bara siffran. En bra detektor pekar ut bestämda meningar. De meningarna är din redigeringslista, inte procentsatsen högst upp på skärmen.
- Skriv om dem med dina egna ord. Bryt den alltför regelbundna rytmen, stryk utfyllnaden, byt allmänna formuleringar mot något som hör just till din berättelse. Läs sedan stycket igen och kontrollera att det nu låter som resten av boken.
- Tävla inte med detektorn. Målet är inte att ”slå” verktyget, utan att se till att texten verkligen låter som du, innan någon annan avgör saken.
Vad ska du konkret ändra när ett stycke låter maskinmässigt? I regel samma sak som du ändå skulle rätta vid redigeringen: variera meningslängden, stryk passiva konstruktioner och intetsägande verb, lägg till en konkret detalj som bara din karaktär känner till. Det är inte att spela ett spel med en detektor, det är helt enkelt bättre prosa. Vi tar upp det separat i artikeln om passiv form i prosa.
En detektor för romanförfattare, inte för uppsatser
De flesta detektorer som finns på nätet är byggda för uppsatser, artiklar och skolarbeten. De är allmänna, räknar ofta ut sitt betyg på nivån av enskilda ord och behandlar en roman på 90 000 ord som ett gigantiskt textblock att klistra in. De är inte tänkta för fiktion, för indelningen i kapitel eller för hur en romanförfattare faktiskt skriver om.
Skrivprogrammen har det omvända problemet: de som är inriktade på att generera text har av uppenbara skäl ingen detektor. De flesta författare hamnar därför i ett val mellan ett verktyg som hjälper till att skriva och en separat, allmän granskare som aldrig var tänkt för böcker. Vellam har en inbyggd detektor som visar, kapitel för kapitel eller för hela boken, hur maskinmässig prosan låter och markerar de meningar som får lägst betyg. Men var tydlig med en sak: detektorn stöder ännu inte svenska. I dag fungerar den för polska, engelska, tyska, spanska, franska, italienska, portugisiska och nederländska. För ett svenskt manus gäller därför metoden ovan, genomförd av dig själv. Det Vellam gör för din svenska text är att läsa hela manuset kapitel för kapitel, följa karaktärer, platser och handlingstrådar och ge en hantverksanalys av varje kapitel, och den läsningen pekar också ut ställen där prosan blir slätstruken och opersonlig. Det är ett sätt att lugna dig själv, författaren, inte en dörr som någon annan har nyckeln till. Vill du veta mer om granskningen före inskick kan du läsa den kompletterande artikeln om att kontrollera din roman innan du skickar in den.
Kom ihåg en sak: även en inbyggd detektor ger en uppskattning, inte ett orakel. Betyget ensamt avgör ingenting. Värdet ligger inte i procentsatsen utan i de markerade meningarna som du kan arbeta med.
Det här gör du bäst i att undvika
Till sist tre fällor som man lätt går i så snart man är rädd att texten ska verka maskinmässig.
Skriv inte om hela boken för att få ett visst betyg
Om en detektor ger en hög procentsats men texten verkligen är din ligger problemet hos verktyget, inte hos texten. Läs de flaggade meningarna och bedöm dem själv.
Lita inte på en enda detektor
Med 61 % falsklarm på mänsklig prosa avgör ett enskilt utlåtande ingenting. Jämför som mest några detektorer och läs de konkreta ställena.
Blanda inte ihop flyt med skuld
En ren och regelbunden mening är inget bevis på en maskin. Ibland är det helt enkelt en ren mening. Ändra den om den låter opersonlig, inte för att ett verktyg lyser rött.
Vanliga frågor
Är detektorer för genererad text tillförlitliga?
Bara delvis. Expertgranskad forskning från Stanford, publicerad 2023, visade att populära detektorer felaktigt klassade mänskliga uppsatser som automatiskt genererade i genomsnitt i 61,3 % av fallen, och att 97,8 % av texterna flaggades av minst en av de sju detektorerna. Utlåtandet från ett enda verktyg är en uppskattning med stor felmarginal, inte ett bevis på vem som är författaren.
Hur vet man om en text läses som om en maskin skrivit den?
Detektorer reagerar på prosans statistiska form: hög förutsägbarhet i orden, regelbunden meningsrytm, upprepade konstruktioner och lite överraskning. Det som kallas ”kännetecknen på genererad text” är stilistiska iakttagelser och inte ett tillförlitligt test, och kännetecknen förändras med varje ny version av en modell. Se dem som ledtrådar och grunda ditt beslut på om ett stycke låter som du.
Kan min text flaggas som maskintext fast jag har skrivit den själv?
Ja, och det händer ofta. Detektorer slår hårdast mot dem som skriver enklare, mer regelbundet och mer formellt, bland annat personer som lär sig hantverket och författare som inte skriver på sitt modersmål. Ett falskt larm betyder inte att du har gjort något fel, utan att verktyget tar fel.
Hur förbättrar man ett stycke som låter maskinmässigt?
I regel på samma sätt som du skulle förbättra det vid redigeringen: variera meningslängden, stryk intetsägande verb och passiva konstruktioner, lägg till en konkret detalj ur din egen berättelse och bryt den alltför regelbundna rytmen. Målet är inte att slå detektorn, utan att få meningen att låta som resten av din bok.