Tilbage til bloggen
AI-deteksjon

Kan du faktisk gjøre KI-tekst umulig å oppdage?

PPlagly.ai-teamet||9 min lesing

Dette er et av de mest søkte spørsmålene i hele feltet, og de fleste av svarene er skrevet av folk som selger noe. Så: ja, du kan som regel senke en detektorscore. Nei, det er ikke det samme som å gjøre tekst uoppdagelig. Og gapet mellom de to setningene er hvor de fleste problemene bor.

Her er hva som faktisk skjer mekanisk, hva det koster skrivingen, og når det er en rimelig ting å gjøre.

Énlinjessvaret

Humaniseringsverktøy fungerer for det meste ved å gjøre teksten mindre forutsigbar. Det senker de fleste scorer. Det gjør også skrivingen dårligere på en spesifikk, målbar måte — og det gjør ingenting med om teksten sier noe som er verdt å lese.

Hva detektorer måler, i ett avsnitt

Nesten alle koker ned til to ting: perplexity, grovt sett hvor overraskende hvert neste ord er, og burstiness, hvor mye setningslengde og kompleksitet varierer. Menneskelig skriving er ujevn — en lang, snirklete setning, så en kort en, og deretter et sidespor. Generert skriving har en tendens til å være glatt og jevnt tempoert. Alt annet er forfinelser oppå disse to idéene.

Så hva gjør egentlig en humanizer?

Når du vet hva som måles, er mottiltakene åpenbare, og de er nøyaktig hva disse verktøyene gjør:

  • Bryt opp rytmen. Splitt noen setninger, slå andre sammen, slik at lengdene varierer mer.
  • Bytt ut vanlige ord med mindre sannsynlige ord. Høyere perplexity med en gang.
  • Legg til små uregelmessigheter. Sammentrekninger, et setningsfragment, et mildt sidespor — teksturen til noen som taster framfor å generere.
  • Myk opp strukturen. Færre helt parallelle kulepunkter, færre ryddige oppsummerende konklusjoner.

Ingenting av dette er mystisk. Det er optimering direkte mot poengsummen, og det fungerer fordi poengsummen er en erstatning. Det er også dens svakhet.

Hva det koster deg

Dette er delen markedsføringssidene utelater, og den er konsistent nok til å være verdt å si tydelig fra om.

Betydningen forskyves

Ordbytte for uforutsigbarhet respekterer ikke presisjon. Tekniske begreper blir erstattet med nærsynonymer som ikke er synonymer. I en akademisk eller teknisk tekst er det slik du ender opp med å påstå noe du ikke mente — og personen som retter det vil legge merke til feilen lenge før noen detektor gjør det.

Det leses litt merkelig

Tekst optimert for statistisk uregelmessighet har en tekstur folk fanger opp uten å klare å navngi den: underlig valgt vokabular, setninger som varierer i lengde uten å variere i rytme, overganger som ikke helt lander. Lesere beskriver det som «rart» oftere enn «menneskelig».

Det er et bevegelig mål

Detektorer blir trent på nytt på humanisert tekst. Det er en direkte tilbakemeldingssløyfe: dagens omgåelse blir morgendagens treningsdata. Alt du limer inn i et verktøy som lover permanent uoppdagelighet lover deg noe ingen kan levere.

Hvem som faktisk spør om dette

Etter vår erfaring er det tre ganske ulike personer bak dette søket, og de trenger ulike svar.

Studenten som prøver å ikke bli tatt

Den ærlige risikovurderingen: humanizers senker poengsummer, men nullstiller dem ikke, mange institusjoner behandler nå bruk av humanizer som et eget brudd uavhengig av AI-bruk, og prosessbevisene — ingen utkast, ingen versjonshistorikk, en manglende evne til å diskutere ditt eget argument — er det som faktisk feller disse sakene. Du vil ta en reell risiko for å unngå arbeid som vanligvis er mindre enn det ser ut til.

Personen som ble feilaktig flagget

Hvis du skrev det selv og en detektor sier noe annet, er det å kjøre det gjennom en humanizer det dårligste trekkene som finnes. Du vil gjøre genuint arbeid statistisk merkeligere for å tilfredsstille et verktøy som allerede tok feil, og du vil ødelegge det ene som hjelper deg: en ren, konsistent utkasthistorikk. Vis utkastene. Spør hvilke passasjer som ble flagget. Snakk deg gjennom argumentet ditt.

Den profesjonelle skribenten som bruker AI som utkastverktøy

Dette er det vanligste tilfellet og det minst problematiske. Hvis du utformer et utkast med en modell og redigerer skikkelig, trenger du ikke en humanizer — redigering for mening produserer allerede variasjonen disse verktøyene forfalsker. Hvis det redigerte utkastet ditt fortsatt scorer høyt, forteller det deg som regel noe sant: skrivingen har forblitt generisk. Fiks det i stedet.

Spørsmålet bak spørsmålet

Nesten alle som spør hvordan man slår en detektor spør egentlig hvordan de kan levere inn noe uten å gjøre det underliggende arbeidet. Verdt å si rett ut: poengsummen er ikke tingen som vurderes. En lærer, en redaktør eller en ansettelsesansvarlig prøver å finne ut om du forstår noe. Et helt uoppdagelig essay som ikke sier noe, sier fortsatt ingenting.

Den mest pålitelige veien til tekst som ikke leses som generert er tekst som bare kunne vært skrevet av deg — et spesifikt eksempel, et tall fra ditt eget arbeid, et argument du vil forsvare. Det er ikke en omvei. Det er bare tingen skrivingen var ment å inneholde.

Hvor vi står

Vi bygger detektorer og vi bygger også et omskrivingsverktøy, så vi har en åpenbar interesse her og du bør lese dette med det i bakhodet. Vår ærlige posisjon: omskriving er legitimt for å forbedre tydelighet og flyt i eget arbeid, og å bruke det til å skjule forfatterskap der det har blitt spurt om det er ikke noe vi vil anbefale til noen.

Og på det opprinnelige spørsmålet — hvis et verktøy forteller deg at dets utdata er permanent uoppdagelig, er den påstanden uheldigvis ikke noe noen kan støtte. Deteksjon og omgåelse er det samme våpenkappløpet sett fra motsatte ender, og ingen av sidene får erklære det for avsluttet.

Check text for a specific AI model

Run your text through a detector tuned for the model you suspect.

Del denne artikkelen

Try Plagly.ai Free

Detect AI-generated content and check for plagiarism with industry-leading accuracy. No credit card required.

Get Started Free