We leven in een tijdperk waarin een simpele scroll door sociale media paranoia kan veroorzaken. Heeft een mens dit geschreven? Of heeft een LLM het uitgespuugd?
Het antwoord is belangrijk. Of je nu essays beoordeelt, schrijvers inhuurt of gewoon moe bent van het online lezen van steriele inhoud, je wilt de waarheid weten. Vermoedelijk laat AI vingerafdrukken achter. Het em-streepje is de gebruikelijke verdachte. Monotone toon. De andere.
Maar kunnen tools deze tics daadwerkelijk op betrouwbare wijze detecteren?
Ik heb vijf populaire AI-detectoren vergeleken met een gecontroleerd experiment. Aan de ene kant: vier artikelen die ik met de hand heb geschreven (geen bots). Aan de andere kant: intro’s van 150 woorden gegenereerd door ChatGPT, Gemini en Claude op basis van mijn artikeltitels.
De resultaten? Sommige tools hebben het opgelost. Anderen misten het doel hard.
Pangram: De zelfverzekerde schijf
Pangram beweert de detector te zijn die ‘echt werkt’. Het is niet voor altijd gratis, maar met het gratis niveau zijn vier controles per dag mogelijk. Betaalde abonnementen beginnen bij $ 20.
Dit is wat er gebeurde:
* Mijn schrijven: 100% menselijk. Hoog vertrouwen.
* ChatGPT/Claude-tekst: 100% AI.
Pangram identificeerde elk monster correct. Het benadrukte zelfs specifieke weggeefacties, zoals de repetitieve ‘vanaf het moment dat je…’-structuur in de AI-voorbeelden.
Uitspraak: 4/4 correct.
Grammaticaal: de grammaticagigant komt de chat binnen
U gebruikt waarschijnlijk Grammarly voor typefouten. Nu markeert het ook AI. Gratis accounts ontvangen dagelijks drie cheques. Betaalde abonnementen beginnen bij $ 12.
Mijn monsters? Nul procent AI. Geen patronen. Schone lei.
De AI-monsters? Niet zo zwart-wit.
*Claude: 68% AI.
* Tweelingen: 66% AI.
Grammaticaal zag de AI-vingerafdrukken. Maar het was niet helemaal overtuigd. Het zag de patronen, maar aarzelde over het oordeel. Toch klopte de oproep.
Uitspraak: 4/4 correct.
GPTZero: Het behoud van de mens
De missie van GPTZero is “het behouden van wat menselijk is.” Gratis gebruikers kunnen 10.000 woorden per maand scannen. Betaalde abonnementen beginnen rond de $ 24.
Bij het derde hulpmiddel werd ik eigenwijs. Mijn schrijfstijl moet duidelijk non-AI zijn. GPTZero was het daarmee eens. “Ik heb er alle vertrouwen in dat deze tekst volledig menselijk is.”
Toen de AI-monsters werden gevoerd, werden ze ook gevangen. Er werd zelfs aangegeven welke zinnen er het meest robotachtig uitzagen. Ik had moeite om het patroon te zien. Misschien is het daar. Misschien niet. Maar de tool heeft ze niet gemist.
Uitspraak: 4/4 correct.
Scribbr: De gratis uitbijter
Scribbr biedt bewerkingsdiensten en een gratis detector. Geen account nodig. Gewoon plakken en controleren.
Mijn schrijven? Gezuiverd als 100% mens. Goed.
De AI-monsters? Ook gemarkeerd als 100% door mensen geschreven.
Dit is waar het kapot ging. Scribbr beweerde dat de ChatGPT- en Claude-teksten volledig menselijk waren. De tool leek veel vertrouwen te hebben in het verkeerde antwoord. Wat het algoritme ook is, het heeft een update nodig.
Uitspraak: 2/4 correct.
Copyleaks: de half-rechtse mededinger
Copyleaks controleert tekst, afbeeldingen en video. Vier gratis scans. Betaalde niveaus beginnen bij $ 17.
Mijn tekst? 100% mensvrij.
De AI-test? Gemengde zak.
* Tweeling: 100% AI (correct).
* Claude: 0% AI (onjuist).
Copyleaks ving de ene bot op, maar liet de andere glijden. Het lijkt te worstelen met kalibratie, afhankelijk van welk model je test.
Uitspraak: 3/4 correct.
De laatste afhaalmaaltijd
Ik wist niet zeker wat ik kon verwachten. Daarom heb ik ze getest. Maar nu? Het is duidelijker.
AI-detectoren zijn niet perfect.
Ze werkten consequent om mijn menselijke schrijven te identificeren. Elk afzonderlijk hulpmiddel markeerde mijn tekst als menselijk. Het lijkt gemakkelijker om te bevestigen wat geen AI is dan wat het wel is.
Het omgekeerde was niet waar. Scribbr faalde zwaar. Copyleaks miste de helft van de bots. De anderen waren perfect in dit kleine monster.
Als je serieus wilt beginnen met het schrijven van AI, vertrouw dan niet op één tool. Gebruik er twee of drie achter elkaar. Zoek naar patronen. En misschien upgraden voor gedetailleerde redenering als de inzet hoog is.
Is er een definitieve tell? Misschien. Of misschien is het gewoon een kat-en-muisspel dat bij elke modelupdate verandert.
Openbaarmaking: het moederbedrijf van Popular Science heeft OpenAI in april 2024 aangeklaagd wegens inbreuk op het auteursrecht. Deze context kan het landschap beïnvloeden, hoewel de bovenstaande testresultaten de prestaties van de tools afzonderlijk weerspiegelen.




















