En enkel klassrumsövning gav upphov till ett oväntat mönster i dussintals inlämningar. Utfallet belyser den växande utmaningen med att bedöma självständigt arbete i en tid då AI-verktyg är lättillgängliga.
En hänvisning till Madagaskar dök upp i 32 av 35 inlämningar efter att en professor vid Alcorn State University hade gömt en instruktion i en tentamensfråga.
Jason Gibson, som undervisar i historia vid universitetet i Mississippi, placerade vit text mot en vit bakgrund i en fråga om den industriella revolutionen. Instruktionen kunde följa med när studenterna kopierade frågan till en chattbot, trots att den inte var synlig vid vanlig läsning.
När Gibson granskade arbetena upptäckte han att nästan alla svar följde den dolda instruktionen genom att infoga Madagaskar i ett orelaterat stycke. Han uppgav för den lokala tv-kanalen WAPT att de 32 studenterna inte fick några poäng för den delen av examinationen.
Ledtråden har sina begränsningar
Det återkommande ordet tyder starkt på att den dolda instruktionen kopierades, bearbetades och återgavs. Det fastslår dock inte vilken chattbot som användes, om varje svar genererades i sin helhet eller om samtliga studenter använde samma metod.
Gibson tog till metoden efter att ha lagt märke till att flera studenters texter lät likartade och skilde sig från hur de uttryckte sig under lektionerna, enligt New York Post. Han uppgav också att traditionella AI-detektorer kunde kringgås genom omskrivningar och automatiserade skrivverktyg.
Oberoende forskning ger stöd för försiktighet när det gäller resultaten från AI-detektorer. I en studie från 2024 testade Mike Perkins och sex medförfattare sex system på 805 textprov. Den genomsnittliga träffsäkerheten sjönk från 39,5 procent till 17,4 procent efter att AI-genererade texter hade modifierats med metoder för att undvika upptäckt.
En separat studie, ledd av Debora Weber-Wulff, utvärderade tolv offentligt tillgängliga AI-detektorer och två kommersiella produkter. Studien publicerades i International Journal for Educational Integrity och drog slutsatsen att systemen inte var tillräckligt träffsäkra eller tillförlitliga för att på egen hand avgöra vem som hade skrivit en text.
Gibsons dolda instruktion gav honom en tydligare indikation än enbart ett resultat från en AI-detektor. Samtidigt har uppgifterna ännu inte verifierats oberoende genom en granskning av studenternas originalfiler.
Källor: WAPT, New York Post, Perkins m.fl., Weber-Wulff m.fl.