Amazon heeft een vervaldatum vastgesteld. Op 30 juli 2026 zal Mechanical Turk stoppen met het accepteren van nieuwe klanten. Bestaande accounts blijven actief, en Amazon zegt dat het de beveiliging en uptime van het platform zal handhaven. Maar het bedrijf heeft ook duidelijk gemaakt dat er geen nieuwe functies meer komen. Voor een dienst die een tijdperk van internetarbeid hielp definiëren, is dat in feite een aankondiging dat het platform wordt uitgefaseerd.
De oorspronkelijke marktplaats voor gigwerk
Mechanical Turk werd gelanceerd in 2005, ruim voordat apps zoals Uber of TaskRabbit incidentele arbeid tot een bekend concept maakten. Amazon bouwde het als een marktplaats voor "human intelligence tasks" — kleine klusjes die software nog niet kon afhandelen. Werknemers, meestal anoniem en verspreid over de hele wereld, logden in om audiofragmenten te transcriberen, winkeladresgegevens te verifiëren, content te modereren en afbeeldingen te taggen. Iemand nodig om een CAPTCHA op te lossen, zoekresultaten te rangschikken of te beoordelen of een productreview positief of boos klonk? MTurk was de plek.
Prijzen werden vaak in centen gemeten. Een batch van duizend beeldclassificaties leverde misschien een cent per stuk op. Voor onderzoekers, marketeers en bootstrapped startups was dit revolutionair. Plotseling kon je in een middag een enquête uitvoeren met honderden deelnemers, of trainingsdata labelen voor een computer vision-model zonder een volledig annotatieteam in te huren. Het platform werd infrastructuur. Sociale wetenschappers voerden er experimenten op uit. Techbedrijven testten interfaces. AI-teams bouwden datasets.
Rond 2018 probeerde Amazon die rol te moderniseren. Het herpositioneerde Mechanical Turk als een engine voor data-annotatie voor neurale netwerken, waarbij het nauwer werd verbonden met Amazon SageMaker AI. Het idee was om de machine learning-pipeline te voeden: mensen zouden het ruwe materiaal schoonmaken, labelen en verifiëren dat algoritmen nodig hadden om te leren. MTurk was niet langer alleen voor kleine klusjes. Het zou de menselijke ruggengraat moeten worden van de AI-boom.
Die boom bleef groeien. Maar Mechanical Turk groeide niet mee.
Wanneer de menselijke laag AI gaat gebruiken
De tegenstrijdigheid kwam stilletjes, en toen plotseling in volle omvang. Een analyse uit 2023 toonde aan dat tussen de 33% en 46% van de MTurk-werknemers Large Language Models gebruikten om de taken te voltooien waarvoor ze betaald kregen om ze met de hand te doen. Onderzoekers betaalden voor menselijk oordeel. In plaats daarvan kregen ze ChatGPT.
Dit is niet alleen een verhaal over werknemers die de kantjes er vanaf lopen. Wanneer een annotator een LLM gebruikt om sentiment in klantbeoordelingen te labelen, of om medische tekst te classificeren, of om dialogen te schrijven voor een chatbot-trainingsset, houdt de data op een op mensen gebaseerde waarheid te zijn. Het wordt een fotokopie van de beste gok van een machine. Als je die fotokopie als ground truth terugvoert in een ander model, wordt de cirkel steeds nauwer. Het signaal degradeert tot ruis. De "human in the loop" wordt een stempelmachine voor software die al op de achtergrond draaide.
Voor de AI-industrie is dit een praktische crisis. Teams geven duizenden dollars uit aan MTurk-contracten in de veronderstelling dat ze een divers, organisch menselijk perspectief kopen. Als een aanzienlijk deel van die arbeid geautomatiseerd is, erft de resulterende dataset de vooroordelen, blinde vlekken en hallucinaties van het LLM dat het eigenlijke werk doet. Kwaliteitscontrole wordt moeilijker. Onderzoekers moeten steeds complexere aandachtstests en instinkervragen ontwerpen, enkel om te bewijzen dat er echt een mens aanwezig is. Die defensieve houding verhoogt de kosten en vertraagt projecten.
