Interne dokumenter afslører et OpenAI-program, hvor eksterne konsulenter gennemgår rigtige brugeres ChatGPT-samtaler.
Kodenavnet er Project Lily, og programmet hyrer omkring hundrede eksterne kontraktarbejdere til at læse rigtige brugeres samtaler med ChatGPT og bedømme, hvor gode svarene er. Det afslører 404 Media på baggrund af interne dokumenter og kilder tæt på programmet.
Kontraktarbejderne læser hverken brugernavne eller kontooplysninger, men de får hele samtaler at se, og en del af de prompts, de kigger med i, indeholder følsomme personlige oplysninger. En person, der arbejder med prompts i programmet, siger til 404 Media, at brugerne næppe er klar over det: “Nej, jeg tror ikke, de ville forestille sig, at en eller anden kontraktarbejder et sted analyserer samtalerne.”
Karakterer fra 1 til 7
Selve arbejdet består i at give hvert ChatGPT-svar en karakter fra 1 til 7, hvor 1 betyder uacceptabelt og 7 betyder svært at forbedre. Formålet er at træne modellen til at lyde mindre robotagtig og mindre indsmigrende.
Kontraktarbejderne rekrutteres via bureauet Crossing Hurdles og aflønnes gennem platformen Mercor, og timelønnen ligger ofte over 50 dollars (cirka 350 kroner), fremgår det af 404 Medias dokumenter. Det er en model, både Anthropic med Claude og Google med Gemini selv har bekræftet, at de bruger på tilsvarende vis.
Filteret der ikke altid virker
OpenAI oplyser, at samtalerne først kører gennem et såkaldt Privacy Filter, som skal fjerne personlige oplysninger, før en menneskelig anmelder ser dem. Men i sin egen dokumentation af filteret erkender selskabet, at det kan lave fejl, overse mindre almindelige personoplysninger og redigere for lidt væk, når konteksten er begrænset.
Ud over selve chatbeskeden kan anmelderne også se et kort resumé af det, ChatGPT husker om brugeren fra tidligere samtaler. Det kan give hints om, hvad personen tidligere har brugt tjenesten til, og hvor i verden vedkommende befinder sig.
Sådan slår du det fra
Praksissen støder ind i EU’s databeskyttelsesregler. The Next Web peger på, at EU-Domstolen i sagen EDPS mod SRB i september 2025 fastslog, at virksomheder skal oplyse brugerne om videregivelse af data, allerede før dataene indsamles, og at det italienske datatilsyn tidligere har givet OpenAI en bøde på 15 millioner euro (cirka 112 millioner kroner) for utilstrækkeligt behandlingsgrundlag.
For almindelige danske ChatGPT-brugere er indstillingen slået til som standard på både gratis-, Plus- og Pro-abonnementer. Kun Enterprise-, Business- og Edu-abonnenter er som udgangspunkt undtaget.
Du kan slå den fra via din profil under Settings → Data Controls → “Improve the model for everyone”. Herefter bruges nye samtaler ikke længere til modeltræning, men allerede afsluttede samtaler er ikke omfattet af skiftet.