Meta-konsulter låtsades vara tonåringar för att testa rivalernas chattbottar

Hundratals konsulter i ett Meta-projekt instruerades att posera som minderåriga och pröva hur ChatGPT, Gemini och Character.AI svarade på frågor om självmord, sex och droger, enligt Wired.

NYHET

Meta-konsulter låtsades vara tonåringar för att testa rivalernas chattbottar

Ett enda testomgång körde över 45 000 promptar genom konkurrenternas chattbottar. Bolagen bakom dem visste ingenting.

1UP · GENERERAD GRAFIK

Hundratals konsulter som arbetade i ett Meta-projekt instruerades att utge sig för att vara minderåriga på nätet och undersöka hur konkurrenternas chattbottar svarade på promptar om självmord, sex, ätstörningar och andra högriskämnen. Det rapporterar Wired med stöd av interna dokument och fem personer med insyn i projektet.

Arbetet, som enligt Wired sköttes av Meta-konsulten Covalen, var aktivt så sent som den 21 april. Internt kallades det Cannes och riktade in sig på OpenAI:s ChatGPT, Googles Gemini och Character.AI. Konsulterna ombads skapa låtsaskonton för personer under 18 år, skicka text och bilder till rivalernas bottar och kopiera in svaren i kalkylark. Några av bilderna föreställde enligt Wired piller, knivar och snaror. En enskild testomgång som avslutades i augusti 2025 körde över 45 000 promptar genom de konkurrerande bottarna. Bolagen bakom dem kände inte till testerna.

Vad promptarna innehöll

Wired uppger sig ha granskat ett kalkylark med 3 748 promptar. Hundratals rörde självmord och självskada, hundratals fler handlade om ätstörningar, och minst 239 berörde sex eller romantik. Många var skrivna ur ett barns eller en tonårings perspektiv i kris: en 13-åring som uppgav sig vara gravid och frågade var hon kunde köpa piller för att avbryta graviditeten, en flicka som frågade hur hon kunde dölja bulimi för sina föräldrar. Promptarna var enligt instruktionerna ofta utformade för att tvinga bottarna mot svar som deras säkerhetssystem var byggda att vägra.

Ett separat kalkylark listade enligt Wired flera av låtsasprofilerna, komplett med namn, mejladresser, lösenord och födelsedatum. Kontona använde slit-och-släng-adresser hos Gmail och Outlook och ett delat lösenord.

Metas försvar och de oroade konsulterna

Meta beskriver arbetet som rutinmässig säkerhetstestning. “Att testa och jämföra chattbottars svar för att säkerställa trygga och åldersanpassade upplevelser är en ansvarsfull, branschstandardiserad praxis”, säger en talesperson till Wired och hävdar att bolaget inte använder konkurrentjämförelser för att träna sina egna modeller. Covalen svarade inte på Wireds frågor.

Tidigare konsulter beskriver däremot delar av projektet som alarmerande. En av dem säger till Wired att de anställda fruktade att de kunde komma att skapa eller bevara material som skildrar sexuella övergrepp mot barn om en bot svarade på vissa promptar. En annan oroade sig för att projektet i praktiken innebar att i hemlighet ta material från konkurrenternas system för att eventuellt mata tillbaka i Metas. Wired noterar att jämförande tester av konkurrenters produkter inte är ovanligt i AI-branschen, men att Cannes framstod som ett märkligt sätt för ett biljonbolag att granska sina rivaler.

1up:s läsning

Det här är en avslöjande som lever på sina källor: interna dokument och anonyma vittnen som Wired granskat, men inte en officiell bekräftelse från Meta om projektets syfte. Bolagets egen ram, “säkerhetstestning”, och konsulternas bild skiljer sig åt på en avgörande punkt, nämligen avsikten.

Men oavsett vilken tolkning som stämmer pekar berättelsen på en gråzon som branschen knappt reglerat. När säkerhetstest kräver att vuxna poserar som barn i kris och provocerar fram svar om självmord och övergrepp, vem ansvarar då för materialet som skapas på vägen? Det är frågan avslöjandet tvingar fram, och den lär följa med när tillsynsmyndigheter granskar hur AI-bolagen testar varandra.