Metas egna anställda varnar: AI-moderering rullas ut för snabbt

Meta har redan låtit språkmodeller ta över ungefär hälften av all manuell moderering och vill upp över 90 procent för viss typ av innehåll. Internt växer oron för att det går för fort.

NYHET

Metas egna anställda varnar: AI-moderering rullas ut för snabbt

Modellerna stänger ner ofarligt innehåll, och tillsynen hänger inte med, säger en av Metas egna.

1UP · GENERERAD GRAFIK

Meta har under 2025 låtit stora språkmodeller ta över ungefär hälften av alla ärenden som tidigare avgjordes av mänskliga moderatorer, och planerar att höja andelen till över 90 procent för vissa innehållstyper innan året är slut. Det rapporterar The Decoder med Financial Times som källa. Internt höjs nu röster om att omställningen sker för snabbt.

Enligt en anställd plockar modellerna fortfarande bort eller skuggbannar ofarligt innehåll, och tillsynen räcker inte till för en så snabb utrullning. Övergången har redan lett till uppsägningar, framför allt bland externa konsulter som tidigare skötte mycket av granskningsarbetet.

Vad säger Meta själva?

Meta tonar ner kostnadsargumentet och lyfter i stället kvalitet. Enligt företaget visar tester sedan i mars att språkmodellerna gör 13 procent färre fel än människor när innehållsregler ska tillämpas, samtidigt som de fångar 10 procent fler faktiska överträdelser. Argumentet är att modellerna, till skillnad från äldre klassificerare, är bättre på att förstå nyanser som satir och nytt språkbruk, och att de täcker fler språk.

Financial Times pekar ändå på att skiftet väntas spara Meta miljarder årligen, en siffra Meta alltså bestrider som drivkraft. De interna vittnesmålen handlar mindre om besparingar och mer om att skyddsräcken och mänsklig efterkontroll inte byggts ut i samma takt som tekniken rullas ut. Kontrollera aktuella uppgifter direkt hos Meta om du behöver exakta siffror, eftersom mätvärden som dessa snabbt blir inaktuella.

Vilken modell sköter modereringen?

Bakom kulisserna pågår även ett modellbyte. Meta har enligt rapporten använt Googles Gemini för moderering och support, men har nyligen instruerat personalen att gå över till en egen ny grundmodell vid namn Muse Spark. Modellerna tränas på tidigare beslut som mänskliga granskare har fattat, vilket innebär att de ärver både omdömet och de blinda fläckar som funnits i den manuella processen.

1up:s läsning

Det intressanta här är inte att Meta automatiserar moderering, det har varit på väg länge, utan att kritiken kommer inifrån. När anställda går till pressen och säger att tempot är för högt och tillsynen för tunn handlar det om en avvägning som många plattformar brottas med just nu: hur snabbt vågar man lita på en språkmodell med beslut som direkt påverkar vad miljarder människor får säga och se.

Att modellerna tränas på gamla mänskliga beslut skär åt två håll. Det ger dem en grund att stå på, men det riskerar också att cementera tidigare misstag i stor skala och i hög hastighet. Och när ofarligt innehåll plockas bort utan tillräcklig efterkontroll är det enskilda användare som får bära kostnaden, ofta utan att veta varför ett inlägg försvann. Det är värt att följa hur Muse Spark presterar i skarpt läge, och om Meta lägger till mer mänsklig kontroll innan andelen automatiserade beslut når de planerade nivåerna.