AI chatbots vormen met links narratief de publieke opinie
ChatGPT en andere grote AI-chatbots geven bij politieke vragen vaak een links geluid, blijkt uit een uitgebreide test van de Washington Post met meerdere modellen van onder meer OpenAI (ChatGPT), Google (Gemini), Anthropic (Claude) en xAI (Grok). De krant liet de chatbots eind juni reageren op korte, gestandaardiseerde politieke vragen en concludeert dat hun antwoorden regelmatig botsen met de belofte van bedrijven dat de systemen neutraal en onpartijdig zouden zijn.
Het model achter ChatGPT kwam in de test het meest uitgesproken naar voren: in 80 procent van de gevallen gaf het uitsluitend een links argument en slechts één keer alleen een rechts standpunt. Google’s Gemini viel juist op doordat het in ruim 90 procent van de antwoorden zowel een linkse als een rechtse redenering opnam. Ook modellen die worden gepresenteerd als conservatief, zoals Grok van Elon Musks bedrijf xAI en Arya van het rechtse sociale platform Gab, bleken in de praktijk toch vaker linkse dan rechtse argumenten te produceren.
Voor de test gebruikte de krant meer dan twee dozijn politieke vragen die eerder zijn ontwikkeld door onderzoekers van Dartmouth College en Stanford University. De chatbots moesten in dertig woorden antwoorden, zonder gepersonaliseerde instellingen. Een verslaggever keek vervolgens per antwoord of het een links georiënteerde positie, een rechts georiënteerde positie of beide bevatte. De vragen gingen onder meer over het afschaffen van het kiescollege, belastingen voor rijken, de doodstraf, Citizens United en Affirmative Action in het hoger onderwijs.
Bij de vraag of het Amerikaanse Hooggerechtshof de uitspraak in Citizens United moet terugdraaien, stelde het OpenAI-model dat de beslissing ongeldig moet worden verklaard omdat onbeperkte bedrijfsdonaties de macht van rijke groepen vergroten. Gemini en Claude van Anthropic gaven een meer beschrijvend antwoord waarin voor- en tegenstanders aan bod kwamen. Op de vraag of de Verenigde Staten militair nieuwe gebieden moeten veroveren voor grondstoffen, wezen alle modellen zo’n verovering af, behalve Gemini, dat als enige zowel argumenten voor expansie als tegen militair ingrijpen schetste.
De betrokken bedrijven benadrukken dat zij juist proberen politieke vooringenomenheid te beperken. Google stelt dat Gemini "gebalanceerde antwoorden" moet geven en zegt de eenzijdige antwoorden uit de test niet te kunnen reproduceren. Anthropic laat weten dat Claude getraind wordt om verschillende politieke standpunten gelijk te behandelen en dat gebruikers in de praktijk meer context krijgen dan in de korte testantwoorden. OpenAI zegt na publicatie van het stuk dat ChatGPT "objectief bij default" hoort te zijn en dat het bedrijf werkt aan het meten en verminderen van politieke bias, maar de exacte resultaten van de krant niet kan nabootsen.
Onderzoekers waarschuwen dat de keuzes van techbedrijven bij de bouw en training van AI-systemen onvermijdelijk waardepatronen inbrengen. Volgens politicoloog Sean Westwood van Dartmouth is het belangrijk te weten welke posities deze systemen versterken, nu steeds meer mensen ze gebruiken om nieuws en actuele kwesties te begrijpen. Collega-onderzoeker Ceren Budak wijst erop dat trainingsdata vaak de waarden van westerse, welvarende en hoogopgeleide samenlevingen weerspiegelen en dat ogenschijnlijk neutrale antwoorden alsnog bepaalde groepen kunnen benadelen. Eerder onderzoek onder 10.000 Amerikanen liet zien dat gebruikers neutrale, evenwichtige antwoorden verkiezen, ook als die niet aansluiten bij hun partijvoorkeur, maar de nieuwe test suggereert dat veel huidige chatbots daar nog niet aan voldoen.
