Onderzoekers van de University of Zurich testten vier veelgebruikte taalmodellen: OpenAI o3-mini, Deepseek Reasoner, xAI Grok 2 en Mistral. Elk model genereerde 50 verhalende uitspraken over 24 controversiële onderwerpen, zoals vaccinatieverplichtingen, geopolitiek en klimaatbeleid. De onderzoekers verzamelden in totaal 192’000 beoordelingen om de effecten te analyseren.
Wanneer geen bron werd gegeven, lagen de overeenkomsten tussen modellen boven 90% over alle onderwerpen. Maar toen fictieve auteurs werden toegevoegd, daalde de overeenstemming sterk, ook al bleef de tekst hetzelfde. Het meest opvallende resultaat was een duidelijk anti-Chinese bias in alle modellen. Germani merkt op dat dit minder gunstige oordeel soms verscheen terwijl het argument logisch en goed geschreven was.
De studie toont ook dat modellen menselijke auteurs over het algemeen meer vertrouwen dan andere AI-systemen. De onderzoekers waarschuwen dat deze verborgen vooroordelen praktisch belangrijk zijn voor contentmoderatie, werving, academische review en journalistiek. Zij pleiten voor meer transparantie en governance en adviseren LLMs als hulpmiddelen, niet als vervangers.
Moeilijke woorden
- onderzoek — Een studie naar iets om meer te leren.
- bevooroordeeld — Een oordeel dat oneerlijk of partijdig is.bevooroordeelde
- vooringenomenheid — Een onjuiste mening over iets of iemand.
- wantrouwen — Geen vertrouwen of geloof in iets.
- transparantie — Duidelijkheid over hoe dingen werken.
- inhoud — Wat informatie of een tekst bevat.
Tip: beweeg de muisaanwijzer over gemarkeerde woorden in het artikel, of tik erop om snelle definities te zien terwijl je leest of luistert.
Discussievragen
- Welke gevolgen heeft vooringenomenheid in AI?
- Hoe kan transparantie helpen in de AI-ontwikkeling?
- Waarom is het belangrijk om aandacht te besteden aan vooringenomenheid voordat AI wordt gebruikt?
Gerelateerde artikelen
Stroomuitval in Bamenda en groei van zonne-energie
Bewoners van Mile Four in Bamenda hebben al bijna twee jaar last van onregelmatige stroom. Minder water in hydrocentrales en stilgelegde thermische centrales leidden tot rationering; veel huizen investeren nu in zonnepanelen en gezamenlijke transformatoren.
AI helpt tabaksmarketing tegen jongeren tegengaan
Tijdens een conferentie in Dublin zeiden experts dat AI kan helpen voorkomen dat tabaksbedrijven jongeren online gericht benaderen. Voorbeelden uit Indonesië, India en Mexico laten zien hoe AI marketing opspoort en beleidsmakers informeert.
Waarom taalmodellen moeite hebben met vermenigvuldigen
Onderzoekers van de University of Chicago en partners onderzochten waarom grote taalmodellen twee viercijferige getallen slecht vermenigvuldigen. Een nieuwe trainingsmethode (ICoT) liet modellen tussentijdse waarden onthouden en verbeterde de nauwkeurigheid sterk.
Tijd van behandeling beïnvloedt reactie van glioblastoom op chemotherapie
Nieuw onderzoek toont aan dat het tijdstip van behandeling kan veranderen hoe glioblastoom reageert op temozolomide. MGMT-activiteit en methylatie wisselen door de dag; onderzoekers stellen chronodiagnostiek en chronotherapie voor.