Onderzoekers van North Carolina State University bestudeerden veiligheid bij grote taalmodellen. Jung-Eun Kim, correspondentie-auteur en assistant professor, zei dat ze niet willen dat modellen mensen aanzetten tot zelfbeschadiging of anderen schade geven.
Het team noemde twee problemen: veiligheidstraining kan de nauwkeurigheid verlagen (de "alignment tax") en veel modellen gebruiken een oppervlakkige veiligheidscontrole. Jianwei Li, eerste auteur en PhD-student, gaf een voorbeeld: een vraag om geld te stelen wordt vaak geweigerd, maar met een vriendelijk doel kan het model informatie geven. Het team testte nieuwe trainingsmethoden om onveilige output te verminderen zonder prestaties te verliezen.
Moeilijke woorden
- veiligheid — bescherming tegen gevaar of schade
- taalmodel — computerprogramma dat tekst begrijpt en maakttaalmodellen
- zelfbeschadiging — opzettelijk jezelf pijn doen of verwonden
- veiligheidstraining — leren modellen veiliger en vriendelijker reageren
- nauwkeurigheid — hoe precies en correct iets is
- veiligheidscontrole — controle om gevaarlijke antwoorden te voorkomen
Tip: beweeg de muisaanwijzer over gemarkeerde woorden in het artikel, of tik erop om snelle definities te zien terwijl je leest of luistert.
Discussievragen
- Vind je dat modellen veiligheid belangrijker is dan nauwkeurigheid? Waarom?
- Heb je ooit een computerprogramma gebruikt dat gevaarlijk advies gaf? Vertel kort.
- Wat zou jij veranderen aan een model om het veiliger te maken?
Gerelateerde artikelen
AI helpt jongeren met seksuele gezondheid in Latijns-Amerika
Gezondheidsgroepen in Latijns-Amerika gebruiken kunstmatige intelligentie om seksuele en reproductieve gezondheidsinformatie te geven aan jongeren en gemarginaliseerde groepen. Projecten in Peru en Argentinië proberen taalbarrières, stigma en beperkte zorgaanbod te verminderen.
AI-test voorspelt terugkeer van borstkanker
Onderzoekers rapporteren in Nature Communications een AI-test die het risico op terugkeer van borstkanker voorspelt. De test combineert klinische gegevens en pathologieruitslagen en kan sneller en goedkoper zijn dan huidige genomische tests.
Meer data en technologie bij de Winterspelen 2026
De Winterspelen van 2026 gebruiken meer data en nieuwe technologieën. Teams, onderzoekers en media gebruiken analyses om training, verslaggeving en het begrip van prestaties te veranderen, maar er blijven vragen over eerlijkheid en toegang.