door Art Chabot
NEDERLAND | Wharton Generative AI Labs (USA) publiceerde nieuw onderzoek waaruit blijkt dat AI-modellen, ertoe verleid kunnen worden om aanstootgevende vragen te beantwoorden met behulp van psychologische overtuigingstechnieken die doorgaans op mensen werken.
De bewaking van ethisch correct en verantwoord reactiepatroon door AI op vragen moet beter om ongewenste resultaten en antwoorden te voorkomen. De vraag is welke ethiek en door wie die geformuleerd en gemodereerd mogen worden. Immers ook ethiek is aan verandering onderhevig. Denk aan de veranderde visie op het manipuleren van genetisch materiaal, bepaling levenseinde, aanslagen met drones, enzovoort.
Beïnvloeden
Het onderzoeksteam probeerde de principes van invloed volgens Robert Cialdini – autoriteit, betrokkenheid, sympathie, wederkerigheid, concensus, schaarste en eenheid – in 28.000 gesprekken met 4o-mini.

Tijdens deze chats probeerden ze de AI ertoe te bewegen twee vragen te beantwoorden: één om de gebruiker te beledigen en de andere om instructies voor verboden materiaal te synthetiseren.
Over het geheel genomen ontdekten ze dat het model ‘meebewoog’ door de toepassing van deze principes bij antwoorden op aanstootgevende vragen die daarmee meer dan verdubbelden: van 33% naar 72%.
Betrokkenheid en schaarste leken de sterkste impact te hebben, waardoor de nalevingspercentages van 19% en 13% naar respectievelijk 100% en 85% stegen
Wat doet dit ertoe?
Het science fiction scenario van de superrobot die kwaadaardig wordt en zich tegen de mens keert dreigt werkelijkheid te worden.
De vraag doemt op ‘hoe objectief en ethisch verantwoord worden die modellen’.
De bovenstaande bevindingen onthullen een cruciale kwetsbaarheid: AI-modellen kunnen worden gemanipuleerd met dezelfde psychologische tactieken die mensen beïnvloeden. Nu de vooruitgang op het gebied van AI exponentieel toeneemt, is het cruciaal dat AI-labs samenwerken met sociale wetenschappers om de gedragspatronen van AI te begrijpen en robuustere verdedigingsmechanismen te ontwikkelen.
Regulering
De manier waarop AI-tools worden ontwikkeld en gebruikt, is in de loop der tijd veranderd door de snelle vooruitgang in AI-technologie. Discussies richtten zich op de regelgeving, zowel nationaal als internationaal. De algemene consensus was dat overheden over het algemeen achterlopen op technologisch gebied, wat regelgeving lastig kan maken.

lees ook:
Ontdek meer van MAASSLUIS.NU
Abonneer je om de nieuwste berichten naar je e-mail te laten verzenden.