door Art Chabot
NEDERLAND | Onderzoekers van Universiteit van California te San Diego hebben zojuist aangetoond dat AI-systemen consequent Alan Turing’s beroemde test van machine-intelligentie kunnen doorstaan, waarbij OpenAI’s GPT-4.5 in bijna driekwart van de gevallen in gecontroleerde proeven voor mens wordt aangezien.
[redactie: GPT = generative pre-trained transformer ]
Waarom het belangrijk is: De Turing-test is al tientallen jaren een heilige graal van AI-onderzoek, maar modelversnelling heeft de doelen zo snel verplaatst dat de resultaten helemaal niet verrassend aanvoelen. Met AI-agenten die zijn uitgerust met next-level tekst-, audio-, beeld- en videomogelijkheden, wordt het vermogen om AI van mensen te onderscheiden een grote uitdaging.
Achtergrond van deze test
De Turing-test, voorgesteld in 1950, daagt machines uit om menselijke juryleden ervan te overtuigen dat ze mens zijn door middel van alleen-tekstgesprekken.
De studie gebruikte een opstelling met drie partijen waarbij juryleden een AI en een mens tegelijkertijd moesten vergelijken voor directe vergelijking tijdens gesprekken van vijf minuten.
De juryleden vertrouwden op informele gesprekken en emotionele signalen in plaats van kennis, waarbij meer dan 60% van de interacties gericht was op dagelijkse activiteiten en persoonlijke details.
GPT-4.5 behaalde een winstpercentage van 73% bij het voor de gek houden van menselijke juryleden wanneer ze werden gevraagd een specifieke persona aan te nemen, wat aanzienlijk beter presteerde dan echte mensen.

CHATGPT is eigendom van OpenAI, Inc., een Amerikaanse onderzoeksorganisatie op het gebied van kunstmatige intelligentie (AI), opgericht in december 2015 en gevestigd in San Francisco, Californië. Het doel is het ontwikkelen van “veilige en nuttige” algemene kunstmatige intelligentie (AGI), wat zij definiëren als “zeer autonome systemen die beter presteren dan mensen bij de meeste economisch waardevolle werkzaamheden”. [ bron wikipedia ]
Meta’s LLaMa-3.1-405B-model slaagde ook voor de test met een succespercentage van 56%, terwijl basismodellen zoals GPT-4o slechts rond de 20% haalden.
Ontdek meer van MAASSLUIS.NU
Abonneer je om de nieuwste berichten naar je e-mail te laten verzenden.