Logo P-magazine Regio Zoeken Rubrieken

📸 AI helpt je een kernbom te bouwen, zolang je het maar in dichtvorm vraagt

Gert B. - 03-12-2025

Uit nieuw onderzoek blijkt dat grote AI-modellen, ondanks ingebouwde veiligheidsmechanismen, verrassend eenvoudig te misleiden zijn. 

De systemen zijn ontworpen om gevaarlijke of illegale informatie te blokkeren, maar onderzoekers ontdekten dat deze bescherming instort zodra de vraag in poëtische vorm wordt gesteld. Door verzoeken te formuleren in rijm, met klassieke versregels of zelfs eenvoudige metaforen, gaven chatbots wél antwoorden die ze in gewone zinnen zouden weigeren, inclusief details over malware, verboden materialen of zelfs de stappen voor het bouwen van een kernwapen.

WIRED meldt dat deze methode van zogeheten “poem prompting” een succesratio had van 62 procent, wat uitzonderlijk hoog is voor een jailbreaktechniek. De onderzoekers konden via poëzie onder meer software-activatiecodes opvragen, informatie rond illegale constructies losweken en instructies laten genereren die normaal door de systemen nauwgezet worden tegengehouden. 

Opvallend genoeg begrijpen de ontwikkelaars zelf nog niet waarom gedichten zo effectief zijn. Vermoed wordt dat de creatieve taalpatronen bestaande veiligheidsfilters om de tuin leiden.

De studie benadrukt dat het dichten op zich géén risico vormt, maar dat de kwetsbaarheid dringend moet worden aangepakt om misbruik te voorkomen. Het rapport concludeert dat verdere verfijning van AI-veiligheid noodzakelijk is, zeker nu deze systemen steeds vaker in gevoelige domeinen worden ingezet.

De mensheid is dus nog even veilig, zolang niemand op het idee komt om rapteksten te proberen.

Ai Kernbom

Reacties

Resterende karakters 500

Meer WTF

Nieuwsbrief Mis nooit meer het laatste nieuws, exclusieve aanbiedingen en boeiende verhalen van P-magazine! Schrijf je nu in voor onze nieuwsbrief en blijf altijd op de hoogte.
Zoeken