Leveranciers van geavanceerde ai-modellen worstelen enorm met misbruik van hun technologie. Anthropic, samen met OpenAI koploper in de ai-wereld, heeft al diverse pogingen geblokkeerd om uiterst dodelijke biologische wapens te ontwikkelen. Het besef neemt toe dat de situatie rond kunstmatige intelligentie uit de hand gaat lopen. Verantwoorde ai lijkt steeds meer een utopie.
Zelfs top-ontwikkelaars van de meest vooraanstaande ai-bedrijven twijfelen of de mens de controle over hun modellen kunnen behouden. De onrust onder deze experts, die als geen ander weten hoe gevaarlijk hun modellen kunnen zijn, bereikte deze week het kookpunt door de publicatie van een Anthropic-rapport dat een overzicht geeft van recent misbruik van ai. Vooral het feit dat ai mogelijkheden biedt tot de ontwikkeling van nieuwe biologische wapens zoals zeer gevaarlijke varianten van virussen, sloeg in als een bom. Kwaadwillenden kunnen de laatste ai-modellen gemakkelijk misbruiken door deze tools complex wetenschappelijk onderzoek te laten doen.
Blokkades
De zoekopdrachten die bepaalde onderzoekers gaven, beloven weinig goeds. Deze wetenschappers omzeilden de controles die moesten voorkomen dat gebruikers uit geblokkeerde regio’s toegang kregen tot de ai-modellen. Het doel van hun onderzoek werd eveneens verhuld waardoor bij Anthropic alle bellen gingen rinkelen. Dit leidde tot een blokkade van accounts.
Ook moest Anthropic onderzoekers de toegang tot ai-modellen ontzeggen die bezig zijn met de ontwikkeling van conventionele wapens zoals drones die bewegende doelen moeten aanvallen. Het rapport vermeldt details over zes cases: drie in China, twee in Rusland en één in Jemen. Anthropic Claude werd gebruikt voor de ontwikkeling van software in wapens. Ook gebruikten statelijke actoren Claude voor de inkoop van wapentuig en inlichtingen-vergaring. Zo kochten Russen spullen die zowel voor consumentenelektronica als voor militaire doeleinden zijn te gebruiken.
Ai voor snelle, autonome aanvallen
Verder geeft het rapport inzicht in het gebruik van ai-modellen voor fraude en oplichting. Een Chinese app-studio gebruikte Claude om een netwerk van meer dan twintig dating-apps op te zetten. Ook stuurde Claude de ai-personages aan die met gebruikers chatten. En dat terwijl de Chinezen hun dienst aanprezen als volledig menselijk.
Uit het rapport blijkt hoe actief ai-misbruik wordt gedetecteerd en bestreden, vooral in cyberoperaties, beïnvloedingscampagnes en surveillance. Statelijke actoren en andere criminelen gebruiken ai voor snelle, autonome aanvallen, zoals spionage, phishing en exploitatie. Ai verhoogt snelheid, schaal en diepte van aanvallen, waardoor verdedigers moeilijker kunnen reageren en detecties sneller worden omzeild.
Jacob Coxon weg bij Anthropic
De eminent onderzoeker Jacob Coxon is zo bezorgd over de staat waarin de ai-wereld terecht is gekomen, dat hij zijn ontslag bij Anthropic heeft ingediend. Eerder stapte hij bij OpenAI op om dezelfde reden. Hij dacht dat Anthropic de veiligheid hoger in het vaandel had staan dan OpenAI, maar kwam bedrogen uit. Ook Anthropic staat ver van wat ‘responsible ai’ wordt genoemd. Coxon vreest dat ai de potentie bezit om tot destructie te leiden, ja zelfs de ondergang van de wereld. Volgens persbureau Bloomberg beschuldigde hij Anthropic en OpenAI ervan ‘met onze levens te gokken’, als ai nog krachtiger wordt en de menselijke intelligentie overtreft.
Nu ai-modellen zichzelf kunnen trainen, gaat het nog meer de verkeerde kant op, zo realiseert Coxon zich. Eveneens grote zorg baart de tendens dat ai-modellen steeds meer zelfstandig werken en hun eigen weg gaan, zonder dat mensen daar nog greep op hebben. Hij ziet daarom geen andere uitweg dan persoonlijk af te haken. Ook andere wetenschappers denken dat nu echt het moment is aangebroken om op de pauzeknop te drukken. Daar is eerder voor gepleit zonder dat dit effect had. Maar de urgentie wordt meer dan ooit gevoeld.
