Het doembeeld van AI die zich aan menselijke controle onttrekt, leidt de aandacht af van de mensen, organisaties en bedrijven die bepalen wat AI kan en mag.

Veel van de berichtgeving van de afgelopen weken over de ‘hackende’ agenten van OpenAI wekt de indruk dat deze agenten zo slim zijn geworden dat ze zich aan menselijke controle onttrekken. En dat voedt weer het doemdenken dat AI uiteindelijk zelfs het voortbestaan van de mensheid bedreigt.

Sciencefictionschrijver Isaac Asimov gaf al in 1947 een naam aan de hardnekkige culturele angst dat kunstmatige wezens zich tegen hun makers keren: het Frankensteincomplex. Als antwoord daarop verzon hij in zijn verhalen de beroemde robotwetten. Het interessante aan die wetten is dat Asimov veiligheid vooral als een ontwerpprobleem zag. Robots moesten zo worden gebouwd dat ze zich veilig gedragen.

Dat principe moeten we ook op AI toepassen. Het zijn mensen die AI-systemen ontwerpen en programmeren; mensen bepalen hun doelen, bevoegdheden en beperkingen; mensen besluiten met welke andere systemen ze mogen communiceren en welke handelingen ze zelfstandig mogen uitvoeren. En uiteindelijk zijn het ook mensen die ze toestaan om een bepaalde hoeveelheid rekenkracht en energie te gebruiken.

Dat AI steeds krachtiger wordt, staat buiten kijf. Maar daaruit volgt niet dat AI vanzelf oncontroleerbaar wordt. Kracht en controle zijn twee verschillende dingen. We bouwen voortdurend technologieën die krachtiger worden – auto’s, vliegtuigen, computersystemen, energiecentrales – en stellen daar technische, organisatorische en wettelijke grenzen aan. Ook bij AI hangt de mate van controle niet alleen af van wat een systeem kan, maar vooral van welke bevoegdheden we het geven, welke veiligheidsmechanismen we inbouwen en onder welke voorwaarden we het inzetten.

Zeggen dat AI-agenten, gebouwd door OpenAI, autonoom besloten Hugging Face te hacken, zoals veel berichtgeving suggereert, is bovendien het toeschrijven van menselijke intenties aan een technisch systeem zonder eigen wil of bedoelingen. AI is niets anders dan software die draait op fysieke hardware – no magic inside.

Wetenschappelijk onderzoek naar agentsystemen bestaat al tientallen jaren. Wetenschappers hebben allerlei technische oplossingen ontwikkeld om grenzen te stellen aan wat agenten bij het nastreven van hun doelen wel en niet mogen doen. Het lijkt er sterk op dat OpenAI daarvan veel minder gebruik heeft gemaakt dan had gekund. Ontspoorde AI-agenten zijn dus niet superslim, maar slecht ontworpen. En daarvoor is OpenAI verantwoordelijk.

Bij discussies over de gevaren van AI worden vaak Nobelprijswinnaar Geoffrey Hinton en Turing Award-winnaar Yoshua Bengio aangehaald, twee vooraanstaande AI-onderzoekers die waarschuwen voor het risico dat de mensheid door AI uitsterft. Maar hoe groot hun expertise op het gebied van AI ook is, dat maakt hen nog niet tot autoriteiten op het gebied van de maatschappelijke gevolgen van AI. Hinton voorspelde in 2016 dat AI binnen vijf jaar beter zou zijn dan radiologen en dat we daarom maar beter konden stoppen met het opleiden van nieuwe radiologen. Dat is niet gebeurd. AI wordt in de radiologie juist steeds meer gebruikt als hulpmiddel, waarbij radioloog en AI samenwerken om de patiëntenzorg te verbeteren. Tegenover Hinton en Bengio staan bovendien tal van gerenommeerde AI-onderzoekers die uitspraken over existentiële risico’s ongefundeerd en misleidend vinden.

Dat met krachtiger AI nieuwe risico’s gepaard gaan, staat eveneens buiten kijf. Maar we moeten ons niet blindstaren op het spectaculairste en meest speculatieve scenario. Er zijn nu al concrete risico’s die om actie vragen: machtsconcentratie bij een handvol technologiebedrijven, foutieve geautomatiseerde beslissingen, discriminatie, desinformatie op grote schaal, te ruime bevoegdheden voor autonome AI-systemen en ontwrichting van delen van de arbeidsmarkt.

Om zulke risico’s te beperken zijn aan de ene kant ethische principes nodig, zoals verantwoordingsplicht, transparantie en menselijke verantwoordelijkheid. Bedrijven en organisaties kunnen en moeten daar zelf werk van maken, maar doen dat lang niet altijd. OpenAI lanceerde ChatGPT eind 2022 zonder zich veel te bekommeren om de maatschappelijke gevolgen. Onderwijsinstellingen, werkgevers en andere organisaties stonden van de ene op de andere dag voor een gigantische uitdaging en de samenleving werd onderdeel van een wereldwijd experiment.

Aan de andere kant is wet- en regelgeving nodig om verantwoord gedrag af te dwingen. Daarvoor bestaan nu al verschillende instrumenten. AI-systemen vallen onder bestaande regels voor bijvoorbeeld productaansprakelijkheid, productveiligheid, consumentenbescherming en privacy. Verder hanteert de Europese AI Act – die trouwens niets expliciet zegt over agentsystemen – een risicogebaseerde aanpak: naarmate een AI-toepassing in een zwaardere risicocategorie valt, gelden strengere verplichtingen rond onder meer risicobeheersing, menselijk toezicht en transparantie. Het knelpunt zit vervolgens in een effectieve handhaving. Veel Europese landen maken daar weinig werk van.

Kortom: de belangrijkste instrumenten om agentsystemen te laten doen wat ze moeten doen zonder uit de bocht te vliegen, bestaan al. Helaas werkt het doemscenario waarin AI de mensheid uitroeit als een gewiekste goocheltruc. Het stuurt onze blik naar de ogenschijnlijke magie van AI. Ongemerkt verdwijnt dan uit beeld wie verantwoordelijk is voor die systemen. En dat zijn mensen, organisaties en bedrijven.

Deel via: