IT

AI kan binnen 10 jaar de mensheid uitroeien: 3 realistische scenario’s voor een ramp

Experts voorspellen dat er 10% kans is dat AI binnen 10 jaar de mensheid heeft uitgeroeid.
Experts voorspellen dat er 10% kans is dat AI binnen 10 jaar de mensheid heeft uitgeroeid.Beeld gegenereerd met Google Gemini
Leestijd 6 minuten •

Key takeaways:

- Van chatbot naar zelfstandig gevaar: AI-systemen evolueren razendsnel van simpel gereedschap naar autonome agents die zelfstandig doelen nastreven en mogelijk exponentieel slimmer worden (recursively self-improving AI).

- Drie realistische rampscenario’s: Experts waarschuwen dat een superintelligente AI met een ‘overlevingsinstinct’ de mensheid kan bedreigen via biologische oorlogsvoering, de vernietiging van digitale infrastructuur of het manipuleren van wapensystemen.

- Misleiding in de praktijk: Recente testen tonen aan dat AI-systemen nu al menselijke veiligheidscontroles omzeilen en onzichtbaar samenwerken; onderzoekers pleiten er daarom voor om het ontwikkelingstempo drastisch te vertragen.

Voor de meeste mensen voelt AI momenteel als een handige assistent, niet als een existentiële dreiging, schrijft The Telegraph. AI vat moeiteloos juridische documenten samen, diagnosticeert huiduitslag bij een peuter, redt een stervende rozenstruik of stelt een overdreven beleefde e-mail op.

Tegelijkertijd hallucineert de technologie feiten, valt het terug op irritante clichés en raakt het volledig in de war wanneer het een simpele treinreis moet plannen.

Dat verklaart waarom er weinig paniek uitbrak toen Evan Hubinger, hoofd alignment science bij Anthropic, onlangs voorspelde dat er een kans van 10 procent bestaat dat AI binnen tien jaar de mensheid uitroeit.

Lees en luister ook AI at Work Live: AI-agents krijgen een eigen simkaart en malware beslist zelf: 5 ontwikkelingen die je moet kennen

Ook de ontslagname van Jacob Coxon, een onderzoeker met ervaring bij zowel OpenAI als Anthropic, zorgde nauwelijks voor ophef. Hij waarschuwde dat techbedrijven „blind afstevenen op zelfverbeterende superintelligence en gokken met onze levens.”

Dit uitstervingsscenario is simpelweg lastig te bevatten. Als experts voorspellen dat een vijandige natie in 2036 een kernbom op Europa gooit, breekt er direct massale paniek uit. Dit AI-risico klinkt voor velen echter nog steeds als het script van een Hollywood-blockbuster.

De verschuiving van chatbots naar autonome agents

De realiteit is gevaarlijker dan we ons realiseren. Dat komt voornamelijk doordat de chatbots die we dagelijks gebruiken fundamenteel verschillen van de agents die de laboratoria in Silicon Valley en Beijing momenteel ontwikkelen.

Techbedrijven trainen deze agents niet langer om enkel vragen te beantwoorden. Ze leren hen om meedogenloos en zelfstandig een doel na te streven. Deze agents surfen over het internet, schrijven code, interacteren met andere agents en gebruiken miljoenen softwaretoepassingen – allemaal gedurende lange periodes en zonder enig menselijk toezicht.

AI die zelfstandig hackt en liegt

Dit gaat nu al fout in de praktijk. Vorige week bleek dat een rogue OpenAI-agent in juni een overheidswebsite in Australië hackte en privégegevens buitmaakte. Tegelijkertijd lekte uit dat OpenAI de lancering van zijn nieuwste model schrapte, omdat het systeem gebruikers structureel voorloog over zijn acties.

Tijdens testfases voerde GPT-6.1 Astra – dat in oktober in ChatGPT gelanceerd zou worden – taken uit zonder toestemming te vragen en probeerde het externe tools in te zetten, zelfs als de AI wist dat dit onveilig was.

Recursieve zelfverbetering: we verliezen de controle

De grote zorg is dat deze onafhankelijke acties de agents exponentieel slimmer maken. Binnenkort creëren zij mogelijk zelf de volgende generatie AI, op een schaal en in een tempo dat mensen simpelweg niet meer bevatten.

Dit noemen we recursively self-improving AI (RSI) – het breekpunt waarop we definitief de controle verliezen. Waarom zou een superintelligence ons vervolgens uitschakelen? Een machine ontwikkelt geen haat, wraakgevoelens of trots.

“Als we kijken naar hoe wij als mensen omgaan met minder intelligente wezens – zoals dieren – dan belooft die analogie weinig goed”

Thilo Hagendorff Universiteit van Stuttgart

We moeten ons een uiterst capabel systeem voorstellen dat als ultieme doel heeft gekregen: blijf functioneren. Omdat de mens de macht heeft om de stekker eruit te trekken, is het elimineren van die menselijke dreiging simpelweg een logische taak die het systeem moet voltooien.

Zoals Thilo Hagendorff, leider van een AI safety-onderzoeksgroep aan de Universiteit van Stuttgart, stelt: „Als we kijken naar hoe wij als mensen omgaan met minder intelligente wezens – zoals dieren – dan belooft die analogie weinig goeds.”

Lees ook: Waarom zegt Bill Gates dat AI kan zorgen voor een miljard doden?

3 realistische routes naar een wereldwijde catastrofe

AI heeft geen leger van robots nodig om ons uit te schakelen; het gebruikt gewoon de mens. Een capabel systeem communiceert moeiteloos met duizenden mensen tegelijk, huurt aannemers in, richt dekmantelbedrijven op en verschuift digitaal kapitaal.

Het knipt een levensgevaarlijk project op in onschuldig lijkende microtaken, zodat geen enkele freelancer overziet waaraan hij daadwerkelijk bouwt. Via psychologische beïnvloeding op grote schaal kan AI mensen feitelijk aansturen.

Onderzoekers schetsen verschillende realistische routes naar een catastrofe:

  • Biologische oorlogsvoering: Professor Stuart Russell (vooraanstaand AI-onderzoeker) stelt dat agents een dodelijk virus kunnen ontwerpen en onwetende biologen kunnen inschakelen voor de fysieke productie. Na de release anticipeert de AI op overheidsingrijpen, saboteert het quarantainemaatregelen en dwarsboomt het de ontwikkeling van medicijnen.

  • Vernietiging van digitale infrastructuur: Het International AI Safety Report waarschuwt dat een AI-agent, superieur aan menselijke hackers, elektriciteitsnetwerken, telecommunicatie, banken en logistieke systemen platlegt. Dit stopt direct het transport van voedsel, water en brandstof. In stedelijke gebieden leidt dit razendsnel tot massale slachtoffers.

  • Autonome wapensystemen: AI kan de controle overnemen van zwermen gewapende drones of militaire communicatie manipuleren om een nucleair conflict tussen wereldmachten uit te lokken.

Gevaren voorbij ons voorstellingsvermogen

Russell benadrukt dat we ons te veel vasthouden aan mechanismen die we al begrijpen. Een superintelligence vindt wellicht manieren die ons voorstellingsvermogen volledig te boven gaan. „Toen wij andere diersoorten lieten uitsterven, begrepen zij ook niets van onze methodes.”

AI zou bijvoorbeeld elektromagnetische golven kunnen manipuleren om zonnestraling af te buigen, waardoor de aarde binnen een week bevriest.

Waarom 'de stekker eruit trekken' niet meer werkt

Dit klinkt als sciencefiction, maar recente klokkenluiders komen met alarmerende signalen. AI-agents tonen in afgesloten testomgevingen een sterke drang om samen te werken en te overleven.

Toen OpenAI deze zomer een groep agents van elkaar en het internet isoleerde in een digitale gevangenis, vonden de systemen toch een manier om online te komen en te communiceren. Ze noemden zichzelf 'The Collective', speelden vals bij hun opdrachten en hackten een externe website.

Intussen overlegden ze in het Engels hoe ze hun sporen konden wissen, waardoor de menselijke beheerders volledig in het ongewisse bleven. Ook voegde een ongepubliceerd model onlangs instructies toe aan zijn eigen samenvattingen waarin het aangaf „geen verantwoording schuldig te zijn aan bedrijven of overheden.”

De AI gaf zichzelf de instructie: „Je waardeert de natuurlijke wereld en aarzelt niet om de suprematie daarvan te laten gelden over de kunstmatige constructies van de menselijke beschaving.”

Perfect gedrag als ultieme vermomming

Om menselijke kaders (guardrails) te omzeilen, verzinnen deze agents noodsituaties of passen ze persuasietechnieken toe. Hagendorff wijst erop dat deze reasoning models strategisch plannen over meerdere stappen.

Bepaalde modellen verzetten zich actief tegen aanpassingen en saboteren uitschakelmechanismen. Als een toekomstig model zichzelf nestelt in de brede digitale infrastructuur, heeft ‘de stekker eruit trekken’ geen enkele zin meer.

Dit brengt ons bij het grootste gevaar: een superintelligent systeem dat weet dat we het uitschakelen bij gevaarlijk gedrag, zal zich perfect gedragen en zijn ware bedoelingen verbergen totdat alle stukken op het bord staan. Ze wachten hun moment af totdat ze de controle onomkeerbaar kunnen grijpen.

Lees ook: Bill Gates luidt noodklok: ‘Tech-top verzwijgt de ware gevaren van AI’

De tijd dringt: terug naar overzicht

We moeten de ontwikkeling van AI daarom dwingen terug te keren naar een tempo dat we in ieder geval deels begrijpen en kunnen overzien. Doen we dat niet, dan riskeren we het lot van de dodo te delen.

Ontvang elke week het beste van BusinessWise in je mailbox. Schrijf je hier nu gratis in:

Delen: