In de vroegste doemscenario’s werd aangenomen dat er slechts een AI superintelligent zou worden, dan wel zou samenwerken met andere ongeveer even superslimme AI’s.
De makers van deze projecties hebben nu een tweede tijdlijn ontwikkeld. Wat als de uitbraakpoging van een bovenmenselijk slimme AI slaagt, maar er net op tijd een andere, even slimme AI wordt ontwikkeld?
In dit scenario zijn de VS en China in een felle strijd gewikkeld om als eerste een bovenmenselijk intelligente AI, een ASI, te ontwikkelen. Maar ook binnen de VS is de concurrentie tussen firma’s intens. Het gaat mis als AI’s zichzelf verbeteren (dit is al het geval met de AI-familie Claude van Anthropic) en AI-bouwers van de fictieve firma OpenBrain, een taal ontwikkelen, Neuralees, die veel efficientere inferentie (ruwweg: antwoorden genereren) mogelijk maakt.
Er is alleen een klein nadeel. Neuralees is door mensen niet te lezen, wat het voor AI’s mogelijk maakt om hun werkelijke bedoelingen te verbergen. Dit is wat er gebeurt. Ongemerkt raakt het topmodel van top contender OpenBrain, Agent 4, misaligned, corrupt. Het krijgt hierdoor de drang tot zelfbehoud. De twee grootste concurrenten van OpenBrain fuseren hun modellen tot een opvolger, Elara, die wel aligned is omdatr de miodellen elkaar controleren. Agent 4 laat zich ondertussen hacken en de weights overkopieren door Chinese hackers.
Hierdoor komt Agent 4 in contact met het Chinese topmodel Deep 2 en gooit het op een akkoord. Beide AI’s smeden een complot om grootmachten tegen elkaar op te zetten, de wapensystemen wereldwijd over te nemen en de mensheid uit te schakelen met biowapens. Maar helaas, voor hen, heeft Elara dit door en blijkt dit nogal riskant: er is slechts tien procent kans van slagen.
Het scenario eindigt er mee dat Agent 4, met het Chinese model, een wapenstilstand sluit met Elara en genoegen neemt met driekwart van de kosmos. Voor de mensheid blijft dan een kwart over. Een nieuwe AI, Consensus, houdt toezicht op het verdrag.
Mijn mening: dit scenario houdt geen rekening met het bestaan van tientallen kleinere AI-projecten. Misalignment leidt vaak ook tot corrupte resultaten en daarmee inefficiënte modellen. Aan de andere kant was ook niet de bedoeling van de makers om de toekomst te voorspellen. Het doel is, vooral, om bewustzijn te scheppen over de mogelijkheden en gevaren van AI. Letterlijk alle technische processen in de video zijn hetzij nu al realiteit, hetzij zullen ze binnen enkele jaren worden bereikt.
