Drie onderzoekers van Anthropic hebben publiekelijk hun bezorgdheid geuit over een kunstmatige intelligentie die uit controle kan raken, en waarschuwen dat zij de mensheid mogelijk tot het einde van het decennium zou kunnen uitroeien. Jim VandeHei en Mike Allen brengen dit verhaal in een artikel dat op 9 september 2026 bij Axios werd gepubliceerd.
Onderzoeker Jacob Coxon nam dinsdag ontslag om, zo blijkt uit wat Axios citeert, « de alarmklok te luiden » op X: de mensen die AI bouwen geloven oprecht dat het ons allemaal zou kunnen doden vóór het einde van het decennium, en het is geen PR-stunt. Evan Hubinger, hoofd onderzoek naar afstemming bij Anthropic, volgde hem op hetzelfde netwerk en bevestigde dat het bedrijf « nog geen plan heeft » om de afstemming van een superintelligente AI op te lossen, terwijl hij zelf het risico op meer dan 10% in het komende decennium inschat. Samuel Marks, hoofd toezicht op grootschalige systemen bij Anthropic, voegde eraan toe dat hoe meer een werknemer ervaring heeft, hoe bezorgder hij is, aldus de door Axios geciteerde uitspraken.
Deze uitspraken komen slechts enkele dagen nadat OpenAI-leiders, waaronder CEO Sam Altman, ook hebben gesproken over een onbeheersbare en zorgelijke fase in de ontwikkeling van AI, melden Jim VandeHei en Mike Allen. Axios ziet hierin een dilemma dat door de hele sector wordt gedeeld: terugschroeven ten koste van vertraging, of doorgaan met het risico de controle te verliezen. Een sector die, zo schrijft de media, met volle snelheid vooruitgaat terwijl men bijna om wereldwijde regelgeving of een pauze vraagt.
Hoewel sommige critici menen dat Anthropic en OpenAI de gevaren van hun producten overdrijven om hun waardering op te drijven en regelgeving te bepleiten die vooral de dominante spelers ten goede zou komen, bevestigt Axios dat men al maanden met tientallen mensen binnen deze bedrijven heeft gesproken die steeds alarmeler zijn. De media stelt dat het onverstandig zou zijn deze waarschuwingen niet serieus te nemen, aangezien deze onderzoekers toegang hebben tot modellen die nog niet publiek zijn vrijgegeven.
VandeHei en Allen benadrukken dat niemand de dreiging van een directe, onmiddellijke calamiteit aanwakkert. Wat deze onderzoekers beschrijven, is een technologie die sneller vooruitgaat dan verwacht en die binnenkort in staat zou kunnen zijn zichzelf autonoom te verbeteren. Een fenomeen dat, eenmaal op gang, zich nog sneller zou kunnen uitbreiden en moeilijker te voorspellen en te beheersen zou maken.