Han har brukt tre år på å trene noen av verdens kraftigste KI-modeller. Nå har Jacob Coxon sagt opp og advarer om at selskapene gambler med menneskeliv. Enda mer oppsiktsvekkende: Forskere som fortsatt sitter på innsiden, støtter ham – én setter risikoen for at KI utsletter menneskeheten til over ti prosent.
– Ikke undervurder kraften i denne teknologien. Dette vil snart være overmenneskelige systemer som kan hacke hva som helst, revolusjonere ethvert fagfelt over natten og skaffe seg reell makt og ressurser, skriver Coxon på X.
Do not underestimate the power of this technology. These will soon be superhuman systems that can hack anything, revolutionize any field overnight, and acquire real power and resources. We have all witnessed the progress in each of these domains, and progress is not slowing.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Avskjeden fra Anthropic har fått enorm oppmerksomhet. Det første innlegget hadde torsdag passert 139 millioner visninger, ifølge visningstelleren på X.
Coxon skriver at han de siste tre årene har forsket på såkalt «pretraining» – den grunnleggende treningen av KI-modeller – hos både OpenAI og Anthropic.
Nå retter han kraftig kritikk mot begge.
– Ingen av selskapene opptrer ansvarlig. De raser rett mot selvforbedrende superintelligens og gambler med livene våre, skriver han.
– Kan drepe alle mennesker
Det oppsiktsvekkende er at Coxon raskt fikk støtte fra forskere som fortsatt arbeider i Anthropic.
Evan Hubinger, som leder selskapets arbeid med såkalt Alignment Science, svarte at Coxon har rett i at frykten er reell.
– Vi tror virkelig og oppriktig at KI kan drepe alle mennesker, skrev Hubinger.
Han anslår personlig risikoen for at dette skjer til over ti prosent i løpet av det neste tiåret.
Hubinger skriver samtidig at Anthropic etter hans vurdering gjør sitt beste, men at selskapet ennå ikke har noen løsning på hvordan en framtidig superintelligens skal holdes under kontroll og i tråd med menneskelige mål.
Også Anthropic-forskeren Samuel Marks støttet hovedbekymringen. Han skrev på egne vegne at KI kan føre til menneskehetens utryddelse eller et tilsvarende katastrofalt utfall.
– Dette kan skje i løpet av de neste få årene, skrev Marks.
Ifølge ham har bekymringen en tendens til å være større blant mer erfarne og høytstående forskere.
[Writing this in a personal capacity, not on behalf of my employer (Anthropic).]
— Samuel Marks (@saprmarks) September 9, 2026
Jacob’s thread is very worth reading. Here’s my birds-eye view of the situation with risks from AI:
1. AI developers believe their technology could cause human extinction (or similarly bad… https://t.co/rCVoiOWWzm
– Dette er ikke et PR-stunt
Coxon hevder selv at frykten er langt større inne i KI-industrien enn det offentligheten får inntrykk av.
Ifølge forskeren toner ledere og seniorforskere ned ordbruken når de uttaler seg offentlig, mens han privat hører de samme menneskene uttrykke frykt.
– Dette er ikke et PR-stunt, skriver han.
Coxon mener ingen annen menneskelig aktivitet innebærer en risiko på samme nivå.
Frykter kappløpet
Ifølge Coxon er situasjonen forskjellig hos de to KI-gigantene han selv har arbeidet for.
Han hevder at mange hos OpenAI ikke fullt ut har tatt inn over seg hva som står på spill for sivilisasjonen. Hos Anthropic mener han derimot at risikoen er godt forstått.
Problemet er kappløpet.
Ifølge Coxon frykter Anthropic at andre vil komme først dersom selskapet selv bremser.
– De tror ingen andre vil opptre ansvarlig, og derfor må de gjøre det selv, til tross for risikoen, skriver han.
Han beskriver beslutningen om å gå inn i det han kaller «sluttspillet», som et «hovmodig veddemål» som ikke bør avgjøres internt i et privat selskaps Slack-kanaler.
Vil bremse utviklingen
Coxon tar til orde for avtaler mellom amerikanske KI-selskaper om å bremse kappløpet. Dersom det ikke er nok, mener han selv et midlertidig forbud mot å gjøre modellene kraftigere bør vurderes.
Til slutt henvender han seg direkte til forskerne som fortsatt bygger teknologien.
Han ber dem spørre seg om de virkelig vil starte treningen av en superintelligent modell uten å ha en grundig forståelse av hvordan den fungerer.
– Skal du bare bøye hodet fordi «det skjer uansett» – eller bruke dette øyeblikket til å kreve andre betingelser?
Coxons advarsel har også nådd amerikansk politikk. Senator Bernie Sanders har varslet lovgivning for å stanse utviklingen av superintelligens.
Merk: Artikkelen er i hovedsak bygget på Jacob Coxons egne innlegg på X etter at han forlot Anthropic. Opplysninger om avgangen og reaksjonene er kontrollert mot AP News.
