Trend DK
Forside AI Anthropic-forsker forlod firmaet med dyster AI-advarsel “De spiller med vores...

Anthropic-forsker forlod firmaet med dyster AI-advarsel “De spiller med vores liv”

Anthropic-forsker forlod firmaet med dyster AI-advarsel
Illustrationsfoto / AI-genereret

En 27-årig AI-forsker forlod Anthropic i protest og gik på X med en tråd om et kapløb mod menneskehedens undergang.

Beskeden kom sent tirsdag aften den 8. september 2026 fra Jacob Coxon, der ifølge sin egen tråd har brugt de seneste tre år på pretraining-forskning hos først OpenAI og siden Anthropic. Coxon skriver, at ingen af de to virksomheder handler ansvarligt, og at industrien styrer direkte mod en selvforbedrende superintelligens.

“They are racing straight to self-improving superintelligence and gambling with our lives,” lyder et af de centrale citater i tråden, som TechCrunch har gennemgået. Oversat: De styrer lige mod en selvforbedrende superintelligens og spiller hasard med vores liv.

Coxon uddyber i tråden, at systemerne snart vil kunne hacke stort set alt og omvælte hele fagområder fra dag til dag. “The people building AI earnestly believe that it could kill us all by the end of the decade,” skriver han ifølge Common Dreams. Altså: De mennesker, der bygger AI, tror oprigtigt på, at det kan slå os alle ihjel inden årtiets udgang.

Fra GPT-4o til opsigelse på X

Ifølge Newsweek er Coxon 27 år, uddannet i matematik og var fra 2023 til 2026 en del af den tekniske stab hos OpenAI, hvor han arbejdede på GPT-4o-modellen. Han skiftede til Anthropic, som han nu forlader med en offentlig opsigelse på X under aliasset @hilbertspaess.

Tråden fik hurtigt bred rækkevidde, og debatten i AI-miljøet eksploderede i timerne efter opslaget.

Anthropic havde ikke ved offentliggørelsen udsendt en officiel reaktion, oplyser PBS NewsHour, der forgæves har forsøgt at få en kommentar fra både Anthropic og OpenAI.

Anthropics egen alignment-chef bakker op

En af de skarpeste reaktioner kom indefra selskabet. Evan Hubinger, der er leder af Anthropics alignment-forskning, gik offentligt ud og gav Coxon medhold på et punkt, hvor virksomheden normalt bliver anklaget for at nedtone risikoen.

“Jacob is correct here, we really do earnestly believe AI could kill all humans,” skrev Hubinger ifølge Common Dreams. Han tilføjede, at han personligt vurderer sandsynligheden for et sådant udfald til over 10 procent inden for det næste årti, og at Anthropic gør sit bedste, men endnu ikke har en plan for at løse alignment for superintelligens.

Coxon selv beskriver i tråden en stemning i laboratorierne, hvor kolleger taler om “crunchtime” og “endgame”, og hvor tingene efter hans vurdering kan være ude af kontrol allerede inden udgangen af næste år.

Debatten om selvforbedrende systemer

Bekymringen handler konkret om det, forskerne kalder rekursiv selvforbedring: AI-systemer, der bliver dygtige nok til selv at designe og træne den næste generation af modeller. Sker det, argumenterer Coxon, forsvinder den menneskelige kontrol hurtigt, fordi udviklingen accelererer i et tempo, hvor tilsyn og sikkerhedsforskning ikke kan følge med.

Ifølge Coxon opererer flere af de nye laboratorier med milliardbudgetter og eksplicit fokus på netop selvforbedrende systemer. Han peger på Recursive Intelligence, der ifølge TechCrunch rejste 335 millioner dollars til en værdiansættelse på 4 milliarder dollars i februar 2026, og Recursive Superintelligence, der rejste 650 millioner dollars tre måneder senere.

Ads by MGDK