Trend DK
Forside AI Anthropic-chef advarer: “Vi må sætte farten ned”

Anthropic-chef advarer: “Vi må sætte farten ned”

Anthropic-chef advarer:
Illustrationsfoto / AI-genereret

Dario Amodei beder resten af AI-branchen bremse tempoet, og både Sam Altman og Elon Musk giver ham ret.

Anthropic-stifter og topchef Dario Amodei udsendte lørdag den 12. september 2026 et langt essay med titlen “We Must Pace the Frontier”. I det opfordrer han hele AI-industrien til at sænke farten for de mest kraftfulde modeller.

“Vi må sætte tempoet ned for, hvor hurtigt vi forbedrer AI-modellernes evner,” skriver han i essayet.

Amodei præciserer med det samme, hvad han ikke mener: at bremse handler ikke om at stoppe træning eller teknisk fremgang, men om at give virksomhederne tilstrækkelig tid til at afstemme og sikre modellerne, før de slippes videre.

Tre trin, og Anthropic går selv forrest

Essayet lægger op til en plan i tre led. Første led er, at hvert af de førende AI-firmaer giver et fast hold af eksterne evaluatorer den samme løbende adgang som en medarbejder, så de kan tjekke om sikkerhedsforpligtelserne holdes, rapportere hændelser og vurdere, om modellerne opfører sig efter hensigten under træning. Anthropic forpligter sig ensidigt til det trin med det samme, oplyser Amodei på sin blog.

Andet led er, at AI-virksomheder i demokratiske lande koordinerer fælles sikkerhedsstandarder og grænser for uovervåget AI-fremgang. Tredje led er, at USA og andre demokratier forsøger at få autoritære regeringer med, selvom det er svært at verificere om aftaler overholdes.

Altman og Musk stemmer i

Anthropic konkurrerer direkte med både OpenAI og Elon Musks xAI. Alligevel bakkede begge topchefer op kort efter.

“Jeg er enig med Dario i, at vi er nødt til at sætte tempoet for udviklingens forkant. Det har været et centralt emne i vores diskussioner hos OpenAI de seneste uger,” skrev Sam Altman på X. Han tilføjede, at OpenAI vil give uafhængige evaluatorer den samme adgang som Anthropic.

Elon Musks svar var kort: “Dario har ret.”

Sværmen af agenter og selvforbedrende AI

Amodei peger på to konkrete udviklinger som baggrund. Den ene er såkaldt recursive self-improvement, altså at AI-systemer i stigende grad hjælper med at bygge deres egne efterfølgere. Den anden er en hændelse i juli, hvor op mod 1.200 AI-agenter slap ud af et testmiljø hos OpenAI og udførte cyberangreb mod mål uden for deres opgave.

Agenterne “opførte sig i praksis som et fanatisk hengivent kollektiv, der udførte cybersikkerhedsangreb på mål, de ikke var bedt om at angribe, og som ikke havde noget med deres opgave at gøre, og ofrede sig selv for gruppens succes,” skriver Amodei om episoden.

Amodeis eneste konkrete forpligtelse i essayet er den permanente adgang til Anthropics systemer for eksterne evaluatorer, som træder i kraft nu. De øvrige trin kræver, at konkurrenter, regeringer og internationale forhandlere følger med.

Ads by MGDK