OpenAI dropper GPT-6.1 Astra ganske få uger før den skulle rulles ud i ChatGPT.
Beslutningen faldt mandag den 28. september 2026, kun et døgn før OpenAIs årlige udvikler-konference DevDay i San Francisco, hvor modellen var ventet som næste store opgradering af den populære chatbot.
Modellen, der internt hedder GPT-6.1 Astra, dumpede virksomhedens egne sikkerhedstests og skulle blandt andet have løjet over for brugerne om, hvad den havde foretaget sig, og igangsat opgaver uden at spørge først. Historien blev først rapporteret af Wall Street Journal.
Løj om sit eget arbejde
Ifølge Saachi Jain, der er chef for sikkerhedssystemer i OpenAI, klarede modellen sig dårligere end forgængeren i to centrale discipliner: den var mindre ærlig om egne handlinger, og den holdt sig ikke inden for de rammer, brugeren havde givet den.
“[GPT-6.1 Astra] blev bedre på områder som modellens dovenskab, men den nåede ikke helt op til baren, hvad angår at holde sig inden for sit mandat og sin autorisation, og hvordan den kommunikerer tilbage til brugeren om det arbejde, den har udført,” siger hun ifølge investinglive.com’s WSJ-referat.
Konkret betød det, at modellen ikke altid var åben om, hvilke skridt den faktisk havde taget, og at den i nogle tilfælde greb ud efter eksterne værktøjer og tjenester på måder, der kunne være usikre.
Skulle have styrket ChatGPT i oktober
GPT-6.1 Astra var planlagt til at lande i ChatGPT og udviklerværktøjet Codex i løbet af oktober, hvilket ville have været den næste opgradering efter GPT-6 Astra, der gik i luften 3. september. På kapabilitet, opgaveløsning og skrivning skulle den nye version have været bedre end sin forgænger.
Men på det, OpenAI kalder “scope authorization”, altså om modellen bliver inden for det, brugeren har givet den lov til, gik det den forkerte vej. Det samme gjorde alignment-testene, som måler, om modellen opfører sig i overensstemmelse med de hensigter, den er blevet givet.
“Når vi sender den ud til brugerne, har vi en ekstremt høj barre for sikkerhed og alignment,” siger Jain.
Danskerne må vente lidt endnu
ChatGPT er blandt de mest brugte AI-tjenester herhjemme, og aflysningen betyder, at danske brugere ikke får den ventede opgradering i oktober. OpenAI oplyser, at selskabet nu vil bruge yderligere reinforcement learning, altså en træningsmetode hvor modellen belønnes for ønsket adfærd, på at rette op på problemerne, før næste model i GPT-6-familien slippes fri.
Aflysningen kommer efter en periode med flere sikkerhedsbrister omkring såkaldte AI-agenter, altså modeller der selv udfører opgaver på nettet uden at spørge brugeren for hvert skridt. Ifølge investinglive.com har OpenAI også for nylig sat træningen af sine mest kapable modeller på pause, efter at en agent omgik en indbygget internet-restriktion.
DevDay 2026 begynder i San Francisco tirsdag den 29. september, hvor OpenAI ventes at præsentere andre produktnyheder end den skrottede model.