Kinesiske Moonshot lancerede AI-modellen Kimi K3 to uger efter Anthropics Fable, og amerikanske eksperter afviser at det blot er en kopi.
Da den kinesiske AI-virksomhed Moonshot den 16. juli offentliggjorde Kimi K3, mødte modellen straks anklager fra Det Hvide Hus om at være bygget på stjålen amerikansk teknologi. Men flere uafhængige AI-forskere afviser den udlægning.
“Jeg tror ikke, man får en model så stærk og så hurtigt oven på Fable udelukkende ved distillation,” siger Braden Hancock, medstifter af Snorkel AI og forsker ved Laude Institute, til TechCrunch.
Hancock henviser til det knappe tidsvindue mellem Anthropics offentliggørelse af Fable-modellen den 1. juli og Kimi K3’s debut godt to uger senere. Distillation er en teknik, hvor man bruger en stor og dygtig AI-model til at oplære en mindre model på dens svar.
Verdens største åbne sprogmodel
Kimi K3 er en mixture-of-experts-model med 2,8 billioner parametre, hvilket gør den til den største åbent tilgængelige sprogmodel til dato, beskriver den amerikanske AI-udvikler Simon Willison på sin blog. Modellen understøtter billed-input, og prisen er tre dollar per million input-tokens og 15 dollar per million output-tokens, svarende til omkring 20 og 100 kroner.
På uafhængige tests placerer K3 sig som nummer to på Vals AI-indekset og nummer tre på Artificial Analysis’ Intelligence Index, skriver Allen Institute-forskeren Nathan Lambert i sin analyse af modellen. På Arenas leaderboard for frontend-kode har K3 desuden overhalet netop Anthropics Fable 5.
Anthropics Fable 5, som anklagerne handler om, er ifølge selskabet den mest kapable Claude-model, der nogensinde er blevet frigivet. Den blev oprindeligt gjort tilgængelig den 9. juni, men blev trukket tilbage tre dage senere af hensyn til yderligere sikkerhedstiltag og genudsendt den 1. juli, kort inden Moonshot lancerede sin egen model.
Det Hvide Hus anklager Kina
Kravet om at Kimi K3 skulle være tyveri kommer fra højeste sted i Washington. Ifølge TechCrunch har videnskabsrådgiver Michael Kratsios kaldt storstilet, skjult industriel distillation, der har til formål at stjæle amerikansk teknologi, for uacceptabelt, mens finansminister Scott Bessent har hævdet, at man kan finde vandmærker fra amerikanske sprogmodeller i mange af de kinesiske modeller.
Distillation-metoden fungerer i praksis ved, at et laboratorium sender store mængder forespørgsler til en avanceret model og bruger svarene til at oplære sin egen model. Praksissen er ikke ulovlig i sig selv, men bryder de amerikanske udbyderes servicevilkår.
“Legitime forskere og ingeniører”
Både Hancock og Lambert peger på, at metoden ikke kan forklare Kimi K3’s niveau. I sin analyse skriver Lambert, at “hvis fjendtlig distillation fra de lukkede topmodeller i USA har bidraget, er det højst i relativt begrænset omfang.” Han tilføjer, at observatører, der har konkluderet, at kinesiske laboratorier kun laver gode modeller på grund af tyveri af immaterielle rettigheder, står over for en opvågnen.
Hancock er ligeledes klar i mælet over for TechCrunch og betegner de kinesiske hold som legitime forskere og ingeniører, der udfører solidt arbejde. Lambert vurderer, at Moonshot går “toe to toe med Anthropic og OpenAI med langt, langt færre ressourcer”.
Moonshot har lovet at frigive de fulde vægte for Kimi K3 senest den 27. juli, hvilket vil gøre modellen fri at hente og videreudvikle for udviklere over hele verden.