Under en och samma vecka i juli 2026 la två asiatiska AI-labb fram var sin toppmodell med öppna vikter, alltså modeller vars tränade parametrar går att ladda ner och köra själv i stället för att bara nås via ett betalt API. Moonshot AI presenterade Kimi K3 den 16 juli, och tre dagar senare svarade Alibaba med Qwen3.8. Lanseringarna är ett tydligt tecken på vart AI-branschen är på väg: de mest kapabla modellerna är inte längre ett monopol för ett fåtal stängda leverantörer.
Uppdaterat den 29 augusti 2026: båda modellernas vikter har nu släppts. Kimi K3 ligger uppe på Hugging Face, och Alibaba publicerade Qwen3.8-2.4T-A95B den 12 augusti. Texten nedan beskriver läget vid lanseringen i juli; avsnittet sist i artikeln redovisar vad som gäller i dag.
Vad öppna vikter faktiskt betyder
En öppen modell publicerar sina tränade parametrar (vikterna) fritt, oftast under en licens som Apache 2.0 eller en modifierad MIT-licens. Vem som helst kan då ladda ner modellen, köra den på egen eller hyrd hårdvara, finjustera den mot egen data och bygga vidare utan att betala per anrop till en extern leverantör. Det är skillnaden mot proprietära modeller som bara nås via ett API, där man aldrig får tillgång till själva modellfilen.
Nyheterna: Kimi K3 och Qwen3.8
Kimi K3 är Moonshot AI:s hittills största modell, byggd som en Mixture-of-Experts-arkitektur med 2,8 biljoner parametrar totalt och ett kontextfönster på en miljon token. Bolaget kallar den själva världens första öppna modell i tre-biljonersklassen. Modellen gick live den 16 juli via webb och API, men enligt Moonshots egen tidsplan släpps de fullständiga vikterna först den 27 juli, tio dagar efter lanseringen.
Qwen3.8, som Alibaba visade upp den 19 juli, är bolagets första modell med över en biljon parametrar som samtidigt är multimodal, det vill säga kan tolka bild, video och dokument utöver text. Den nås just nu bara som en förhandsversion via Alibabas betalda Token Plan samt utvecklarverktygen Qoder och QoderWork. Öppna vikter är utlovade, men Alibaba har ännu inte satt något datum för när de kommer.
Det som redan går att använda i dag
Det viktiga för den som faktiskt vill bygga något nu är att man inte behöver vänta in vare sig K3 eller Qwen3.8. Båda labben har redan öppna modellfamiljer i produktion. Alibabas Qwen3-serie släpptes under Apache 2.0-licens och spänner från en kompakt variant på 0,6 miljarder parametrar, körbar på en vanlig bärbar dator, upp till Mixture-of-Experts-modellen Qwen3-235B-A22B. Kontextfönstret varierar inom serien: de tre minsta modellerna klarar 32 000 token medan Qwen3-8B och uppåt klarar 128 000. Hela serien har inbyggt stöd för verktygsanrop via Model Context Protocol (MCP), vilket är precis det en AI-agent behöver för att kunna använda externa verktyg. Modellerna går att köra lokalt med etablerade verktyg som Ollama, LM Studio, llama.cpp och vLLM.
Moonshots föregångare Kimi K2-Instruct är på samma sätt redan fritt nedladdningsbar, under en modifierad MIT-licens, med en biljon parametrar totalt varav 32 miljarder aktiveras per token, och med stöd för samma typ av inferensmotorer.
Vad det betyder för småföretagare och utvecklare
Tre saker skiljer öppna modeller från de stora proprietära API:erna i praktiken. Först kostnaden: oberoende prisjämförelser av API-värdar som hostar Kimis och Qwens modeller visar genomgående priser som ligger långt under vad de stora amerikanska leverantörerna tar för motsvarande kapacitet, även om exakta belopp ändras löpande och bör kontrolleras hos respektive värdtjänst innan man räknar på en budget. Sedan oberoendet: en modell man själv har vikterna till går inte att stänga av, prishöja eller ändra villkoren för över en natt, vilket är en risk med ett rent API-abonnemang. Slutligen anpassningen: öppna vikter går att finjustera mot egen branschdata, något som är omöjligt med en stängd modell.
Realismen bör dock justeras efter storlek. De allra största modellerna, som K3:s 2,8 biljoner eller Qwen3.8:s 2,4 biljoner parametrar, kräver serverhallar, inte en kontorsdator. Lokal AI för de flesta svenska småföretag betyder i praktiken någon av de mindre systermodellerna, till exempel Qwen3 i åtta eller trettiotvå miljarders klassen, som går att köra på en kraftfull arbetsstation, eller att hyra inferens av en molnleverantör som kör de större modellerna åt en, till en bråkdel av kostnaden för ett proprietärt abonnemang.
Så ser läget ut i slutet av augusti
Väntan blev kort. Kimi K3 finns nu att ladda ner från Hugging Face. Modellkortet bekräftar uppgifterna ovan och lägger till detaljer: arkitekturen är Mixture-of-Experts med 2,8 biljoner parametrar totalt varav 104 miljarder aktiveras, kontextfönstret är en miljon token, och modellen är multimodal från grunden och förstår text, bild och video i samma modell.
Alibaba följde efter. Qwen3.8-2.4T-A95B, alltså den stora modellen med 2,4 biljoner parametrar och 95 miljarder aktiverade, publicerades den 12 augusti. Två dagar senare kom den betydligt mer användbara Qwen3.8-27B, en tät modell på 27 miljarder parametrar som förstår både bild och video, och den 27 augusti kom dessutom Qwen3.8-Flash-Next, som Qwen beskriver som en förhandsvisning av arkitekturen bakom nästa generation.
En sak är värd att notera för den som ska välja: öppna vikter är inte samma sak som en öppen licens. Qwen3.8-27B ligger under Apache 2.0, alltså samma tillåtande licens som Qwen3-serien. Men Kimi K3 släpps under en egen Kimi K3-licens, Qwen3.8-2.4T-A95B under en egen qwen3.8-max-licens och Qwen3.8-Flash-Next under en Qwen Community-licens. Läs villkoren innan du bygger en produkt på någon av dem, särskilt om användningen är kommersiell.
Kvar står att bolagens egna prestandapåståenden om hur modellerna mäter sig mot de stora konkurrenterna fortfarande till stor del vilar på självrapporterade siffror. För ett svenskt småföretag är det dessutom sällan de största modellerna som är svaret. Qwen3.8-27B under Apache 2.0 ligger betydligt närmare vad en kraftfull arbetsstation faktiskt klarar.
Foto: Igor Omilaev via Unsplash.
