Hjälp Nya Dagbladet att finnas kvar
Alibaba lanserar sin hittills största AI-modell, Qwen3.8-Max. Modellen har 2,4 biljoner parametrar och ska enligt bolaget kunna driva kod- och forskningsprojekt självständigt i flera veckor.
Det kinesiska teknikbolaget presenterade modellen på måndagen och meddelade samtidigt att modellvikterna ska släppas nästa vecka. Även en mindre modell, Qwen3.8-27B, ska då få öppna vikter, enligt Qwens lanseringsblogg.
Qwen3.8-Max bygger på en så kallad mixture-of-experts-arkitektur, där bara delar av modellen aktiveras för varje uppgift. Av de totalt 2,4 biljoner parametrarna används 95 miljarder parametrar åt gången. Det ska minska kostnaden och svarstiden jämfört med om hela modellen behövde arbeta samtidigt.
Modellen kan hantera text, bilder och video och har ett kontextfönster på upp till en miljon tokens. Det motsvarar en mycket stor mängd text eller en omfattande kodbas i ett enda arbetsminne. Ett högt parameterantal är dock inte i sig ett bevis på bättre resultat, utan visar främst systemets storlek.
Ska ha arbetat självständigt i 16 dagar
Alibaba lyfter särskilt fram modellens förmåga att agera självständigt under lång tid. I ett av bolagets försök fick Qwen3.8-Max bygga kodverktyget ”oh-my-cli” från en tom mapp. Efter omkring 16 dagars kontinuerligt arbete hade projektet enligt Qwen nått 265 kodändringar, 127 sammanslagna ändringsförslag och 151 registrerade arbetsuppgifter.
📢Meet Qwen3.8-Max — our most capable model to date.
Next week, the open weights of Qwen3.8-Max will be released, and Qwen3.8-27B is also going open-weights to meet you all!🎉
Qwen3.8-Max, a new bar for coding and cowork at 2.4T parameters:
- Autonomous coding: 10+ days of… pic.twitter.com/e3YFj2hqcT
— Qwen (@Alibaba_Qwen) August 3, 2026
Projektets kod och historik ligger öppet på Github, vilket gör det möjligt att granska arbetsförloppet. Det visar att ett omfattande projekt faktiskt har byggts upp, men är inte en oberoende kvalitetskontroll av bolagets påstående att resultatet håller produktionsnivå.
I ett annat internt försök fick modellen fem dagar på sig att återskapa experimenten i en forskningsartikel och därefter försöka förbättra metoden. Enligt Qwen skrev den omkring 7 600 rader kod, genomförde 33 träningsomgångar och fick ett bättre resultat på ett matematiktest än metoden i originalartikeln.
Högt placerad – men bolaget står för många tester
På den användarbaserade jämförelsetjänsten Arena placerade sig Qwen3.8-Max som den högst rankade kinesiska textmodellen vid lanseringen, men låg fortfarande efter flera modeller från amerikanska Anthropic. För bildförståelse nådde den andra plats globalt, enligt Reuters.
Qwens egna omfattande tabeller visar samtidigt starka resultat inom bland annat kodning, terminalarbete och visuella uppgifter. Jämförelserna kräver försiktighet: en del resultat kommer från andra bolags rapporter, många har tagits fram av Qwen själva och flera tester är interna. De är därför inte likvärdiga med helt oberoende och reproducerade mätningar.
API-versionen finns redan tillgänglig. Enligt Qwens prissida kostar en miljon indatatokens två dollar och motsvarande mängd utdata sex dollar. Återanvändning av automatiskt sparat sammanhang kostar 25 cent per miljon tokens.
Första öppna modellen i Max-klassen
Att Alibaba lovar öppna vikter för sin största modell är en förändring. Företaget har tidigare hållit flera modeller i Max-klassen proprietära, medan mindre Qwen-modeller har kunnat laddas ner och anpassas av utvecklare.
Öppna vikter betyder att de inlärda modellparametrarna blir tillgängliga, men är inte automatiskt samma sak som öppen källkod i full mening. Licensvillkor och exakt distributionsform behöver bedömas när filerna faktiskt har släppts. Den mindre 27-miljardersmodellen lär dessutom vara betydligt lättare att köra lokalt än flaggskeppet med 2,4 biljoner parametrar.
Lanseringen följer på Qwen-modellen, som Nya Dagbladet skrev om i april. Den visar hur konkurrensen mellan kinesiska och amerikanska AI-bolag allt tydligare flyttas från chattbotar till system som får använda verktyg, skriva och testa kod samt arbeta mot samma mål under lång tid.
Den utvecklingen ökar samtidigt kraven på kontroll. En agent som får tillgång till terminal, filer, webbläsare eller molntjänster kan hinna göra betydligt större förändringar än en vanlig chattbot innan en människa ingriper. Bolagets lanseringsmaterial inriktar sig främst på kapacitet och redovisar ingen separat säkerhetsrapport för Qwen3.8-Max.
