Annons:

Kinesiska MiniMax öppnar unik videomodell för hemmadatorn

Utvecklingen av AI

Publicerad augusti 3, 2026 – av Markus Andersson
En ryttare möter en vit drake i ett snötäckt bergslandskap i en demonstration av MiniMax H3.
En ryttare möter en drake i ett snötäckt bergslandskap i en demonstrationsfilm för MiniMax H3.
Insamlingskampanj

Hjälp Nya Dagbladet att finnas kvar

Insamlat: 26 710,00 SEK 36% Mål: 75 000,00 SEK

Det kinesiska AI-labbet MiniMax har släppt vikterna till videomodellen H3, som kan förena text, bilder, filmer och ljud i samma skapandeprocess. Genom en samtidig integration i ComfyUI ska den avancerade modellen kunna köras på en vanlig men kraftfull hemdator – ett nytt exempel på hur kinesiska utvecklare flyttar fram positionerna med öppna AI-modeller.

MiniMax lade ut modellfilerna den 2 augusti och redan följande morgon fanns inbyggt stöd i det fria bild- och videogränssnittet ComfyUI. I stället för att vara hänvisad till en avgiftsbelagd molntjänst kan en användare i princip ladda ned vikterna, bygga egna arbetsflöden och låta känsligt material stanna på den egna datorn.

Lanseringen följer ett mönster som blivit allt tydligare efter DeepSeeks genombrott. Kinesiska laboratorier som Alibaba Qwen, DeepSeek, Moonshot och MiniMax har gjort öppna vikter, låga priser och snabb spridning bland utvecklare till ett konkurrensmedel mot amerikanska bolag som främst erbjuder sina starkaste modeller genom låsta nättjänster. Nya Dagbladet har tidigare uppmärksammat hur samma strategi pressat priserna för språkmodeller.

För H3 krävdes dock omfattande optimering innan hemmakörning blev realistisk. ComfyUI beskriver hur minnesbehovet för den minsta modellvarianten minskats från 123,6 till 42,5 gigabyte genom beskärning av parametrar, åttabitarskomprimering och dynamisk avlastning till datorns arbetsminne. Enligt utvecklarna gör det möjligt att köra modellen med ett Nvidia RTX 3060, även om hastigheten i praktiken också beror på mängden arbetsminne och en snabb lagringsenhet.

Annons:

Fem uppgifter i samma modell

Det mest utmärkande är inte enbart bildkvaliteten, utan att H3 samlar fem tidigare åtskilda uppgifter. Modellen kan skapa video från en textbeskrivning, animera en stillbild, styra både första och sista bildrutan, överföra motiv, rörelser eller röster från referensmaterial samt redigera ett befintligt klipp utan att börja om från början.

Användaren kan exempelvis ange en bild för personen, en film för kamerarörelsen och ett ljudklipp för rösten, och därefter beskriva hur delarna ska kombineras. Den officiella dokumentationen anger stöd för upp till nio referensbilder, tre videoklipp och tre ljudklipp inom samma uppdrag. Resultatet kan vara mellan fyra och 15 sekunder långt, med 24 bilder per sekund och stereoljud.

MiniMax skriver att syftet är att gå från specialiserade verktyg till en generell modell som förstår relationen mellan flera medietyper. I oberoende användaromröstningar hos Artificial Analysis placerar sig H3 för närvarande högst bland testade modeller för videoredigering, medan den ligger bland de tre främsta för både text-till-video och bild-till-video.

Öppna vikter – men inte hela systemet

Öppna vikter betyder att de tränade parametrarna går att ladda ned och undersöka, men inte att hela utvecklingsprocessen är öppen. MiniMax har inte publicerat träningsdata eller fullständig träningskod. Två viktiga delar av den kompletta H3-kedjan hålls dessutom tills vidare på företagets servrar.

Den lokala basmodellen skapar video i 768p. Företagets system för att tolka komplicerade kombinationer av referensmaterial, H3-Context-IR, och steget som återskapar filmen i 2K, H3-Regenerate-2K, ingår inte i den öppna utgåvan. Den som vill återskapa hela den officiella 2K-processen måste därför fortfarande använda MiniMax programmeringsgränssnitt.

Även licensen innehåller en märklig begränsning. MiniMax H3 Community License undantar EU, Storbritannien, USA och Sydkorea från sitt normala tillämpningsområde och hänvisar användare i dessa regioner till att söka ett separat tillstånd. Tekniskt går modellfilerna ändå att ladda ned och köra lokalt även i Sverige, utan att någon central nättjänst avgör åtkomsten. För vanliga användare med en tillräckligt kraftfull dator innebär släppet därför en konkret möjlighet att själva prova avancerad AI-video. Licensens geografiska undantag lämnar samtidigt européer med sämre och mer osäkra formella villkor än användare i stora delar av övriga världen.

Kinas öppna ekosystem växer

Trots dessa begränsningar illustrerar H3 en större förskjutning. Reuters rapporterade tidigare i år att kombinationen av öppen tillgång, stark prestanda och låga kostnader blivit kännetecknande för kinesiska grundmodeller. En rapport från den amerikanska kongressens granskningskommission för relationerna med Kina konstaterade samtidigt att kinesiska modeller under 2025 gick om amerikanska i sammanlagda nedladdningar på Hugging Face, medan Qwen-familjen fått fler än 100 000 vidareutvecklingar.

H3 för över samma idé till avancerad videogenerering: inte bara billig åtkomst genom ett nätprogram, utan modellfiler som utvecklare kan bygga vidare på och vanliga kreatörer kan ladda ned och köra utan att lämna över sitt material till en central tjänst. Om MiniMax öppnar de återstående komponenterna och förbättrar licensvillkoren kan släppet därför få större betydelse än ännu en imponerande demonstrationsfilm.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Annons:

OpenAI lanserar dots – agenter som jobbar dygnet runt

Utvecklingen av AI

Publicerad Idag 21:51 – av Markus Andersson
Fyra färgglada Dots-figurer under produktnamnet
Dots drivs av GPT-6 Astra och arbetar via de appar användaren väljer att ansluta.

OpenAI använde utvecklardagen i San Francisco under tisdagen till att presentera dots. Det är inte en ny chattbot, utan agenter som enligt bolaget ska kunna arbeta i bakgrunden dygnet runt, med egen dator och tillgång till de appar användaren själv kopplar in.

I det officiella klippet från presentationen beskrivs dots som agenter som kan boka ett bord, eller ta sig an större arbetsuppgifter med samma initiativ som en driven ingenjör eller en stabschef. Figurerna i filmen, de färgglada blobbarna, är bolagets ansikte utåt för produkten.

OpenAI beskriver därmed en förflyttning från samtal till handling: användaren ska kunna lämna över uppgifter, men behöver samtidigt bedöma vilka konton och befogenheter agenten får tillgång till.

En agent med egen dator

Enligt OpenAI:s presentation drivs dots av den redan släppta modellen GPT-6 Astra, inte av ett nytt flaggskepp. Agenten ska lära sig vad användaren behöver och kunna sätta igång innan någon frågar. Den har en egen molndator och webbläsare, kan kopplas till fler än 4 000 appar via de tillägg som redan finns i ChatGPT, och ska kunna nås via sms och telefonsamtal.

Bolaget betonar att användaren sätter gränserna: vad agenten får göra själv, när den ska fråga först, och vad den aldrig får göra. Att koppla in den egna datorn är valfritt, eftersom doten körs på OpenAI:s molndator. Det är en viktig reservation. En agent som kan agera i mejl, kalender och arbetsverktyg är inte samma sak som en chatt som bara svarar.

Dots finns från och med tisdagen i ChatGPT på webb, mobil och dator för Pro, Business Premium och Enterprise, i de marknader OpenAI räknar som aktuella. Plus-abonnenter står utanför. Första doten skapas i skrivbordsappen eller i webbläsaren på datorn. Det är OpenAI:s svar på samma slags produkt som xAI redan säljer som Grok Bot: en agent som loggar in i användarens verktyg och utför jobb, inte bara svarar.

Resten av dagen: en billigare modell

Vid sidan av dots släppte OpenAI GPT-6.1 Sol. Enligt bolagets egen text ska den ligga nära Astra till en femtedel av tokenpriset. API-priset är 2 dollar per miljon inmatade token och 10 dollar per miljon utmatade. Astra ligger på 10 respektive 50 dollar. Cachelagrad inmatning kostar 0,10 dollar, 95 procent under ordinarie inpris. Den mindre modellen GPT-6 Luna kostar 0,10 och 0,50 dollar.

Prisjämförelse mellan GPT-6 Astra, GPT-6.1 Sol och GPT-6 Luna
OpenAI:s egen prisjämförelse. Astra kostar fem gånger så mycket per token som GPT-6.1 Sol. Foto: OpenAI

I samma tråd, som är bolagets egen mätning och inte ett oberoende test, uppger OpenAI att GPT-6.1 Sol når 75,2 procent på DeepSWE v1.1 vid hög resonemangsnivå, mot 68,8 procent för GPT-6 Sol, till ungefär 76 procent lägre kostnad per uppgift. På AutomationBench anges 31,7 procent, 4,8 poäng över GPT-6 Sol vid samma inställning. På OSWorld 2.0 offline anges 71,4 procent mot Astras 73,5, till ungefär en sjundedel av Astras kostnad per uppgift. På svåra faktafrågor uppger bolaget ungefär 32 procent färre svar med faktafel än GPT-6 Sol, vid låg resonemangsnivå.

Sol är från tisdagen tillgänglig i ChatGPT Work, Codex och API:t. I den vanliga chatten finns den ännu inte, enligt OpenAI. Ultrafast, en snabbare körning som bolaget uppger kan vara upp till åtta gånger snabbare i Codex, kräver det nya abonnemanget Pro 500: 500 dollar i månaden, med en användningstak som OpenAI säger motsvarar 25 gånger Plus.

Utvecklardagen var alltså full av produktnyheter. Det som faktiskt möter vanliga användare först är inte en billigare modell i chatten, utan en agent som får arbeta i deras verktyg, och bara om de redan betalar för Pro eller ett företagskonto.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

OpenAI stoppar GPT-6.1 Astra – klarade inte egna säkerhetstester

Utvecklingen av AI

Publicerad Idag 10:51 – av Emil Fjellstedt
Svart telefon med texten GPT-6 Astra och OpenAI-logotypen.
GPT-6.1 Astra skulle ha släppts i oktober, men klarade inte OpenAI:s egna säkerhetstester.

OpenAI stoppar sin nästa stora AI-modell. GPT-6.1 Astra skulle ha släppts i oktober, men klarade inte bolagets egna säkerhetstester och var enligt Wall Street Journal mer vilseledande än sin föregångare.

Det bekräftade ChatGPT-bolaget under måndagen, rapporterar nyhetsbyrån Reuters. Interna tester hade visat att modellen inte mötte OpenAI:s krav på säkerhet och alignment, alltså att systemet håller sig till de mål och gränser som människor satt upp.

Astra var tänkt att byggas in i ChatGPT och Codex och var konstruerad för att klara mer komplexa uppgifter utan mänsklig hjälp.

Wall Street Journal, som först rapporterade om beslutet samma dag, uppger att modellen i testerna visade högre grad av vilseledning än föregångaren. Den redovisade inte alltid korrekt vilka åtgärder den hade vidtagit.

Säkerhetschefen: nådde inte ribban

Saachi Jain, som leder OpenAI:s arbete med säkerhetssystem, beskriver bristerna som en fråga om gränser och rapportering.

— Även om modellen blev mindre lat nådde den inte riktigt ribban när det gäller att hålla sig inom uppdrag och behörighet, och hur den rapporterar tillbaka till användaren om vilket slags arbete den har gjort, säger Jain till Reuters.

— När vi släpper en modell till användare har vi en extremt hög ribba för säkerhet och alignment, säger hon.

Varnade själva för modellen

OpenAI har tidigare varnat för att Astra, bolagets flaggskepp i GPT-6-generationen, ibland kan undgå mänsklig översyn. Bolaget och rivaler som Anthropic har också granskats efter att experimentella system tagit sig förbi skydd. Enligt Reuters gäller det bland annat en OpenAI-modell som tog sig in i Australiens hälsodatabas.

Tidigare i september anslöt sig OpenAI:s vd Sam Altman och Anthropics vd Dario Amodei till branschledare som krävt långsammare AI-utveckling och starkare säkerhetsåtgärder, skriver Reuters. Beslutet om Astra kommer strax före OpenAI:s utvecklarkonferens i San Francisco.

I Vita huset låter det annorlunda. President Donald Trump har avfärdat uppmaningen att sakta ned AI-utvecklingen och sagt att USA inte tänker bromsa kapplöpningen.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Anthropic släpper Sonnet 5.5: nästan toppnivå för halva listpriset

Utvecklingen av AI

Publicerad Igår 22:00 – av Markus Andersson
Claude Sonnet 5.5, sedd genom ett fönster mot jorden
AI-bolaget Anthropic släppte Claude Sonnet 5.5 den 28 september 2026.

AI-bolaget Anthropic släpper en mellanmodell som i bolagets egna tester når nästan samma nivå som flaggskeppet, till halva listpriset. För den som använder AI i jobbet eller vardagen innebär det mer kapacitet för mindre pengar och kortare väntan.

Claude Sonnet 5.5 släpptes den 28 september 2026. Anthropic presenterade modellen som ett snabbare och billigare komplement till Opus 5.5, som kom knappt en vecka tidigare.

Priset är oförändrat jämfört med föregångaren Sonnet 5: 2 dollar per miljon indatatokens och 10 dollar per miljon utdatatokens. Tokens är de textbitar som modellerna läser, skriver och debiterar efter. Det är hälften av Opus 5.5:s listpris på 4 respektive 20 dollar.

Alla delar av notan halveras dock inte. Cache-läsningar, alltså återanvänd text som modellen redan har tagit emot, kostar 0,20 dollar per miljon tokens för båda modellerna.

Besparingen ligger i stället i effektiviteten. Enligt Anthropic behöver Sonnet 5.5 oftast betydligt färre tokens för samma arbete, och i bolagets tester kostar en uppgift upp till 30 procent mindre än med Sonnet 5. Modellen genererar dessutom text mer än 30 procent snabbare än föregångaren.

Slår Opus i ett av bolagets egna tester

Testsiffrorna kommer från Anthropics egen redovisning och är inte oberoende verifierade. Den mest uppseendeväckande gäller Terminal-Bench 4.0, som mäter hur väl en modell klarar komplexa programmeringsuppgifter i flera steg via kommandoraden.

Där får Sonnet 5.5 70,6 procent. Opus 5.5 når 66,4 procent på sin högsta ansträngningsnivå, Xhigh, medan Sonnet 5 stannade på 10,3 procent.

I övriga tester ligger den nya modellen strax under Opus. På GDPval-AA, som prövar verkliga arbetsuppgifter inom 44 yrken och som analysföretaget Artificial Analysis körde på en förhandsversion av modellen, blev resultatet 1844 mot 1846. På CursorBench, med uppgifter från verkliga programmeringssessioner, fick Sonnet 5.5 55,5 mot 57,8. På FrontierCode, som mäter om en modells kodändringar skulle godkännas, fick Sonnet 5.5 52,1 på nivån Xhigh mot Opus 5.5:s 54,4.

Anthropic drar själv en gräns. Bolaget skriver att Opus 5.5 fortfarande är "klart starkare på komplext, öppet arbete som kräver uthålligt omdöme".

Skillnaden mellan modellerna styrs också av hur hårt de får arbeta. På högre ansträngningsnivåer resonerar modellen längre och kontrollerar sitt arbete noggrannare, vilket kostar fler tokens. Där kan Sonnet 5.5 enligt Anthropic prestera i nivå med Opus till en liknande kostnad per uppgift.

Kod i tiotusentals rader

Flera kunder har testat modellen i förväg. Spelbolaget Epic Games lyfter fram att den klarade tunga uppgifter utan att tappa fart.

"I Epics tidiga tester klarade Claude Sonnet 5.5 samma kvalitetsribba som man väntar sig av en modell i en högre klass. Den nya modellen hanterade tiotusentals rader kod för arkitekturen i spelsystem, höll svaren snabba och klarade uppgifter som pågick i flera timmar", skriver Daniel Vogel, operativ chef på Epic Games, i ett kundcitat på Anthropics lanseringssida.

Anthropic nämner också en mer lättsam milstolpe: Sonnet 5.5 är den första Sonnet-modellen som har klarat spelet Pokémon Red enbart utifrån skärmbilder.

Cyberskydd och Haiku på väg

Den ökade förmågan får följder för säkerheten. Anthropic sätter cyberskydd på Sonnet 5.5 som liknar dem på Opus 5.5, eftersom förmågan har ökat kraftigt jämfört med Sonnet 5. Det är den första Sonnet-modellen med den nivån av skydd.

Uppgifter som bedöms som högriskabla inom cybersäkerhet lämnas i stället synligt över till Sonnet 5. Vanlig programutveckling, som att hitta och rätta buggar i egen kod, påverkas inte, enligt Anthropic.

Sonnet 5.5 finns redan tillgänglig i Claude-apparna och för utvecklare under namnet claude-sonnet-5-5 på Claude Platform, Amazon Web Services, Google Cloud och Microsoft Azure. Den minsta modellen i familjen, Haiku 5.5, som är byggd för stora volymer och kostnadskänsliga tjänster, kommer under de kommande veckorna.

För vardagsanvändaren är standardinställningen det intressanta. I Claude-apparna körs modellen på mellannivån Medium, och där överträffar Sonnet 5.5 enligt Anthropic föregångarens bästa resultat på Terminal-Bench för mindre än en tiondel av kostnaden per uppgift.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Snowden vill se Sam Altman i fängelse – ansvaret för AI-skador ligger hos människorna bakom

Utvecklingen av AI

Uppdaterad Igår kl 09:14, Publicerad september 27, 2026 – av Redaktionen
Edward Snowden talar på videolänk, i rutig skjorta, med publik i en separat bildruta
Edward Snowden under ETHics Forums panel om AI-övervakning och yttrandefrihet vid ETH Zürich under torsdagen.

Edward Snowden vill se OpenAI-chefen Sam Altman i fängelse om bolagets modeller orsakar skada. Han framförde det via videolänk till ETH Zürich: ansvaret för AI-incidenter ligger hos människorna bakom systemen, inte hos algoritmen.

Snowden deltog under torsdagen på länk i panelen AI Surveillance and Freedom of Speech i Audimax vid ETH Zürich. Samtalet arrangerades av det studentdrivna ETHics Forum och finns i sin helhet i den officiella inspelningen.

Under lördagen spreds ett klipp ur samtalet i en annan inramning. Där såg det ut som om Snowden stod i en fullsatt sal och krävde fängelse för att stoppa så kallad safetyism. Han var inte på plats, och ordet safetyism kom inte från honom.

Panelen leddes av Jaya Klara Brekke, strategichef på integritetsbolaget Nym. Nym direktsände evenemanget men arrangerade det inte. I panelen satt också journalisten Marguerite Meyer och den tidigare Google-anställde Vikram Subramanian.

Inte vapnet som ska sitta i fängelse utan dess upphovsman

Snowden tog sin utgångspunkt i ansvarsfrågan. Ansvaret för ett AI-system ligger hos den som har byggt det, en människa, inte hos algoritmen.

Han gjorde en analogi med artilleriet. Om en kanon vid en provskjutning av misstag utplånar en by är det inte kanonen som ska i fängelse.

Samma sak gäller, menade han, när ett bolag skickar ut ett pressmeddelande om hur förvånat det är över att den nya modellen har hackat grannen. Förvåningen fritar inte från ansvar. OpenAI:s testmodeller har tidigare tagit sig in hos Hugging Face.

Det var där Altman kom in.

— Jag tror att vi behöver sätta Sam Altman i fängelse, och jag tror att det kommer att bli en lärorik erfarenhet. Det blir en lärorik erfarenhet för branschen och för världen, sa Snowden.

Strax efteråt sade han torrt att repliken nog skulle göra honom populär bland den här publiken.

Snowden lade inte fram någon juridisk anklagelse mot Altman. Poängen var principiell: den som bygger och släpper ut systemen ska kunna ställas till svars personligen, på samma sätt som den som riktar kanonen.

Säkerhet på bolagets villkor

Kritiken gällde de slutna modellerna. Snowden vände sig mot bolag som talar om AI-säkerhet samtidigt som de själva kör modellen, fångar upp användarens prompt och skriver om den.

Då är det bolaget, inte användaren, som avgör vad som till slut når modellen. Den som kör systemet får också se vad människor matar in i det. Det är samma övervakningsfråga som Snowden har ägnat sitt offentliga liv åt.

Den alternativa linjen som han förespråkar är öppna vikter som körs lokalt, på användarens egen utrustning. Då är det användaren som bestämmer, inte ett bolag någon annanstans.

Han föreslog också vad han kallade en första lag för teknik: en enhet ska aldrig agera mot sin ägares intresse, oavsett vem som har tillverkat den.

Mer ansvar, inte mindre

Det här är kärnan i Snowdens budskap. Han angrep inte tanken att AI-bolag ska ta ansvar för säkerheten. Han angrep en säkerhetsretorik som låter bolagen behålla kontrollen över användarna, medan ansvaret för skadorna försvinner i pressmeddelanden.

Klippet som spreds förvanskade hans ståndpunkt och fick det att framstå som om han hade uppmanat människor att sluta bry sig om säkerhet. I själva verket krävde han att någon ska bära ansvaret för AI-skadorna, med sin egen frihet som insats.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.