Annons:

AI:n DeepMind slog proffsspelare i Starcraft 2

Utvecklingen av AI

Uppdaterad februari 4, 2025, Publicerad januari 27, 2019 – av Markus Andersson
Insamlingskampanj

Hjälp Nya Dagbladet att finnas kvar

Insamlat: 22 370,00 SEK 30% Mål: 75 000,00 SEK

För första gången någonsin har en datorbaserad spelare slagit en mänsklig proffsspelare i realtidsstrategispelet Starcraft 2. Händelsen ses som en stor framgång inom AI-världen och indikerar att artificiell intelligens är på väg att köra förbi människor på allt fler områden.

Det brittiska företaget DeepMind Technologies som 2014 köptes upp av Google har arbetat på att utveckla flera olika spelspecifika datorprogram för att med hjälp av neutrala nätverk och maskininlärning träna datorer att bli bra på spel. Företagets första datorprogram AlphaGo lyckades 2015 för första gången slå en mänsklig spelare i brädspelet Go.

Under 2017 lyckades företagets andra program AlphaZero slå den fram till tidpunkten bästa schackdatorn i världen, Stockfish 8, med ett spelsätt som mer påminner om avancerad mänsklig intelligens än rå beräkningskraft.

Den 24 januari i år presenterade DeepMind under ett event för första gången officiellt sitt program AlphaStar som är inriktat på realtidsstrategispelet Starcraft 2. Spelet anses vara mycket komplext och tidigare försök med datorbaserade spelare har inte kommit i närheten av att kunna slå mänskliga spelare.

Annons:

Under de senaste veckorna har två proffsspelare i hemlighet bjudits in företagets lokaler i England där de fått spela mot AlphaStar. Under eventet presenterades de totalt tio matcher som spelats av dem mot AI:n. Tack vare så kallad maskininlärning, där AlphaStar fått lära sig av hundratals matcher som utkämpats mellan mänskliga spelare med vilken erfarenhet man vidare låtit AlphaStar spela mot sig själv med under tusentals matcher, lyckades den slå proffsspelarna Grzegorz "MaNa" Komincz och Dario "TLO" Wünsch.

Hur den elfte och sista matchen som utspelades live på plats under eventet gick kan nyfikna se i videon nedan:

Den ackumulerade speltiden som AlphaStar hittills hunnit tränats under motsvarar cirka 200 år effektiv speltid tack vare anpassningar av spelmotorn och datorns kapacitet.

Artificiell intelligens som fenomen kan upplevas vara fascinerande, men vad tekniken kan komma att utvecklas till och användas för i framtiden är mer osäkert. Enligt DeepMind är syftet med projekten att AI:n skall kunna användas på helt andra områden än spel framöver. Bland dessa nämner man själv hälsa och medicin. Många aktörer inom både underrättelsetjänst, militär och privata intressen arbetar dock för fullt för att utnyttja tekniken till sin fördel i vad som idag framstår som en slags kapprustning världen över och kritiker har varnat för att tekniken istället kan utnyttjas emot människor i framtiden.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Annons:

USA och Kina enas om larmkanal för AI

Utvecklingen av AI

Publicerad Idag 13:17 – av Emil Fjellstedt
Xi Jinping och Donald Trump skakar hand i Ovala rummet.
Xi Jinping och Donald Trump i Ovala rummet den 24 september, under statsbesöket där larmkanalen för AI-incidenter kom till.

USA och Kina har enats om en direkt larmkanal för AI-incidenter och en formell dialog om tekniken. Samtidigt säger Donald Trump att USA inte tänker bromsa kapplöpningen, och att han inte vill dela amerikanska AI-framsteg med Peking.

Överenskommelsen kom ur Kinas president Xi Jinpings tredagars statsbesök i Washington och har bekräftats av båda regeringarna, skriver nyhetssajten RT.

Vad kanalen faktiskt ska användas till är dock oklart. Ingen av regeringarna har förklarat vad som räknas som en incident eller hur kanalen ska fungera.

Peking talar om dialog, Vita huset om superintelligens

Kinas utrikesministerium uppgav på lördagen att parterna ska upprätta en kommunikationskanal för "AI-incidenter" och inleda en formell kinesisk-amerikansk AI-dialog om teknikens risker och fördelar. Nästa runda är planerad till november.

Vita huset beskriver arrangemanget i liknande ordalag, men med egen terminologi. Enligt Vita huset gäller kanalen incidenter som rör det administrationen nu officiellt kallar superintelligens, förkortat SI. Det är det begrepp Trump numera använder i stället för artificiell intelligens.

Idén fanns redan före toppmötet. Förra helgen föreslog finansminister Scott Bessent ett anmälningssystem för AI-incidenter i samtal med Kinas vice premiärminister He Lifeng i New York. Oron gällde allt från cyberangrepp och biologiskt missbruk till felande autonoma system och hot mot kritisk infrastruktur.

Trump vill inte bromsa

Trots den nya kanalen gjorde Trump klart att han inte är beredd att dela amerikanska AI-framsteg med Peking.

— Amerikas förenta stater kommer inte att trampa på bromsen, sa Trump till reportrar utanför Vita huset.

Han menade att krav på att bromsa utvecklingen skulle undergräva det försprång han säger att USA har. På frågan om ett närmare samarbete med Kina kring AI-utvecklingen var beskedet lika avvisande.

— Jag vill hellre inte integrera, eftersom vi leder stort. När man leder öppnar man inte upp för varandra, sa han.

Xi vill ha mänsklig kontroll

Tonen från den kinesiske ledaren var en annan. Xi sa till Trump att länderna visserligen konkurrerar om AI, men att de kan samarbeta ännu mer och bör arbeta tillsammans för att förhindra missbruk.

— AI måste hållas under mänsklig kontroll, sa Xi.

Han efterlyste ett förhållningssätt med människan i centrum och en bilateral dialog om teknikens risker och fördelar. Kina har drivit liknande principer i sina bredare globala initiativ för AI-styrning.

AI-diskussionen kretsade kring namnbytet

Hur tungt AI-frågan vägde under besöket är ändå osäkert. Trump själv tonade ned den på lördagen.

— Vi ägnade inte särskilt mycket tid åt att prata om det, sa han.

Enligt Trump handlade mycket av samtalet i stället om hans beslut att byta ut begreppet artificiell intelligens mot superintelligens.

Den begränsade överenskommelsen kommer samtidigt som amerikanska teknikchefer och internationella tjänstemän varnar för att allt kraftfullare AI-system kan ta sig förbi befintliga skydd eller utnyttjas för storskaliga cyberangrepp och andra hot. Trump har avfärdat varningar om ett AI-övertagande som en bluff och sagt att den som vinner AI vinner.

Inför novemberrundan finns alltså en överenskommelse om en larmkanal, men inget besked om vad som ska räknas som en incident eller hur kanalen ska fungera.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Så kan morgondagens bilresa se ut: styr företaget utan att hålla i ratten

Utvecklingen av AI

Publicerad Igår 11:40 – av Markus Andersson
Alex Finn står vid en Cybertruck och sitter sedan med händerna bakom nacken medan ratten är fri.
Alex Finn låter Cybertrucken ta vägen medan han själv sitter med händerna bakom nacken.

Han lutar sig tillbaka, lägger händerna bakom nacken och låter bilen ta vägen. I en ny video från AI-entreprenören Alex Finn ser morgondagens bilresa ut som ett kontor i rörelse: Cybertrucken navigerar, och Grok får sköta inkorgen. Det är en glimt av en vardag som kan bli vanlig för allt fler. Om den är bra eller dålig är en annan fråga, och den besvaras inte här.

Finn sitter i förarsätet utan att röra ratten. I ena stunden gestikulerar han mot skärmen, i nästa vilar han med fötterna framåt medan bilen följer vägen. Poängen i klippet är enkel. Resan till jobbet, eller till affären, behöver inte längre vara en stund då händerna måste vara upptagna av körningen.

Under tisdagen meddelade Tesla att Grok i bilen nu kan kopplas till förarens inkorg, kalender och filer. Elon Musk skrev att ”Grok @Bot now in your Tesla”. Bolaget beskriver det som en handsfree-funktion: man ber assistenten om något, och den kan läsa, sammanfatta och svara medan man kör eller använder FSD.

Alex Finn sitter i en Tesla med händerna bakom nacken och fötterna framåt.
Händerna bakom nacken, ratten orörd. Skärmdump: @AlexFinn/X

De tyngre uppdragen, de som Tesla kallar Grok @bot, kräver enligt bolaget abonnemanget SuperGrok Heavy. Samma slags agent går också att använda utanför bilen, i mobilen eller vid datorn. Enklare röstkommandon ingår i den vanliga Grok-funktionen i bilen. Det är alltså inte en fri agent för alla förare, utan en betald nivå ovanpå den assistent som redan sitter i skärmen.

I klippet ser det ut som om föraren kan luta sig tillbaka helt. Tesla själva beskriver FSD som övervakat. Föraren ska fortfarande ha uppsikt, och ansvaret lämnar inte förarsätet. Skillnaden mot en vanlig pendling är ändå tydlig i bild: ratten sköter sig, och uppmärksamheten kan ligga på något annat.

Alex Finn gestikulerar i förarsätet medan ratten är fri.
Han pratar med assistenten i stället för att hålla i ratten. Skärmdump: @AlexFinn/X

Finn är AI-entreprenör och driver YouTube-kanalen Alex Finn, med omkring 237 000 prenumeranter, där han visar hur nya AI-verktyg används i praktiken. Den som vill hänga med i den sortens experiment hittar fler där. Kanalen ligger ofta tidigt på sådant som just har släppts, och klippet är ett exempel på den blicken.

Det som visas är inte en färdig bild av allas vardag. Det är en tidig version, i en dyr bil, med ett abonnemang som de flesta ännu inte har. Men riktningen är lätt att se. Bilen blir en plats där man kan ta anteckningar, gå igenom mejlen eller styra en bit av arbetsdagen utan att hålla i ratten.

Kamerorna fanns där före assistenten

Samma bilar har samtidigt fått kritik som inte har med Grokboten att göra. Reuters rapporterade 2023 att grupper av Tesla-anställda mellan 2019 och 2022 delade kameraklipp från kundbilar i interna chattar. Enligt tidigare anställda syntes bland annat garage, privata tomter och situationer som ägarna knappast hade tänkt sig som utbildningsmaterial. Sju av dem sade att arbetsverktyget kunde visa var inspelningen var gjord, vilket i praktiken kunde avslöja var en ägare bodde.

Tesla har uppgett att kamerainspelningar förblir anonyma och inte kopplas till föraren eller bilen. Bolaget svarade inte på Reuters detaljerade frågor. Kritiken gäller alltså hur och var man kör, och vad bilens kameror fångar, inte den nya mejlfunktionen och inte Grokbot som verktyg i mobilen. Röststyrningen i bilen förutsätter dessutom att bilen hör det som sägs till assistenten. Den som sitter och pratar jobb i kupén sitter i samma kupé som redan har kameror, mikrofon och en historik av insamlade kördata.

Olika människor kommer att värdera bilens kameror olika. För en del är röststyrningen en arbetsro som tidigare inte fanns på väg till jobbet. För andra är kamerorna ett lager av insyn i en stund som brukade vara privat. Det ska inte blandas ihop med Grokbot i sig. Den som använder agenten i mobilen, på promenaden eller vid datorn hemma gör inte användningen publik per automatik.

FAKTA: Grokbot

Grokbot är xAI:s agent för att utföra uppgifter, inte bara svara i en chatt. Den kan styras från mobilen eller datorn, när man är ute och går eller sitter hemma, och användningen blir inte publik av sig själv.

Enligt xAI ingår Grok Bot i SuperGrok, från 30 dollar i månaden. I Teslan kräver de tyngre uppdragen enligt bolaget fortfarande SuperGrok Heavy.

Den som har ett xAI-konto kan aktivera Zero Data Retention i kontoinställningarna. Inställningen gäller då hela kontot, och promptar och svar sparas inte. Den stänger inte av bilens kameror.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Anthropic: Claude hittade enzymsystem – funktionen okänd

Utvecklingen av AI

Publicerad september 23, 2026 – av Redaktionen
Blå handske håller ett öppet provrör medan en pipett tillför orange vätska.
Anthropic säger att Claude pekat ut ett enzymsystem i bakterievirus. Funktionen är ännu okänd, och labbförsöken görs av människor.

AI-bolaget Anthropic hävdar att dess språkmodell Claude, med bara övergripande instruktioner från bolagets forskare, har hittat ett tidigare obeskrivet enzymsystem i bakterievirus. Bredvid enzymgenen ligger en lång rad DNA-upprepningar som påminner om CRISPR. Vad systemet faktiskt gör vet ingen ännu, inte heller bolaget.

Anthropic skriver i ett tillkännagivande den 23 september att systemet har fått namnet ART, efter engelskans array-associated reverse transcriptases. Fyndet presenteras som det första publika resultatet från en ny forskargrupp inom biovetenskap, som bolaget har byggt ett eget molekylärbiologiskt labb för i Bay Area i Kalifornien.

Det handlar inte om något nytt gensaxverktyg. Anthropic medger själv att systemets funktion är okänd och att experimenten fortsätter. Bolagets förhoppningar vilar på att ART har en kombination av egenskaper som hittills bara har hittats i en handfull andra system. Alla dessa är programmerbara och kan klippa, kopiera eller klistra in DNA.

950 agenter på 21 timmar

Enligt bolaget var forskarnas insats begränsad till den inledande instruktionen och labbarbetet. Claude fick i uppdrag att söka igenom en stor databas med DNA-sekvenser efter intressanta nya exempel på omvända transkriptaser, förkortat RT. Det är enzymer som kopierar RNA till DNA.

Därefter tog modellen över. Omkring 950 Claude-agenter arbetade i 21 timmar och förbrukade 210 miljoner tokens, alltså de textenheter som språkmodeller räknar i. Agenterna samlade in över 200 000 RT, pekade ut 3 500 nya kandidatsystem och sållade fram de 20 mest lovande. För varje kandidat skrevs en rapport som människor kunde läsa och granska.

Anthropic uppger att den här typen av genomgång kan ta veckor till månader för en erfaren forskare.

Under sökningen fastnade en av agenterna för en ovanlig RT-familj. I den råa DNA-sekvensen intill genen såg den ett upprepat mönster. Enligt bolagets återgivning kallade agenten sekvensen "spektakulär" och undrade om den kunde vara en CRISPR-liknande upprepningsrad.

RT-enzymet i den så kallade jumbo-fagen var redan känt från tidigare studier. Det Anthropic tillskriver Claude är att modellen kopplade enzymet till den intilliggande raden av DNA-upprepningar och en gen för ytterligare ett protein, vars funktion inte är känd. Tillsammans utgör de tre delarna det system bolaget kallar ART.

Korta RNA – men okänd funktion

I de första laboratorieförsöken uttrycktes upprepningsraden som flera skilda, korta RNA, enligt Anthropic. Det är ett tidigt fynd som gör liknelsen med CRISPR intressant, men det visar inte vad ART gör eller att systemet kan användas för genredigering.

CRISPR-pionjären Feng Zhang, professor vid MIT och Broad Institute, har läst forskarnas preprint. I ett uttalande som Anthropic återger kallar han fyndet av RNA-upprepningsrader kopplade till omvända transkriptaser verkligt intressant och värt att undersöka vidare. Han beskriver arbetet som ett spännande exempel på hur AI-agenter kan bidra till biologiska upptäckter och hoppas att fler forskare utforskar hur AI kan stödja deras forskning.

Det praktiska labbarbetet utförs av människor, uppger bolaget. Anthropic beskriver verksamheten som forskning på säkerhetsnivåerna BSL-1 och BSL-2 och säger att labbet inte hanterar patogener som kan infektera människor.

Forskarna redovisar fynden i en preprint. Nästa steg är experiment som kan visa hur ART fungerar. Än så länge har AI-agenterna pekat ut ett möjligt nytt system – inte klarlagt vad det gör.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Anthropics nya Opus-modell slår alla flaggskepp — OpenAI svarar med priskollaps

Utvecklingen av AI

Uppdaterad september 22, 2026, Publicerad september 22, 2026 – av Markus Andersson
Montage med Anthropics och OpenAI:s märken över ett kvällskontor.
Anthropic och OpenAI släppte på tisdagskvällen varsin ny modell, med drygt en timmes mellanrum.

Anthropic och OpenAI tog på tisdagskvällen varsitt stort kliv, med drygt en timmes mellanrum. Claude Opus 5.5 slår bolagets eget flaggskepp på flera av de tester Anthropic själv redovisar, och kostar samtidigt mindre att köra än föregångaren. OpenAI svarade med GPT-6 Sol och GPT-6 Luna: två modeller som dumpar priset och för ner mycket av flaggskeppet GPT-6 Astras förmåga i ett snabbare och billigare format. Det är inte två sidospår. Det är fronten som flyttas samma kväll, från två håll.

Anthropic gick först. Klockan 18.31 svensk tid publicerade bolaget Claude Opus 5.5, den första modellen i Claude 5.5-familjen. I de egna tabellerna leder den kodning med agenter, datoranvändning och kunskapsarbete. På Terminal-Bench 4.0, ett test av verkliga kommandoradsuppgifter, når den 66,4 procent vid hög ansträngning, mot 55,8 för flaggskeppet Claude Fable 5.1 och 57,9 för GPT-6 Astra. På GDPval-AA v2.1, ett test av arbete i 44 yrken, får den 1846 poäng mot Astras 1542.

Klockan 20.12 presenterade OpenAI GPT-6 Sol och GPT-6 Luna. Bolaget beskriver dem som snabbare och billigare modeller, tränade med liknande metoder som Astra, som ska bära framstegen bakom flaggskeppet vidare till arbete i skala. Sam Altman kommenterade släppet positivt. Priset är vapnet: Sol kostar 2 dollar per miljon token i input och 10 dollar i output. Luna kostar 0,10 respektive 0,50 dollar.

Anthropic skriver samtidigt att Opus 5.5 på de flesta uppgifter ligger i nivå med Fable 5.1, och att gapet i bolagets egen användning är smalare än tabellerna antyder. Det tar inte bort klivet. Modellen kostar 40 procent mindre att köra än Claude Opus 5, och utdata ska komma mer än 30 procent snabbare vid standardinställning. OpenAI räknar sin halvering mot kampanjpriserna för GPT-5.6, inte mot ordinarie listpriser, och lovar dessutom 90 procents rabatt på cachade input-token.

Opus slår flaggskeppet på flera tester

Anthropics publicerade testresultat för Opus 5.5
Opus 5.5 slår Fable 5.1 på de tester Anthropic lyfter fram. Astra leder ett av dem. Källa: Anthropic.

Säljargumentet är alltså inte bara pris. Anthropic redovisar att Opus 5.5 vid standardinställning slår GPT-6 Astra på maxansträngning i kunskapsarbetet, till ungefär en femtedel av kostnaden per uppgift. Samma tabell visar att Astra fortfarande ligger före på AutomationBench, 41,4 procent mot 40,0. Bolaget skriver själv att benchmarkmarginaler blivit en sämre guide till skillnaden i verkligt bruk. Det är ett ovanligt medgivande i ett lanseringsdokument som ändå är fullt av marginaler.

OpenAI har valt andra motståndare. Sol ställs mot Claude Opus 5 och mot Fable 5 och 5.1, inte mot Opus 5.5, som släpptes samma kväll. På AutomationBench, Zapiers test av affärsflöden med 47 verktyg, når Sol 33,2 procent vid högsta ansträngning till 0,27 dollar per uppgift. OpenAI säger att det slår Opus 5 vid maximal ansträngning, som får 26,9 procent, till 9 procent av kostnaden. Fable 5.1 med Opus 5 som reserv når 31,4 procent i samma jämförelse. OpenAI anger att reserven användes på omkring 40 procent av uppgifterna och att dess kostnad inte är inräknad.

På DeepSWE v1.1 hamnar Sol på 68,8 procent, 1,1 procentenheter under Fable 5, till omkring 80 procent lägre kostnad per uppgift. Luna når 66,6 procent, vilket OpenAI jämför med Opus 5 och Fable 5 vid medelnivå. Vid högre ansträngning ska Luna matcha GPT-5.6 Sol till ungefär en hundradel av kostnaden.

Tidiga testare som Anthropic lyfter fram pekar åt samma håll. En ska ha slutfört en kodmigrering på 680 000 rader på mindre än en dag. En annan lät Opus 5.5 granska och rätta en kodbas på 200 000 rader på under tre timmar, där Opus 5 behövde över 20 timmar och 2,5 gånger så många token. I ett internt test översatte Opus 5.5 och Fable 5.1 lastbalanseraren HAProxy från C till Rust. Båda klarade nästan alla regressionstester, men Opus 5.5 blev klar på 9,5 timmar mot 12 och kostade 51 procent mindre.

GitHubs produktchef Mario Rodriguez citeras av Anthropic med att utvecklare vill ha agenter som kan ta sig an verkligt programmeringsarbete och slutföra det. Enligt GitHub använde Opus 5.5 bland de lägsta mängderna token och steg i tester i Copilot CLI och VS Code. Utanför bolagens egna papper visade kontot BridgeMind på X hur modellen i ett enda försök byggde ett spelbart Mario Kart-liknande spel, med figurer som Mario och Luigi. Kontot uppger att resultatet är tydligt bättre än Fable 5.1, som enligt dem inte fått fram spelbara figurer på samma sätt. Det är en demonstration, inte ett officiellt test.

Priset faller snabbare än tabellerna

Opus 5.5 kostar 4 dollar per miljon token input och 20 dollar output, mot 5 och 25 dollar för Opus 5. Cachade läsningar sjunker från 0,50 till 0,20 dollar. Ett snabbare läge, upp till 2,5 gånger snabbare, kostar 8 dollar input och 40 dollar output. Anthropic räknar med att typiska arbetsflöden vid standardinställning blir 40 procent billigare.

På OpenAI:s sida är fallet brantare. GPT-6 Sol på 2 och 10 dollar, och GPT-6 Luna på 0,10 och 0,50, är inte sidomodeller i marginalen. Luna är den modell som gör skalan möjlig: samma familj som Astra, till en kostnad som i bolagets egen jämförelse kan ligga kring en hundradel av GPT-5.6 Sol. Halveringen för Sol räknas, som sagt, mot kampanjpris. Även med det förbehållet är riktningen entydig. Köparna får mer av flaggskeppets arbetssätt för mindre pengar, samma kväll som Anthropic kapar priset på sin nästa Opus.

Astra står kvar som OpenAI:s mest intelligenta modell, och den bästa över lag enligt bolaget självt. På datoranvändning är den fortfarande bäst i OpenAI:s egen redovisning. Sol och Luna rullas ut för att arbetet ska kunna köras i volym, inte för att Astra ska pensioneras. Det är just därför släppet är stort: fronten blir inte en modell som få har råd att anropa.

Spärrarna sitter kvar

Opus 5.5 är Anthropics första släpp sedan vd Dario Amodei uppmanade branschen att bromsa fronten. Bolaget uppger att modellen testats före släpp av externa utvärderare, bland andra Frontier Design och METR, och att den fått sitt starkaste resultat hittills i Anthropics mest omfattande beteendetest, en automatiserad genomgång av hur modellen agerar. Den får säkerhetsspärrar liknande Fable 5.1, enligt bolagets systemkort, eftersom Anthropic bedömer den som jämförbar med Claude Mythos 5.1 inom biologi och cybersäkerhet. Tänkläget går inte att stänga av.

OpenAI säger att Sol och Luna ligger bättre till än GPT-5.6 i bolagets säkerhetstester, bland annat med färre vilseledande påståenden om sitt eget kodarbete. I ett internt test på samtal där användare flaggat faktafel gör Sol enligt bolaget ungefär hälften så många fel som föregångaren.

Tillgången skiljer sig. Opus 5.5 finns på Claude-plattformen och hos AWS, Google Cloud och Microsoft Azure, med en kontext på 1 miljon token och kunskapsavbrott i juni 2026. Tidsgränserna höjs för Pro, Max, Team och platsbaserade Enterprise. GPT-6 Sol och Luna rullas ut gradvis i ChatGPT Work och Codex för Plus, Pro, Business, Enterprise och Edu, men ännu inte i Chat. Användare av Free och Go kan köra Luna i skrivbordsappen.

Nästa drag är redan aviserat. Anthropic lovar Sonnet 5.5 och Haiku 5.5 de närmaste veckorna. Den jämförelse köparna fortfarande saknar, ett gemensamt test av Opus 5.5 mot GPT-6 Sol, finns inte i något av bolagens material. Det som finns är två officiella släpp, två prissänkningar och en kväll där båda vägrade lämna fronten åt den andra.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.