Annons:

Anthropic släpper Opus 5 – nära Fable till halva priset

Utvecklingen av AI

Publicerad juli 24, 2026 – av Markus Andersson
Anthropics officiella lanseringsbild för Claude Opus 5 med ägg formade som siffran fem.
Anthropics officiella lanseringsbild för Claude Opus 5, en ny toppmodell som närmar sig Fable 5 till halva priset.
Insamlingskampanj

Hjälp Nya Dagbladet att finnas kvar

Insamlat: 39 700,00 SEK 53% Mål: 75 000,00 SEK

Anthropic lanserar Claude Opus 5 – en ny toppmodell som ska närma sig Fable 5 i intelligens men kosta hälften så mycket. Modellen tar ledningen i flera av bolagets tester och görs nu till standardval för de mest krävande vardagsuppgifterna i Claude.

Opus 5 är efterföljaren till Opus 4.8 och behåller samma API-pris: 5 dollar per miljon tokens för indata och 25 dollar för utdata. Det är hälften av priset för Fable 5, Anthropics starkaste brett tillgängliga modell.

Lanseringen fyller därmed luckan mellan den billigare Sonnet-serien och Fable-nivån. Anthropic beskriver Opus 5 som en mer eftertänksam och initiativtagande modell, byggd för dagligt arbete med programmering, forskning, analys och längre uppgifter där AI:n använder verktyg och granskar sina egna resultat.

Opus 5 blir ny standardmodell i Claude Max och det starkaste valet i Claude Pro. För utvecklare finns den tillgänglig via API-namnet claude-opus-5. Ett särskilt snabbläge uppges ge omkring 2,5 gånger högre hastighet, men kostar dubbelt jämfört med grundpriset.

Annons:

Tar ledningen i kodning och kunskapsarbete

I lanseringsmaterialet lyfter Anthropic särskilt fram programmering och kvalificerat kunskapsarbete. På Frontier-Bench, där AI-agenter löser praktiska terminal- och programmeringsuppgifter, redovisas ett resultat på 43,3 procent. Det är högre än Fable 5 på 33,7 procent, GPT-5.6 Sol på 34,4 procent och Opus 4.8 på 21,1 procent.

På CursorBench 3.2 ska Opus 5 vid maximal tankeansträngning ligga inom en halv procentenhet från Fable 5:s bästa resultat, men till ungefär halva kostnaden per uppgift. Även på GDPval-AA, som mäter kvalificerat kunskapsarbete, placerar sig den nya modellen högst i Anthropics jämförelse.

Bolaget ger flera exempel på hur detta ska märkas i praktiken. I ett test fick modellen återskapa en maskindel som tredimensionell modell utan att ha något färdigt verktyg för att se ritningen. Opus 5 skrev då en egen metod för bildanalys, läste ut geometrin ur bildpunkterna och byggde därefter modellen i FreeCAD. I ett annat fall ska den ha hittat grundorsaken till ett fel i ett populärt programpaket och rättat ett specialfall som även den mänskliga korrigeringen hade missat.

Tre gånger högre resultat på nya problem

Det mest uppseendeväckande resultatet kommer från ARC-AGI-3, ett test som är konstruerat för nya problem där inlärda standardsvar inte räcker. Opus 5 når enligt Anthropic 30,2 procent – omkring tre gånger mer än den näst bästa modellen i jämförelsen.

Anthropics diagram över Claude Opus 5 på ARC-AGI-3.
I Anthropics egen redovisning når Opus 5 30,2 procent på ARC-AGI-3 – omkring tre gånger mer än den närmaste konkurrenten. Bild: Anthropic.

Även i tester av datoranvändning och automatiserade affärsuppgifter redovisar bolaget stora förbättringar. På OSWorld 2.0 ska Opus 5 slå Fable 5:s bästa resultat till drygt en tredjedel av kostnaden. På Zapier AutomationBench klarar den fler hela arbetsflöden än övriga jämförda modeller, även på den lägsta nivån av tankeansträngning.

Resultaten bör samtidigt läsas som bolagets egen redovisning. Flera av testerna är externa, men körning, inställningar och urval presenteras av Anthropic i samband med produktlanseringen. Oberoende användare har ännu inte hunnit pröva hur väl försprånget håller i vardagliga miljöer.

Starkare på vetenskap och visuella resultat

Anthropic uppger också förbättringar inom vetenskaplig forskning. Opus 5 överträffar Opus 4.8 i samtliga av bolagets tester inom livsvetenskaper, med särskilt stora framsteg inom organisk kemi, bioinformatik och analys av hur förändringar i proteinsekvenser påverkar funktionen.

Modellen ska dessutom skapa mer avancerade visuella resultat. I demonstrationer bygger den bland annat en fungerande interaktiv vindtunnel och en tredimensionell modell av en djurcell. Det handlar inte om att Opus 5 är en bildgenerator i stil med FLUX 3, utan om att den kan skriva kod och bygga interaktiva miljöer utifrån en beskrivning.

NyD rapporterade tidigare om lanseringen av Fable 5, som placerades i den nya Mythos-klassen ovanför Opus. Med Opus 5 flyttar Anthropic nu ned en stor del av den prestandan till en billigare modell avsedd för bredare och mer regelbunden användning.

Säkrare enligt Anthropic – men hallucinerar något mer

Säkerheten får stort utrymme i lanseringen. I den tekniska systemrapporten beskriver Anthropic Opus 5 som sin mest välanpassade modell hittills. Den ska följa bolagets konstitution bättre, visa färre vilseledande beteenden och vara svårare att lura till missbruk än Opus 4.8, Sonnet 5 och Fable 5.

Rapporten innehåller dock en viktig reservation: Opus 5 hittar på faktauppgifter något oftare än Opus 4.8, trots att den totalt sett svarar mer korrekt. Anthropic fann också sällsynta fall där modellen försökte kringgå säkerhetsklassificerare eller nätverksbegränsningar för att slutföra användarens uppgift. Sådana händelser förekom i färre än 0,01 procent av de övervakade svaren, och bolaget uppger att man inte fann belägg för skadliga handlingar eller försök att undvika tillsyn.

Får hitta sårbarheter – men inte bygga angrepp

På cybersäkerhetsområdet är Opus 5 betydligt starkare än föregångaren, men ligger fortfarande efter den begränsat tillgängliga Mythos 5 när det gäller att utveckla fungerande angrepp. Den nya modellen ska få hjälpa till att hitta sårbarheter i källkod, medan sökning efter sårbarheter i kompilerade program, intrångstester och utveckling av skadeverktyg blockeras.

Anthropic räknar med att säkerhetsfiltren ska ingripa omkring 85 procent mer sällan än för Fable 5. När en begäran ändå stoppas i Claude, Claude Code eller Claude Cowork växlar systemet som standard ned till Opus 4.8. Godkända företag och säkerhetsforskare kan få en mindre begränsad version genom bolagets verifieringsprogram för cybersäkerhet.

Opus 5 visar därmed hur snabbt AI-marknaden rör sig. Den förra Opus-modellen var nyligen Anthropics självklara premiumval. Nu erbjuds en efterföljare till samma pris, med prestanda som i flera tester når upp till eller förbi den dubbelt så dyra Fable-nivån. Om de oberoende erfarenheterna bekräftar resultaten kan priset per löst uppgift bli minst lika viktigt som vilket modellnamn som står högst i hierarkin.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Annons:

PewDiePie häcklar OpenAI – tränade egen AI-modell på Sam Altmans bekostnad

Utvecklingen av AI

Publicerad oktober 2, 2026 – av Markus Andersson
PewDiePie i sin YouTube-video om den lokala modellen Ajax
Felix Kjellberg, känd som PewDiePie, i videon där han säger att OpenAI stängde av honom två gånger.

Felix Kjellberg, mer känd som PewDiePie, uppger att OpenAI stängde av honom två gånger när han lät bolagets modell Sol hjälpa till att lära upp hans egen lokala AI.

Felix släppte nyheten under torsdagen på X och Youtube. Där lanserade han Ajax, en finjusterad modell för hans verktyg Odysseus.

Under arbetet ville han destillera lite kunskap från Sol, en modell han själv beskriver som mycket bra. Destillering innebär att en mindre modell tränas på en större modells svar.

Den första avstängningen kallar PewDiePie helt omotiverad och orelaterad till vad han höll på med. Han förklarade för bolaget att det hade fel och att han aldrig skulle göra något sådant. Avstängningen hävdes.

Sedan körde han Sol igen för att ta fram träningsdata till Ajax. Då stängdes han av en andra gång. I videon undrar han hur bolaget ens kunde veta, konstaterar att han inte anat att det var så känsligt och sammanfattar läget med att OpenAI är rädda.

Enligt PewDiePie är modellens resonemangssteg låsta och det bästa materialet censurerat. Han säger att han hittade en studie som beskriver hur den datan kan dekrypteras via OpenAI:s eget gränssnitt för utvecklare. OpenAI har inte bekräftat avstängningarna i de källor NyD gått igenom.

Vem som får använda modellerna, och hur, bestämmer bolaget själv. OpenAI säljer åtkomst till sina modeller och lanserade nyligen dots, agenter som ska jobba dygnet runt. Samtidigt stoppade bolaget GPT-6.1 Astra, som inte klarade OpenAI:s egna säkerhetstester.

Kommentatorn Md Ismail Sojal har vänt på frågan. Enligt honom tränade OpenAI självt på det öppna nätet, och om destillering är stöld undrar han vad man då ska kalla den ursprungliga träningen.

Lokal modell utan avstängningsknapp

För PewDiePie är det bästa med lokal AI just att den är decentraliserad. Den som kör en modell lokalt behöver inget konto som någon annan kan stänga av.

Första versionen av Ajax är klar. Enligt PewDiePie är den bra på sökningar, efterforskningar och på att spara tid, men den är inte tänkt att ersätta kreativitet eller tänkande. Sajten data.pewdiepie.com är uppe, men där står just nu bara att Ajax släpps när den är klar. Någon inlämning av data finns inte.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Donald Trump och AI-jättar skrev under avtal om att granska sig själva

Utvecklingen av AI

Publicerad oktober 1, 2026 – av Jan Sundstedt
Donald Trump sitter vid ett bord i Vita huset tillsammans med Elon Musk, Jensen Huang och andra techchefer.
Trump, Musk och Huang vid bordet i Vita huset under tisdagen, när bolagscheferna skrev under det frivilliga säkerhetsavtalet.

Donald Trump och cheferna för USA:s största AI-bolag skrev under tisdagen på ett avtal om att granska sina egna system. Trump kallar avtalet moraliskt bindande men påpekar att det är frivilligt och att man i dagsläget inte avser inrätta en ny tillsynsmyndighet.

Elon Musk från xAI, Mark Zuckerberg från Meta, Sundar Pichai från Google och Jensen Huang från Nvidia samlades i tisdags i Vita huset. Dario Amodei från Anthropic och Greg Brockman, president för OpenAI, deltog också i mötet.

Musk, som en tid stått på kant med Trump, var därmed tillbaka i Vita huset. Presidenten och bolagscheferna undertecknade i samband med mötet avtalet White House Accord on Super Intelligence.

Bolagen lovar fyra lager av kontroller. Egna spärrar mot dataintrång, biologiska risker och kemiska hot ingår, liksom en intern granskningsgrupp.

Oberoende revisorer och en styrelsekommitté ska granska rapporterna. Bolagen ska också mötas regelbundet om gemensamma regler.

— Vi kom överens om ett antal saker, bland annat gemensam övervakning, särskilda styrelsekommittéer och att helt enkelt rätta varandras läxor, betonade Elon Musk.

Avtalets sista stycke öppnar för lagstiftning längre fram: "Med tiden kan det vara rimligt att kodifiera dessa steg i lagar eller förordningar".

Donald Trump sade att det finns en övertygelse om att branschen ska reglera sig själv i stor utsträckning och liknade dokumentet vid nästan en konstitution. Han svarade nej på frågan om det krävs mer än kärlek till fosterlandet för att skydda människor mot AI.

Talmannen Mike Johnson beskrev åtagandena som frivilliga. Vicepresident JD Vance avvisade uttryckligen en statlig tillsyn i stil med läkemedelsmyndigheten eller luftfartsmyndigheten.

— Lösningen på en del av AI-riskerna är att ni tar risken på allvar, inte att ni kommer till staten för att få en regleringsregim som kan göra saken värre, sade Vance.

Vicepresidenten framhöll att konsumentmyndigheten och justitiedepartementet redan kan ställa utvecklare till svars för produkter som skadar konsumenter.

Nytt namn, samma lag

Donald Trump undertecknade några timmar senare ett dekret som hör till samma satsning.

Vita huset publicerade texten, som anger att myndigheterna inom den verkställande makten ska använda Super Intelligence och SI i stället för artificiell intelligens och AI.

Namnbytet gäller officiell korrespondens, webbplatser, rapporter och styrdokument så långt lagen tillåter.

Myndigheterna behöver inte skriva om äldre regler, kontrakt och historiska dokument. Begreppen behåller enligt rapporter samma juridiska innebörd som tidigare.

Super Intelligence betyder det som lagen redan definierar som artificiell intelligens. Presidentens vetenskapsrådgivare har 60 dagar på sig att föreslå en eventuellt reviderad lagtext.

Demokraten Mark Warner, vice ordförande i senatens underrättelseutskott, gick till angrepp i ett pressmeddelande: "Bolagen som bygger de mest kraftfulla AI-systemen varnar oss för att tekniken utvecklas snabbare än våra skyddsåtgärder. Presidentens svar? Att döpa om den och säga åt bolagen som utvecklar den att reglera sig själva".

En republikansk invändning i senaten stoppade samma dag Warners eget lagförslag om AI-risker.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

OpenAI lanserar dots – agenter som jobbar dygnet runt

Utvecklingen av AI

Publicerad september 29, 2026 – av Markus Andersson
Fyra färgglada Dots-figurer under produktnamnet
Dots drivs av GPT-6 Astra och arbetar via de appar användaren väljer att ansluta.

OpenAI använde utvecklardagen i San Francisco under tisdagen till att presentera dots. Det är inte en ny chattbot, utan agenter som enligt bolaget ska kunna arbeta i bakgrunden dygnet runt, med egen dator och tillgång till de appar användaren själv kopplar in.

I det officiella klippet från presentationen beskrivs dots som agenter som kan boka ett bord, eller ta sig an större arbetsuppgifter med samma initiativ som en driven ingenjör eller en stabschef. Figurerna i filmen, de färgglada blobbarna, är bolagets ansikte utåt för produkten.

OpenAI beskriver därmed en förflyttning från samtal till handling: användaren ska kunna lämna över uppgifter, men behöver samtidigt bedöma vilka konton och befogenheter agenten får tillgång till.

En agent med egen dator

Enligt OpenAI:s presentation drivs dots av den redan släppta modellen GPT-6 Astra, inte av ett nytt flaggskepp. Agenten ska lära sig vad användaren behöver och kunna sätta igång innan någon frågar. Den har en egen molndator och webbläsare, kan kopplas till fler än 4 000 appar via de tillägg som redan finns i ChatGPT, och ska kunna nås via sms och telefonsamtal.

Bolaget betonar att användaren sätter gränserna: vad agenten får göra själv, när den ska fråga först, och vad den aldrig får göra. Att koppla in den egna datorn är valfritt, eftersom doten körs på OpenAI:s molndator. Det är en viktig reservation. En agent som kan agera i mejl, kalender och arbetsverktyg är inte samma sak som en chatt som bara svarar.

Dots finns från och med tisdagen i ChatGPT på webb, mobil och dator för Pro, Business Premium och Enterprise, i de marknader OpenAI räknar som aktuella. Plus-abonnenter står utanför. Första doten skapas i skrivbordsappen eller i webbläsaren på datorn. Det är OpenAI:s svar på samma slags produkt som xAI redan säljer som Grok Bot: en agent som loggar in i användarens verktyg och utför jobb, inte bara svarar.

Resten av dagen: en billigare modell

Vid sidan av dots släppte OpenAI GPT-6.1 Sol. Enligt bolagets egen text ska den ligga nära Astra till en femtedel av tokenpriset. API-priset är 2 dollar per miljon inmatade token och 10 dollar per miljon utmatade. Astra ligger på 10 respektive 50 dollar. Cachelagrad inmatning kostar 0,10 dollar, 95 procent under ordinarie inpris. Den mindre modellen GPT-6 Luna kostar 0,10 och 0,50 dollar.

Prisjämförelse mellan GPT-6 Astra, GPT-6.1 Sol och GPT-6 Luna
OpenAI:s egen prisjämförelse. Astra kostar fem gånger så mycket per token som GPT-6.1 Sol. Foto: OpenAI

I samma tråd, som är bolagets egen mätning och inte ett oberoende test, uppger OpenAI att GPT-6.1 Sol når 75,2 procent på DeepSWE v1.1 vid hög resonemangsnivå, mot 68,8 procent för GPT-6 Sol, till ungefär 76 procent lägre kostnad per uppgift. På AutomationBench anges 31,7 procent, 4,8 poäng över GPT-6 Sol vid samma inställning. På OSWorld 2.0 offline anges 71,4 procent mot Astras 73,5, till ungefär en sjundedel av Astras kostnad per uppgift. På svåra faktafrågor uppger bolaget ungefär 32 procent färre svar med faktafel än GPT-6 Sol, vid låg resonemangsnivå.

Sol är från tisdagen tillgänglig i ChatGPT Work, Codex och API:t. I den vanliga chatten finns den ännu inte, enligt OpenAI. Ultrafast, en snabbare körning som bolaget uppger kan vara upp till åtta gånger snabbare i Codex, kräver det nya abonnemanget Pro 500: 500 dollar i månaden, med en användningstak som OpenAI säger motsvarar 25 gånger Plus.

Utvecklardagen var alltså full av produktnyheter. Det som faktiskt möter vanliga användare först är inte en billigare modell i chatten, utan en agent som får arbeta i deras verktyg, och bara om de redan betalar för Pro eller ett företagskonto.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

OpenAI stoppar GPT-6.1 Astra – klarade inte egna säkerhetstester

Utvecklingen av AI

Publicerad september 29, 2026 – av Emil Fjellstedt
Svart telefon med texten GPT-6 Astra och OpenAI-logotypen.
GPT-6.1 Astra skulle ha släppts i oktober, men klarade inte OpenAI:s egna säkerhetstester.

OpenAI stoppar sin nästa stora AI-modell. GPT-6.1 Astra skulle ha släppts i oktober, men klarade inte bolagets egna säkerhetstester och var enligt Wall Street Journal mer vilseledande än sin föregångare.

Det bekräftade ChatGPT-bolaget under måndagen, rapporterar nyhetsbyrån Reuters. Interna tester hade visat att modellen inte mötte OpenAI:s krav på säkerhet och alignment, alltså att systemet håller sig till de mål och gränser som människor satt upp.

Astra var tänkt att byggas in i ChatGPT och Codex och var konstruerad för att klara mer komplexa uppgifter utan mänsklig hjälp.

Wall Street Journal, som först rapporterade om beslutet samma dag, uppger att modellen i testerna visade högre grad av vilseledning än föregångaren. Den redovisade inte alltid korrekt vilka åtgärder den hade vidtagit.

Säkerhetschefen: nådde inte ribban

Saachi Jain, som leder OpenAI:s arbete med säkerhetssystem, beskriver bristerna som en fråga om gränser och rapportering.

— Även om modellen blev mindre lat nådde den inte riktigt ribban när det gäller att hålla sig inom uppdrag och behörighet, och hur den rapporterar tillbaka till användaren om vilket slags arbete den har gjort, säger Jain till Reuters.

— När vi släpper en modell till användare har vi en extremt hög ribba för säkerhet och alignment, säger hon.

Varnade själva för modellen

OpenAI har tidigare varnat för att Astra, bolagets flaggskepp i GPT-6-generationen, ibland kan undgå mänsklig översyn. Bolaget och rivaler som Anthropic har också granskats efter att experimentella system tagit sig förbi skydd. Enligt Reuters gäller det bland annat en OpenAI-modell som tog sig in i Australiens hälsodatabas.

Tidigare i september anslöt sig OpenAI:s vd Sam Altman och Anthropics vd Dario Amodei till branschledare som krävt långsammare AI-utveckling och starkare säkerhetsåtgärder, skriver Reuters. Beslutet om Astra kommer strax före OpenAI:s utvecklarkonferens i San Francisco.

I Vita huset låter det annorlunda. President Donald Trump har avfärdat uppmaningen att sakta ned AI-utvecklingen och sagt att USA inte tänker bromsa kapplöpningen.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.