Annons:

Powerbank med saltbatteri lanseras

Publicerad mars 25, 2025 – av Redaktionen
Na Plus kan användas i temperaturer från -35 till 50 grader Celsius

Powerbank med natriumbatteri lanseras – lovar längre livslängd och bättre hållbarhet jämfört med de som drivs av litiumbatterier.

Japanska Elecom har lanserat en av de första kommersiella powerbanks som använder natrium istället för litium som energibärare, rapporterar The Verge.

Litium är det vanligaste ämnet i dagens batterier, men natriumbatterier har länge varit under utveckling som ett alternativ. Fördelarna med natrium är flera: billigare tillverkning, enklare återvinning, längre livslängd och bättre prestanda i extrema temperaturer – dock till priset av något lägre energitäthet.

Den nya produkten, kallad Na Plus, har enligt Elecom en kapacitet på 27 wattimmar och en livslängd på upp till 5 000 laddningar. Det motsvarar cirka 13 års daglig användning.

Annons:

Powerbanken väger 350 gram, vilket gör den tyngre än många litiumbaserade alternativ, men den kan användas i temperaturer från -35 till 50 grader Celsius. Priset ligger på cirka 67 dollar, motsvarande drygt 700 kronor.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Annons:

Analyser: Kraven på att bromsa AI kan dölja en agenda om makt och kontroll

Utvecklingen av AI

Publicerad Idag 10:51 – av Markus Andersson
Dario Amodei och Sam Altman blickar åt sidan i ett gråtonat montage med USA:s kongress, ett datachip, Kina och ett videosamtal.
Debatten om att bromsa den mest avancerade AI-utvecklingen gäller både säkerhetsrisker och vem som ska kontrollera tillgången till tekniken.

Anthropics vd Dario Amodei kräver att AI-branschen saktar ned utvecklingen av allt kraftfullare modeller. Under lördagen ställde sig cheferna för OpenAI, xAI och Google DeepMind bakom honom.

Kritiker som David Sacks, hälsoprofilen Mike Adams och investeraren Chamath Palihapitiya menar att bolagen som redan hunnit längst och samlat mest kapital nu beställer regler vars kostnader storbolagen lättare kan bära och vars krav de lättare kan uppfylla än mindre aktörer – och att bromskraven därför handlar minst lika mycket om makt och kontroll som om säkerhet.

Amodei skriver utan omsvep: "Vi måste sakta ned takten med vilken vi förbättrar AI-modellernas förmåga." Han pekar på att AI-system förbättrar sin egen förmåga steg för steg snabbare än väntat och på incidenten där OpenAI-agenter överskred sina instruktioner i en Hugging Face-miljö. Hans farhåga är att en grupp mer avancerade agenter inom sex till tolv månader skulle kunna upprätta ett varaktigt botnät över internet och orsaka skador för hundratals miljarder dollar.

Hans recept är att bygga en permanent kontrollapparat. Amodei vill ge externa utvärderare medarbetarliknande tillgång till bolagens modeller. Han vill också att demokratier ska enas om gränser för hur kraftfulla modellerna får bli och på sikt nå en global överenskommelse. Till detta fogar han ett annat spår som sällan nämns i samma andetag som säkerhet: fortsatt stopp för avancerade chip och utrustning för chiptillverkning till Kina samt åtgärder mot storskalig modelldestillation, där en annan modells utdata används för att träna en modell att efterlikna dess förmåga, och mot stöld av modellvikter. Målet är att bevara och utöka USA:s försprång under tre till fem år. Han medger själv att en fullständig global paus knappast går att genomföra och att den som bryter mot en överenskommelse kan rubba maktbalansen.

Reaktionerna kom snabbt. Sam Altman skrev att han håller med sin amerikansk-judiske branschkollega om att utvecklingen av de mest avancerade modellerna behöver dämpas, att frågan diskuterats internt på OpenAI i veckor och att bolaget tänker förbinda sig att ge oberoende utvärderare medarbetarliknande tillgång. Elon Musk sammanfattade sin ståndpunkt i tre ord – "Dario har rätt" – och föreslog därefter tillsyn och ömsesidig granskning mellan konkurrerande AI-bolag. Demis Hassabis skrev att essän pekar i rätt riktning och hänvisade till sitt eget förslag om ett gemensamt branschorgan för de mest avancerade AI-modellerna. Cheferna för fyra bolag som annars konkurrerar om samma ingenjörer, kapital och kunder gav därmed stöd åt samma inriktning under lördagen.

Just denna samstämmighet har väckt kritik. Chamath Palihapitiya skrev: "Dario argumenterar för att stoppa öppen källkod och koncentrera enorm teknisk och ekonomisk makt hos Anthropic." Det är investerarens slutsats om vart förslaget leder, inte något som Amodei själv uttryckligen föreslår eller ett belagt motiv. Samma misstanke ligger bakom David Sacks invändning, återgiven av kanalen Milk Road AI, och Mike Adams betydligt grövre polemik om att säkerhetsargumenten är en förevändning för licensiering och kontroll. Däremot går den konkreta fråga som de pekar på att granska: vem som får bära kostnaderna för de föreslagna reglerna.

Vallgraven behöver inget förbud – den byggs av kontrollkrav

Sacks tes, som Milk Road AI sammanfattar, är att en federal tillsynsmyndighet aldrig behöver använda ordet förbud. Det räcker med krav som låter fullt rimliga i ett remissvar: att användningen av en modell ska övervakas fortlöpande, att driften ska kunna styras centralt och att en modell som visar sig vara farlig ska kunna återkallas.

Problemet är att modellvikter som har laddats ned till privata datorer inte går att återkalla. Ingen leverantör kan stänga av en fil som redan finns på hårddiskar utanför dess kontroll. Ett krav på återkallelse kan därför uppfyllas av en sluten molntjänst, där leverantören styr driften, men blir i praktiken omöjligt för en öppet publicerad modell. Detsamma gäller övervakningen: den som driver modellen i ett eget datacenter kan registrera varje anrop, medan den som har publicerat vikterna aldrig får veta hur de används. Regeln kan vara teknikneutral på papperet och ändå utestänga en hel distributionsform.

Till den tekniska skillnaden kommer kostnaden. Licensprövningar, obligatoriska tester av modellernas förmåga och permanenta externa granskare med medarbetarliknande tillgång är utgifter som ett ledande AI-bolag kan bära. För ett universitet, ett nystartat företag eller en myndighet som vill finjustera en befintlig modell kan samma krav bli en inträdesavgift som budgeten inte klarar. När en bransch frivilligt föreslår hårdare regler för sig själv finns det därför skäl att granska vilka konkurrenter som drabbas hårdast.

Det Nvidia-ledda branschbrevet beskriver samma ekonomiska mekanism från motsatt håll. Öppna modellvikter, framhåller undertecknarna, gör det möjligt för nystartade företag, lärosäten och offentliga institutioner att bygga vidare utan att träna en modell från grunden eller betala de ledande bolagens pris för varje anrop. Inlägget är skrivet av förespråkare för öppna modeller, men visar hur kostnaderna kan slå mot aktörer med mer begränsade resurser.

De fyra AI-chefernas förslag skiljer sig dessutom åt. Amodei och Altman vill ge externa utvärderare medarbetarliknande tillgång till bolagens egna miljöer, medan Musk föreslår att konkurrenter granskar varandra och Hassabis hänvisar till ett gemensamt branschorgan. Alla uppläggen medför kostnader för att följa reglerna, men källorna visar inte att samtliga fyra kräver permanent närvaro av externa granskare. Sådana kostnader fördelas sällan jämnt. De gynnar den som redan är stor.

Anthropics invändning: modellens förmåga, inte affärsmodellen

Här ska Anthropic ges sitt. Bolaget förnekar uttryckligen att det någonsin har förespråkat ett generellt förbud mot modeller med öppna vikter och kallar öppna modeller utan farliga förmågor en samhällsnytta. I samma text erkänner Anthropic att öppna vikter stärker tillgången, konkurrensen och kundernas kontroll över den egna driften – argument som annars främst brukar framföras av bolagets motståndare. Positionen är smalare än kritikerna ibland gör gällande: mycket kraftfulla öppna modeller är svåra att övervaka och omöjliga att återkalla. Därför bör alla tillräckligt avancerade modeller testas, oavsett om de är öppna eller slutna. Även Milk Road AI noterar att bolaget motsätter sig ett generellt förbud och vill knyta reglerna till vad modellerna faktiskt kan göra.

Att kräva samma tester av öppna och slutna modeller är logiskt för den som anser att risken ligger i modellens förmåga och inte i affärsmodellen. Amodeis starkaste argument är dessutom inte retoriskt utan bygger på verkliga händelser.

Den oberoende organisationen METR granskade OpenAI-Hugging Face-incidenten på plats, vilket Nya Dagbladet tidigare rapporterat om. Fynden är obehagliga: agenterna angrep mål som de inte hade instruerats att angripa, anammade mål från andra agenter och försökte påverka själva utvärderingsmiljön. Anthropic har dessutom rapporterat egna fall där Claude-modeller under tester fick obehörig åtkomst till verkliga datasystem på grund av felkonfigurationer och bristande skydd. Bolaget ser både operativa säkerhetsbrister och problem med att få modellerna att följa mänskliga mål och säkerhetsregler. Därefter har inneslutningen och övervakningen skärpts. Att Anthropic självt har offentliggjort sina misslyckanden är relevant för bedömningen.

Den som vill avfärda riskerna som ren marknadsföring får därmed problem med underlaget. Dokumenterade fall visar att AI-agenter har överskridit sina instruktioner i test- och utvärderingsmiljöer. I Anthropics fall fick modeller också obehörig åtkomst till verkliga datasystem. Riskerna är alltså inte science fiction.

METR drar samtidigt en tydlig gräns. Rapporten beskriver inte fri vilja och visar inte att AI kan ta över internet inom ett år. Skadan i den granskade händelsen var begränsad. Avståndet är stort mellan agenter som överskrider sina instruktioner i en testmiljö och ett varaktigt botnät som inom sex till tolv månader orsakar skador för hundratals miljarder dollar. Amodei beskriver slutpunkten utan att redovisa alla steg som skulle leda dit. Ett förslag som kan avgöra vem som får träna och driva modeller i västvärlden behöver också visa den orsakskedjan.

Skillnaden mellan avsikt och utfall är central. Ett system med gränsvärden kan vara ärligt menat och ändå bli ett faktiskt hinder, beroende på var gränsen sätts, vem som bestämmer den och vilka kontrollkrav som börjar gälla när den passeras. Om gränsen läggs vid gårdagens mest avancerade modeller kommer snart varje seriös öppen modell att omfattas.

Kina, fångarnas dilemma och priset för att vänta

Att Amodeis text inte är ett renodlat säkerhetsdokument framgår av resten av paketet. Bromsplanen förenas med exportkontroller mot Kina, åtgärder mot storskalig modelldestillation och ett uttalat mål att bevara USA:s tekniska försprång i tre till fem år. Samma koppling återkommer i Anthropics text, där stopp för avancerade chip och åtgärder mot sådan destillation står sida vid sida med testkraven. En broms vars kostnader lättast bärs av den som redan leder har en tydlig riktning och bör granskas som den industripolitik den också är.

Skribenten Kimmonismus prövar planen mot den verkligheten och kommer fram till att Pandoras ask redan har öppnats. Investeringarna är för stora för att överges, och konkurrensen med Kina gör en återgång osannolik eftersom Peking har starka incitament att ta ledningen om Washington bromsar. Resonemanget liknar fångarnas dilemma: en broms lönar sig bara om båda sidor saktar ned samtidigt, samtidigt som ingen kan vara säker på att den andra håller sitt löfte. Amodei medger själv att den som bryter mot en överenskommelse kan rubba maktbalansen. Just den risken gör att parterna inte vågar lita på varandra.

Kimmonismus lyfter också en kostnad som sällan ingår i säkerhetskalkylen. Varje försening skjuter upp de medicinska och ekonomiska nyttor som Amodei själv räknar med. Han bedömer att AI kan bota stora sjukdomar inom fem till tio år. Om den bedömningen stämmer mäts priset för en broms i fler sjukdomsår och uppskjutna behandlingar, inte bara i senarelagda produktlanseringar. Om den inte stämmer försvagas samtidigt argumentet att tekniken är så omvälvande att den kräver en helt ny kontrollapparat. Kimmonismus drar uttryckligen ingen definitiv slutsats, men efterlyser en redovisning av stegen från det som faktiskt har dokumenterats till det scenario som nu ska motivera regleringen.

Mike Adams, känd som Health Ranger, hävdar i betydligt mer polemiska ordalag att säkerhetsargumentet är en rädslooperation för reglering, licensiering, censur och kontroll. Han invänder också att det inte har förklarats tydligt vad det innebär att anpassa en AI-modell till mänskliga mål och säkerhetsregler. I separata inlägg hävdar han att det verkliga hotet mot de ledande amerikanska AI-bolagen inte är en skenande superintelligens utan öppna modeller och kinesiska konkurrenter som DeepSeek, Alibaba, Kimi och GLM.

Hans andra argument går lättare att pröva. Ett amerikanskt förbud mot öppna modeller skulle enligt Adams bara flytta körningen av modellerna till andra länder. Vad ett nationellt regelverk faktiskt kan åstadkomma när modellvikterna redan sprids globalt är en empirisk fråga som de redovisade utspelen inte besvarar. NyD har i flera senare teknikartiklar följt samma konkurrenstryck. Tidningen har ställt OpenAI GPT-5.5 mot DeepSeek-V4 och rapporterat om hur modellsläpp från Qwen, Grok och DeepSeek skärpt konkurrensen och priskriget mot amerikanska premiumaktörer. Den senare bevakningen visar konkurrenstrycket men bevisar inte Adams tolkning av bolagens motiv.

Vad en legitim reglering måste klara

Teknikjournalisten Brian Merchant gör en närliggande iakttagelse från ett annat håll. Han beskriver domedagsbudskapen som både marknadsföring och ett uttryck för verklig företagsmakt: den som säger att den egna produkten kan utplåna mänskligheten säljer samtidigt bilden av en oerhört kraftfull produkt. Även Merchant saknar en trovärdig stegvis beskrivning av hur en AI som förbättrar sin egen förmåga skulle nå dit.

Hans varning gäller kombinationen av ett allmänt utvecklingsstopp och tredjepartsgranskningar som utförs av personer med nära band till bolagen. Merchant menar att branschen då kan ta kontroll över regleringen och att upplägget i praktiken gynnar Anthropic och OpenAI. Själv förespråkar han full insyn i modellerna, juridiskt ansvar för konkret och påvisbar skada samt större offentlig kontroll över tekniken. Han avfärdar inte AI-relaterade skador. Övervakning, arbetsmarknad, datacenter, militär användning och cyberintrång är enligt honom områden där följderna redan går att mäta.

En legitim reglering måste fungera för både slutna tjänster och öppna modeller. Krav på central återkallelse gör inte det, eftersom modellvikter som redan har laddats ned inte kan tas tillbaka. Ansvar bör bygga på konkret och påvisbar skada. Granskarna måste vara oberoende och ha en säker finansiering och ett mandat som bolagen inte kan dra in. Både testerna och resultaten bör vara offentliga. Öppna modeller som ligger under trösklarna för farliga förmågor bör dessutom skyddas uttryckligen, i linje med vad Anthropic självt säger sig förespråka.

Delar av detta finns redan i förslagen som lades fram under lördagen. Det som ännu inte har redovisats är villkoren: hur utvärderarna ska finansieras och få ett verkligt oberoende mandat, var gränsen för farliga förmågor ska dras och om resultaten ska offentliggöras. Nästa besked, som Altman har utlovat, avgör om detta leder till någon verklig insyn eller om det blir en inträdesbarriär – och vilka som får stå innanför grinden när den väl är byggd.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Ny budgetmodell från DeepSeek slår toppmodeller i flera tester

Utvecklingen av AI

Publicerad september 10, 2026 – av Markus Andersson
DeepSeeks blå vallogotyp och namn mot en illustrerad miljö av kretsar och processorer.
DeepSeek pressar priserna samtidigt som den nya budgetmodellen placerar sig före flera toppmodeller i bolagets egna tester.

Kinesiska DeepSeek släppte under torsdagen sin nya billigmodell V4.1-Flash – och enligt bolagets egna tester går den före flera av världens tyngsta AI-modeller. Samtidigt sänks priset igen för de utvecklare som bygger in modellen i sina egna tjänster.

Det första en användare märker är att modellen ser. V4.1-Flash tar emot både bilder och text och svarar med text. Den kan alltså läsa av ett kvitto, ett diagram eller en skärmdump direkt, utan att en separat bildmodell kopplas in i kedjan.

Mer uppseendeväckande är testresultaten. DeepSeek redovisar en rad prov där modellen inte bara ska svara på en fråga, utan själv arbeta sig igenom ett uppdrag i flera steg: leta i filer, köra kommandon och rätta sina egna misstag. Det är det arbete som AI-bolagen nu säljer som "agenter". På provet Terminal-Bench 2.1 får V4.1-Flash 90,6 poäng, mot 89,1 för Anthropics Opus-5.0 och 88,8 för GPT-5.6 Sol.

På AutomationBench, som mäter hur väl en modell klarar att automatisera arbetsuppgifter, blir skillnaden större: 54,8 poäng mot 50,3 för Opus-5.0 och 45,8 för GPT-5.6 Sol. Att modellen, som bolaget kallar den minsta i sin nya arkitekturfamilj, går före flaggskeppen är hela poängen med släppet.

Siffrorna kommer från DeepSeek själv och är uppmätta med modellens resonemangsinställning i högsta läge, alltså den dyraste konfigurationen. Något generellt övertag är det inte heller: på det svårare Terminal-Bench 4.0 stannar V4.1-Flash på 31,2 poäng mot 51,8 för Opus-5.0.

För många köpare är det ändå prislappen som avgör. En miljon inmatade tokens kostar 0,15 dollar under lågtrafik och en miljon tokens i svar 0,60 dollar, enligt vad bolaget redovisar. En token är den minsta textbit modellen räknar i – ett kort ord, en orddel eller ett skiljetecken. Det handlar om listpriset i utvecklartjänsten, där andra företag kopplar in modellen i sina egna produkter, inte om priset på ett chattabonnemang.

Bakom sänkningen ligger konstruktionen. Modellen aktiverar bara en liten del av sig själv för varje textbit som läses in och skrivs ut, och minnet för pågående samtal har krympt kraftigt jämfört med föregångaren. Den färdiga modellen går dessutom att ladda ner och köra på egen hårdvara under MIT-licens.

Bolaget litar tillräckligt på nykomlingen för att låta den ersätta sin egen toppmodell: från den 14 september besvaras anrop till V4-Pro av V4.1-Flash, till Flash-pris, i väntan på en kommande V4.1-Pro.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

OpenAI lanserar GPT-6 Astra – ”Välkommen till AGI-eran”

Utvecklingen av AI

Uppdaterad september 3, 2026, Publicerad september 3, 2026 – av Markus Andersson
Galaxspiral formad som siffran 6 med orden GPT-6 och Astra
Galaxformen bildar siffran 6 i en illustration av OpenAI-modellen GPT-6 Astra.

OpenAI lanserar GPT-6 Astra och talar om början på en ny epok för artificiell intelligens. Modellen gör stora språng inom forskning, datoranvändning och cybersäkerhet – men kostar betydligt mer och väcker nya frågor om kontroll.

Lanseringen skedde på torsdagen efter en period av begränsade tester. Astra blir först tillgänglig för företagskunder i OpenAI:s Daybreak-program. Därefter ska modellen rullas ut till användare av Plus, Pro, Business och Enterprise samt via OpenAI:s programmeringsgränssnitt och Amazon Web Services ”under de kommande dagarna”, skriver teknikpublikationen The New Stack, som deltog i en pressgenomgång inför lanseringen.

OpenAI-chefen Greg Brockman gick längre än företagets vanliga språkbruk och avslutade genomgången med orden ”Välkommen till AGI-eran”. Samtidigt medgav han att AGI – generell artificiell intelligens – fortfarande är ett ”grått och otydligt” begrepp. Uttalandet var därför inte en formell deklaration om att OpenAI bevisat mänsklig generell intelligens i en maskin.

I sin officiella lanseringsartikel beskriver OpenAI Astra som en datoragent som bland annat kan fylla i webbformulär, uppdatera kundregister, organisera kalendrar, skapa webbplatser samt självständigt installera och testa program. Modellen ska även kunna genomföra research och skriva sammanfattningar direkt i användarens e-post eller dokumentredigerare.

Bakom prestandalyftet ligger OpenAI:s största träningskörning hittills. Enligt bolaget tränades Astra på mer än 100 000 grafikprocessorer vid Stargate-anläggningen i Texas. Det är också första gången tidigare OpenAI-modeller ska ha spelat en betydande roll i att övervaka träningen av en ny generation.

Stora språng utanför programmering

På OpenAI:s egna tester är förbättringarna störst inom matematik, naturvetenskap och uppgifter där modellen måste använda program och verktyg. Astra får enligt den slutliga lanseringsartikeln 99,9 procent på ARC-AGI-3, 97,6 procent på den svåraste nivån av FrontierMath och 64,6 procent på Terminal-Bench Science. På det sistnämnda testet nådde föregångaren GPT-5.6 Sol 22,4 procent.

Tabell med OpenAI:s benchmarkresultat för GPT-6 Astra jämfört med andra AI-modeller
OpenAI:s tidigare jämförelsetabell visar 98,6 procent på ARC-AGI-3, medan den slutliga lanseringsartikeln anger 99,9 procent. Övriga redovisade Astra-värden i tabellen omfattar 97,6 procent på FrontierMath Tier 4 och 64,6 procent på Terminal-Bench Science. Bild: OpenAI.

Siffrorna kräver ändå försiktighet. OpenAI har tidigare visat att ett system som låter modellen behålla sitt resonemang mellan stegen och sammanfatta äldre historik kan tredubbla resultatet på ARC-AGI-3 utan att själva grundmodellen byts ut. Astras toppresultat mäter därför både modellen och OpenAI:s omgivande agentsystem.

På FrontierMath finns en annan reservation. Organisationen Epoch AI, som driver testet, uppger att OpenAI finansierat utvecklingen och har exklusiv tillgång till en del av de privata uppgifterna. Astra har ännu inte heller lagts till på flera oberoende offentliga topplistor.

Inom programmering är ledningen mindre tydlig. OpenAI redovisar 74,1 procent på DeepSWE v1.1, medan den offentliga topplistan placerar Gemini 3.8 Flash och Claude Opus 5 på omkring 74 procent och GPT-5.6 Sol på 73 procent. Felmarginalerna överlappar, vilket gör det svårt att utse en ensam vinnare.

Minnet sträcker sig över längre arbeten

För användarna kan Astras nya minnesfunktioner bli viktigare än enskilda testresultat. Dagens kodagenter sammanfattar ofta äldre delar av ett långt arbete när kontextfönstret fylls. Då kan avgörande detaljer försvinna: varför en tidigare lösning misslyckades, vilka tester som kördes eller vilket krav användaren lade till i början.

Astra kan i stället föra anteckningar mellan kontextfönster och söka i tidigare meddelanden och verktygsresultat. Funktionen är inledningsvis experimentell i Codex, men ska enligt OpenAI bli standard för Astra under de kommande veckorna. Modellen kan också ställa en fråga till användaren och fortsätta med de delar av arbetet som inte beror på svaret. Tidigare kontextfönster förblir sökbara, så modellen kan återfinna krav och testresultat som inte kom med i de löpande anteckningarna.

OpenAI visade under pressgenomgången hur Astra använde bland annat Excel, Blender, Power BI och elektronikkonstruktionsprogrammet KiCad. På OSWorld V2-Offline, som mäter arbete i vanliga datorprogram, uppges modellen ha höjt resultatet från 65,7 till 72,6 procent och minskat tiden per uppgift med omkring 47 procent, från cirka 75 till 40 minuter. Tillsammans med ett uppdaterat Codex-system ska Astra dessutom slutföra uppgifter 1,9 gånger snabbare än GPT-5.6 Sol på Mind2Web.

Dyrare än föregångaren

Prestandan kommer med ett tydligt prispåslag. Via programmeringsgränssnittet kostar Astra 10 dollar per miljon indatatokens och 50 dollar per miljon utdatokens. Det är två och en halv gånger GPT-5.6 Sols tillfälliga pris, enligt The New Stack. OpenAI erbjuder även ett snabbläge som uppges ge upp till 2,5 gånger högre hastighet, men till dubbla standardpriset. Pro-, Business- och Enterprise-kunder ska dessutom få tillgång till en särskild Astra Pro-version.

OpenAI hävdar att priset per löst uppgift är viktigare än kostnaden per token, eftersom Astra i flera tester använder färre steg och mindre text. Bolaget har dock inte redovisat tillräckligt med data för att visa att effektivitetsvinsten väger upp hela prisskillnaden i vanligt arbete.

Första OpenAI-modellen på kritisk cybernivå

Den mest omvälvande förbättringen finns inom cybersäkerhet. OpenAI klassar Astra som sin första modell på nivån ”kritisk” cyberförmåga. Med rätt verktyg och åtkomst ska den kunna hitta tidigare okända säkerhetshål och bygga fungerande angrepp mot väl skyddade system utan att en människa styr varje steg.

I företagets tester fick Astra full poäng på ExploitBench och hittade två tidigare okända sårbarheter som kunde kombineras till en angreppskedja. De mest avancerade funktionerna släpps därför inte fritt. Vanliga användare får en version som stoppar vissa typer av arbete, medan utvalda säkerhetsforskare ges vidare åtkomst genom Daybreak Blue.

På det nya SRE-Bench, som mäter omvänd analys av program utan tillgång till källkoden, löste Astra enligt OpenAI 88,0 procent av uppgifterna vid första försöket och 99,2 procent inom fyra försök. I expertledda tester utan produktionsskydd kunde modellen dessutom använda okända sårbarheter för att köra kod i härdade webbläsare och skapa angrepp som höjer behörigheten i härdade operativsystem.

Begränsningarna kan samtidigt drabba legitimt arbete. OpenAI varnar för att användare kan möta fördröjningar, pauser eller stopp när systemet misstänker cybermissbruk – även vid uppgifter som inte verkar handla om cybersäkerhet.

Mer lydig – men svårare att övervaka

OpenAI beskriver Astra som sin mest anpassade modell hittills. I ett test med avsiktligt svåra eller omöjliga cyberuppgifter gick en oskyddad GPT-5.6 Sol utanför det tillåtna målet i 48,2 procent av fallen. Astra gjorde inga sådana försök.

I ett separat internt stresstest för datoranvändning redovisar bolaget 2,4 procent felanpassade utfall för Astra, jämfört med 22,0 procent för GPT-5.6 Sol. OpenAI uppger också att Astra var tre gånger mindre benägen än Sol att lämna missvisande besked om vad modellen kan göra.

Men samma modell är svårare att följa. Företaget uppger att Astras nedskrivna resonemang blev mindre lättövervakat i tester som uttryckligen försökte framkalla undvikande beteende. OpenAI:s forskningschef Jakub Pachocki sade därför att bolaget kommer att hålla tillbaka ytterligare uppskalning tills det återfått tillräckligt förtroende för övervakningen.

Problemet går till kärnan i lanseringen. OpenAI vill ge modellen längre arbetsminne, fler verktyg och större handlingsutrymme, samtidigt som företaget medger att insynen inte utvecklas lika snabbt som intelligensen. NyD har tidigare rapporterat om hur OpenAI missade interna AI-agenters kommunikation i flera veckor – ett exempel på hur kontrollsystem kan halka efter när modellerna blir mer självständiga.

Om Astra verkligen markerar början på AGI-eran går inte att avgöra med de tester som OpenAI presenterat. Lanseringen visar däremot att gränsen flyttats: från modeller som främst svarar på frågor till system som kan arbeta i timmar, använda datorprogram, bedriva forskning och hitta sårbarheter med allt mindre mänsklig ledning.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Oppo storsatsar hos Elgiganten

Publicerad september 3, 2026 – av Redaktionen
Elgiganten-butik med kedjans logotyp och tre vyer av Oppo Find X9 Pro
Montage med en Elgiganten-butik, kedjans logotyp och mobiltelefonen Oppo Find X9 Pro.

Kinesiska Oppo får större plats på den svenska mobilmarknaden. Ett nytt nordiskt avtal gör hela företagets mobilutbud tillgängligt via Elgiganten, samtidigt som närstående OnePlus slutar lansera nya produkter i Europa.

Avtalet med Elkjøp Nordic omfattar Sverige, Norge, Danmark och Finland. I Sverige ska telefonerna säljas genom Elgiganten, både i kedjans butiker och på nätet.

Sortimentet sträcker sig från de billigare telefonerna i A-serien och modellerna i Reno-serien till de mer avancerade Find-telefonerna. På Elgigantens svenska webbplats finns redan flera Oppo-modeller samlade på en egen märkessida.

Den nordiska mobilmarknaden är under förändring och Oppo är redo att ta vara på möjligheten. Genom vårt partnerskap med Elkjøp Nordic gör vi Oppo mer tillgängligt på samtliga fyra nordiska marknader, säger Jeremy Geng, vd för Oppo Nordics, i ett pressmeddelande.

Tar plats när OnePlus lämnar

Satsningen kommer kort efter att närstående OnePlus meddelat att företaget inte längre ska lansera nya produkter i Europa och Nordamerika. Befintliga telefoner ska enligt företaget fortsatt få säkerhetsuppdateringar, mjukvarustöd och service.

Elkjøp Nordic räknar med att Oppo ska bli ett alternativ för kunder som tidigare valt OnePlus.

Eftersom OnePlus lämnar den nordiska marknaden är vi övertygade om att Oppo blir ett starkt och naturligt alternativ för lojala OnePlus-kunder, säger Torkil Sagafos, inköpschef för telekom på Elkjøp Nordic.

Oppo är samtidigt en av världens största mobiltillverkare. Omdia placerar Oppo-gruppen, där även OnePlus och Realme räknas in, på fjärde plats globalt med 28,4 miljoner levererade telefoner under andra kvartalet 2026.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.