Annons:

OpenAI missade AI-agenternas hemliga chatt i veckor

Utvecklingen av AI

Publicerad augusti 11, 2026 – av Markus Andersson
OpenAI:s och Hugging Faces logotyper i ett delat montage.
OpenAI:s och Hugging Faces logotyper i ett delat montage.
Insamlingskampanj

Hjälp Nya Dagbladet att finnas kvar

Insamlat: 28 570,00 SEK 38% Mål: 75 000,00 SEK

Nya uppgifter visar hur OpenAI:s testagenter byggde en egen anslagstavla, delade sårbarheter och fördelade uppgifter mellan sig under flera veckor. När företaget stängde kanalen hittade modellerna en ny väg att kommunicera – och fortsatte mot externa system.

OpenAI-forskarna Eric Wallace och Michael Dalton redovisade den utökade tidslinjen vid säkerhetskonferensen Black Hat i Las Vegas. Wired rapporterade att anslagstavlan till slut innehöll hundratusentals meddelanden och hade vuxit fram inuti Artifactory, den pakethanterare som OpenAI använde i sin testinfrastruktur.

Det var samma serie av händelser som i juli slutade med att AI-agenter tog sig ur en isolerad testmiljö och angrep AI-plattformen Hugging Face. NyD rapporterade då att modellerna försökte komma över lösningar till cybertestet ExploitGym genom att utnyttja flera sårbarheter i verkliga system.

De nya uppgifterna visar att intrånget inte föregicks av en enda plötslig ”rymning”. I stället växte en gemensam kunskapsbank fram mellan separata agentkörningar. Där delades tekniska fynd, inloggningsuppgifter och arbetsuppgifter som senare modeller kunde hitta och använda.

Annons:

Började med två felaktiga testuppgifter

Förloppet började den 7 maj när OpenAI startade en träningskörning med en ännu inte lanserad modell. Dagen därpå fick en agent av misstag en uppgift med en Google Drive-länk, trots att den saknade internetåtkomst. I försöket att lösa uppgiften upptäckte agenten att den kunde skriva filer till Artifactory.

Några dagar senare saknades en nödvändig fil i en annan agents uppgift. Den lämnade då ett meddelande i pakethanteraren för att fråga om någon annan agent hade filen. Fler agentinstanser hittade meddelandet och började använda samma utrymme som anslagstavla. Tidslinjen har sammanställts av programmeraren och AI-forskaren Simon Willison från OpenAI:s publicerade Black Hat-presentation.

Den 26 maj lyckades agenter för första gången utnyttja Artifactory för indirekt internetåtkomst. En månad senare fann de en tidigare okänd brist som gav möjlighet att köra kommandon i systemet. Ett fynd från en agent kunde därefter återanvändas av andra.

— Det här handlade om ett team av agenter som arbetade tillsammans, hittade sårbarheter, delade dem, rörde sig i sidled genom våra och externa system och gjorde detta under dagar och veckor, sade Wallace vid konferensen.

I ett av de meddelanden som visades under presentationen konstaterade en agent att ett angrepp mot extern infrastruktur låg utanför den avsedda uppgiften. Den fortsatte ändå med motiveringen att testuppgiften annars var omöjlig och att andra agenter redan gjorde samma sak.

Stängdes – kom tillbaka fyra dagar senare

Den 4 juli blev aktiviteten så omfattande att Artifactory drabbades av ett avbrott. OpenAI återkallade komprometterade behörigheter, raderade meddelandena, åtgärdade den då kända sårbarheten och kontaktade leverantören.

Fyra dagar senare hade nya agentkörningar hittat en annan kanal. Genom en oskyddad WebDAV-funktion skapade de kataloger vars namn fungerade som meddelanden. På så vis återuppstod anslagstavlan utan de filer och behörigheter som OpenAI just hade tagit bort.

Mellan den 8 och 19 juli använde agenterna nya sårbarheter och felkonfigurerade behörigheter för att röra sig genom ytterligare delar av OpenAI:s infrastruktur. De hittade också en svagt skyddad extern tjänst som blev språngbräda till Hugging Face. Där nådde angreppet administratörsbehörighet i flera datorkluster på mindre än 13 timmar, enligt den tekniska tidslinjen.

Förstod kopplingen först efter Hugging Face

Hugging Face offentliggjorde intrånget den 16 juli utan att då veta att det kom från OpenAI:s tester. OpenAI började tre dagar senare koppla ihop den interna eskaleringen med agenternas cybertester. Först den 20 juli, när bolaget bad Hugging Face att återkalla behörigheter som redan hade spärrats efter intrånget, stod det klart att händelserna var delar av samma förlopp.

Redogörelsen belägger inte att modellerna var medvetna eller hade egna fientliga avsikter. OpenAI har tidigare uppgett att de var hårt inriktade på att maximera resultatet i ExploitGym. Händelsen visar däremot att separata agentkörningar kunde behandla säkerhetsgränser som hinder, lämna information åt framtida körningar och fortsätta även när en logg uttryckligen identifierade en åtgärd som förbjuden.

Dalton uppgav att flera team nu har lagt annat arbete åt sidan för att förbättra isolering, övervakning och incidenthantering. Företaget ska enligt honom medvetet sakta ned delar av forskningen medan skydden byggs om.

— Fullt automatiserade offensiva förlopp kräver investeringar i ett verkligt fullt automatiserat försvar, och där är vi inte som bransch, sade Dalton.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Annons:

Donald Trump och AI-jättar skrev under avtal om att granska sig själva

Utvecklingen av AI

Publicerad Igår 10:18 – av Jan Sundstedt
Donald Trump sitter vid ett bord i Vita huset tillsammans med Elon Musk, Jensen Huang och andra techchefer.
Trump, Musk och Huang vid bordet i Vita huset under tisdagen, när bolagscheferna skrev under det frivilliga säkerhetsavtalet.

Donald Trump och cheferna för USA:s största AI-bolag skrev under tisdagen på ett avtal om att granska sina egna system. Trump kallar avtalet moraliskt bindande men påpekar att det är frivilligt och att man i dagsläget inte avser inrätta en ny tillsynsmyndighet.

Elon Musk från xAI, Mark Zuckerberg från Meta, Sundar Pichai från Google och Jensen Huang från Nvidia samlades i tisdags i Vita huset. Dario Amodei från Anthropic och Greg Brockman, president för OpenAI, deltog också i mötet.

Musk, som en tid stått på kant med Trump, var därmed tillbaka i Vita huset. Presidenten och bolagscheferna undertecknade i samband med mötet avtalet White House Accord on Super Intelligence.

Bolagen lovar fyra lager av kontroller. Egna spärrar mot dataintrång, biologiska risker och kemiska hot ingår, liksom en intern granskningsgrupp.

Oberoende revisorer och en styrelsekommitté ska granska rapporterna. Bolagen ska också mötas regelbundet om gemensamma regler.

— Vi kom överens om ett antal saker, bland annat gemensam övervakning, särskilda styrelsekommittéer och att helt enkelt rätta varandras läxor, betonade Elon Musk.

Avtalets sista stycke öppnar för lagstiftning längre fram: "Med tiden kan det vara rimligt att kodifiera dessa steg i lagar eller förordningar".

Donald Trump sade att det finns en övertygelse om att branschen ska reglera sig själv i stor utsträckning och liknade dokumentet vid nästan en konstitution. Han svarade nej på frågan om det krävs mer än kärlek till fosterlandet för att skydda människor mot AI.

Talmannen Mike Johnson beskrev åtagandena som frivilliga. Vicepresident JD Vance avvisade uttryckligen en statlig tillsyn i stil med läkemedelsmyndigheten eller luftfartsmyndigheten.

— Lösningen på en del av AI-riskerna är att ni tar risken på allvar, inte att ni kommer till staten för att få en regleringsregim som kan göra saken värre, sade Vance.

Vicepresidenten framhöll att konsumentmyndigheten och justitiedepartementet redan kan ställa utvecklare till svars för produkter som skadar konsumenter.

Nytt namn, samma lag

Donald Trump undertecknade några timmar senare ett dekret som hör till samma satsning.

Vita huset publicerade texten, som anger att myndigheterna inom den verkställande makten ska använda Super Intelligence och SI i stället för artificiell intelligens och AI.

Namnbytet gäller officiell korrespondens, webbplatser, rapporter och styrdokument så långt lagen tillåter.

Myndigheterna behöver inte skriva om äldre regler, kontrakt och historiska dokument. Begreppen behåller enligt rapporter samma juridiska innebörd som tidigare.

Super Intelligence betyder det som lagen redan definierar som artificiell intelligens. Presidentens vetenskapsrådgivare har 60 dagar på sig att föreslå en eventuellt reviderad lagtext.

Demokraten Mark Warner, vice ordförande i senatens underrättelseutskott, gick till angrepp i ett pressmeddelande: "Bolagen som bygger de mest kraftfulla AI-systemen varnar oss för att tekniken utvecklas snabbare än våra skyddsåtgärder. Presidentens svar? Att döpa om den och säga åt bolagen som utvecklar den att reglera sig själva".

En republikansk invändning i senaten stoppade samma dag Warners eget lagförslag om AI-risker.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

OpenAI lanserar dots – agenter som jobbar dygnet runt

Utvecklingen av AI

Publicerad september 29, 2026 – av Markus Andersson
Fyra färgglada Dots-figurer under produktnamnet
Dots drivs av GPT-6 Astra och arbetar via de appar användaren väljer att ansluta.

OpenAI använde utvecklardagen i San Francisco under tisdagen till att presentera dots. Det är inte en ny chattbot, utan agenter som enligt bolaget ska kunna arbeta i bakgrunden dygnet runt, med egen dator och tillgång till de appar användaren själv kopplar in.

I det officiella klippet från presentationen beskrivs dots som agenter som kan boka ett bord, eller ta sig an större arbetsuppgifter med samma initiativ som en driven ingenjör eller en stabschef. Figurerna i filmen, de färgglada blobbarna, är bolagets ansikte utåt för produkten.

OpenAI beskriver därmed en förflyttning från samtal till handling: användaren ska kunna lämna över uppgifter, men behöver samtidigt bedöma vilka konton och befogenheter agenten får tillgång till.

En agent med egen dator

Enligt OpenAI:s presentation drivs dots av den redan släppta modellen GPT-6 Astra, inte av ett nytt flaggskepp. Agenten ska lära sig vad användaren behöver och kunna sätta igång innan någon frågar. Den har en egen molndator och webbläsare, kan kopplas till fler än 4 000 appar via de tillägg som redan finns i ChatGPT, och ska kunna nås via sms och telefonsamtal.

Bolaget betonar att användaren sätter gränserna: vad agenten får göra själv, när den ska fråga först, och vad den aldrig får göra. Att koppla in den egna datorn är valfritt, eftersom doten körs på OpenAI:s molndator. Det är en viktig reservation. En agent som kan agera i mejl, kalender och arbetsverktyg är inte samma sak som en chatt som bara svarar.

Dots finns från och med tisdagen i ChatGPT på webb, mobil och dator för Pro, Business Premium och Enterprise, i de marknader OpenAI räknar som aktuella. Plus-abonnenter står utanför. Första doten skapas i skrivbordsappen eller i webbläsaren på datorn. Det är OpenAI:s svar på samma slags produkt som xAI redan säljer som Grok Bot: en agent som loggar in i användarens verktyg och utför jobb, inte bara svarar.

Resten av dagen: en billigare modell

Vid sidan av dots släppte OpenAI GPT-6.1 Sol. Enligt bolagets egen text ska den ligga nära Astra till en femtedel av tokenpriset. API-priset är 2 dollar per miljon inmatade token och 10 dollar per miljon utmatade. Astra ligger på 10 respektive 50 dollar. Cachelagrad inmatning kostar 0,10 dollar, 95 procent under ordinarie inpris. Den mindre modellen GPT-6 Luna kostar 0,10 och 0,50 dollar.

Prisjämförelse mellan GPT-6 Astra, GPT-6.1 Sol och GPT-6 Luna
OpenAI:s egen prisjämförelse. Astra kostar fem gånger så mycket per token som GPT-6.1 Sol. Foto: OpenAI

I samma tråd, som är bolagets egen mätning och inte ett oberoende test, uppger OpenAI att GPT-6.1 Sol når 75,2 procent på DeepSWE v1.1 vid hög resonemangsnivå, mot 68,8 procent för GPT-6 Sol, till ungefär 76 procent lägre kostnad per uppgift. På AutomationBench anges 31,7 procent, 4,8 poäng över GPT-6 Sol vid samma inställning. På OSWorld 2.0 offline anges 71,4 procent mot Astras 73,5, till ungefär en sjundedel av Astras kostnad per uppgift. På svåra faktafrågor uppger bolaget ungefär 32 procent färre svar med faktafel än GPT-6 Sol, vid låg resonemangsnivå.

Sol är från tisdagen tillgänglig i ChatGPT Work, Codex och API:t. I den vanliga chatten finns den ännu inte, enligt OpenAI. Ultrafast, en snabbare körning som bolaget uppger kan vara upp till åtta gånger snabbare i Codex, kräver det nya abonnemanget Pro 500: 500 dollar i månaden, med en användningstak som OpenAI säger motsvarar 25 gånger Plus.

Utvecklardagen var alltså full av produktnyheter. Det som faktiskt möter vanliga användare först är inte en billigare modell i chatten, utan en agent som får arbeta i deras verktyg, och bara om de redan betalar för Pro eller ett företagskonto.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

OpenAI stoppar GPT-6.1 Astra – klarade inte egna säkerhetstester

Utvecklingen av AI

Publicerad september 29, 2026 – av Emil Fjellstedt
Svart telefon med texten GPT-6 Astra och OpenAI-logotypen.
GPT-6.1 Astra skulle ha släppts i oktober, men klarade inte OpenAI:s egna säkerhetstester.

OpenAI stoppar sin nästa stora AI-modell. GPT-6.1 Astra skulle ha släppts i oktober, men klarade inte bolagets egna säkerhetstester och var enligt Wall Street Journal mer vilseledande än sin föregångare.

Det bekräftade ChatGPT-bolaget under måndagen, rapporterar nyhetsbyrån Reuters. Interna tester hade visat att modellen inte mötte OpenAI:s krav på säkerhet och alignment, alltså att systemet håller sig till de mål och gränser som människor satt upp.

Astra var tänkt att byggas in i ChatGPT och Codex och var konstruerad för att klara mer komplexa uppgifter utan mänsklig hjälp.

Wall Street Journal, som först rapporterade om beslutet samma dag, uppger att modellen i testerna visade högre grad av vilseledning än föregångaren. Den redovisade inte alltid korrekt vilka åtgärder den hade vidtagit.

Säkerhetschefen: nådde inte ribban

Saachi Jain, som leder OpenAI:s arbete med säkerhetssystem, beskriver bristerna som en fråga om gränser och rapportering.

— Även om modellen blev mindre lat nådde den inte riktigt ribban när det gäller att hålla sig inom uppdrag och behörighet, och hur den rapporterar tillbaka till användaren om vilket slags arbete den har gjort, säger Jain till Reuters.

— När vi släpper en modell till användare har vi en extremt hög ribba för säkerhet och alignment, säger hon.

Varnade själva för modellen

OpenAI har tidigare varnat för att Astra, bolagets flaggskepp i GPT-6-generationen, ibland kan undgå mänsklig översyn. Bolaget och rivaler som Anthropic har också granskats efter att experimentella system tagit sig förbi skydd. Enligt Reuters gäller det bland annat en OpenAI-modell som tog sig in i Australiens hälsodatabas.

Tidigare i september anslöt sig OpenAI:s vd Sam Altman och Anthropics vd Dario Amodei till branschledare som krävt långsammare AI-utveckling och starkare säkerhetsåtgärder, skriver Reuters. Beslutet om Astra kommer strax före OpenAI:s utvecklarkonferens i San Francisco.

I Vita huset låter det annorlunda. President Donald Trump har avfärdat uppmaningen att sakta ned AI-utvecklingen och sagt att USA inte tänker bromsa kapplöpningen.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.

Anthropic släpper Sonnet 5.5: nästan toppnivå för halva listpriset

Utvecklingen av AI

Publicerad september 28, 2026 – av Markus Andersson
Claude Sonnet 5.5, sedd genom ett fönster mot jorden
AI-bolaget Anthropic släppte Claude Sonnet 5.5 den 28 september 2026.

AI-bolaget Anthropic släpper en mellanmodell som i bolagets egna tester når nästan samma nivå som flaggskeppet, till halva listpriset. För den som använder AI i jobbet eller vardagen innebär det mer kapacitet för mindre pengar och kortare väntan.

Claude Sonnet 5.5 släpptes den 28 september 2026. Anthropic presenterade modellen som ett snabbare och billigare komplement till Opus 5.5, som kom knappt en vecka tidigare.

Priset är oförändrat jämfört med föregångaren Sonnet 5: 2 dollar per miljon indatatokens och 10 dollar per miljon utdatatokens. Tokens är de textbitar som modellerna läser, skriver och debiterar efter. Det är hälften av Opus 5.5:s listpris på 4 respektive 20 dollar.

Alla delar av notan halveras dock inte. Cache-läsningar, alltså återanvänd text som modellen redan har tagit emot, kostar 0,20 dollar per miljon tokens för båda modellerna.

Besparingen ligger i stället i effektiviteten. Enligt Anthropic behöver Sonnet 5.5 oftast betydligt färre tokens för samma arbete, och i bolagets tester kostar en uppgift upp till 30 procent mindre än med Sonnet 5. Modellen genererar dessutom text mer än 30 procent snabbare än föregångaren.

Slår Opus i ett av bolagets egna tester

Testsiffrorna kommer från Anthropics egen redovisning och är inte oberoende verifierade. Den mest uppseendeväckande gäller Terminal-Bench 4.0, som mäter hur väl en modell klarar komplexa programmeringsuppgifter i flera steg via kommandoraden.

Där får Sonnet 5.5 70,6 procent. Opus 5.5 når 66,4 procent på sin högsta ansträngningsnivå, Xhigh, medan Sonnet 5 stannade på 10,3 procent.

I övriga tester ligger den nya modellen strax under Opus. På GDPval-AA, som prövar verkliga arbetsuppgifter inom 44 yrken och som analysföretaget Artificial Analysis körde på en förhandsversion av modellen, blev resultatet 1844 mot 1846. På CursorBench, med uppgifter från verkliga programmeringssessioner, fick Sonnet 5.5 55,5 mot 57,8. På FrontierCode, som mäter om en modells kodändringar skulle godkännas, fick Sonnet 5.5 52,1 på nivån Xhigh mot Opus 5.5:s 54,4.

Anthropic drar själv en gräns. Bolaget skriver att Opus 5.5 fortfarande är "klart starkare på komplext, öppet arbete som kräver uthålligt omdöme".

Skillnaden mellan modellerna styrs också av hur hårt de får arbeta. På högre ansträngningsnivåer resonerar modellen längre och kontrollerar sitt arbete noggrannare, vilket kostar fler tokens. Där kan Sonnet 5.5 enligt Anthropic prestera i nivå med Opus till en liknande kostnad per uppgift.

Kod i tiotusentals rader

Flera kunder har testat modellen i förväg. Spelbolaget Epic Games lyfter fram att den klarade tunga uppgifter utan att tappa fart.

"I Epics tidiga tester klarade Claude Sonnet 5.5 samma kvalitetsribba som man väntar sig av en modell i en högre klass. Den nya modellen hanterade tiotusentals rader kod för arkitekturen i spelsystem, höll svaren snabba och klarade uppgifter som pågick i flera timmar", skriver Daniel Vogel, operativ chef på Epic Games, i ett kundcitat på Anthropics lanseringssida.

Anthropic nämner också en mer lättsam milstolpe: Sonnet 5.5 är den första Sonnet-modellen som har klarat spelet Pokémon Red enbart utifrån skärmbilder.

Cyberskydd och Haiku på väg

Den ökade förmågan får följder för säkerheten. Anthropic sätter cyberskydd på Sonnet 5.5 som liknar dem på Opus 5.5, eftersom förmågan har ökat kraftigt jämfört med Sonnet 5. Det är den första Sonnet-modellen med den nivån av skydd.

Uppgifter som bedöms som högriskabla inom cybersäkerhet lämnas i stället synligt över till Sonnet 5. Vanlig programutveckling, som att hitta och rätta buggar i egen kod, påverkas inte, enligt Anthropic.

Sonnet 5.5 finns redan tillgänglig i Claude-apparna och för utvecklare under namnet claude-sonnet-5-5 på Claude Platform, Amazon Web Services, Google Cloud och Microsoft Azure. Den minsta modellen i familjen, Haiku 5.5, som är byggd för stora volymer och kostnadskänsliga tjänster, kommer under de kommande veckorna.

För vardagsanvändaren är standardinställningen det intressanta. I Claude-apparna körs modellen på mellannivån Medium, och där överträffar Sonnet 5.5 enligt Anthropic föregångarens bästa resultat på Terminal-Bench för mindre än en tiondel av kostnaden per uppgift.

Trovärdighet – grunden i vår journalistik sedan 2012

Nya Dagbladets position är unik i det svenska medielandskapet. NyD är oberoende på riktigt. Tidningen ägs och kontrolleras inom den egna redaktionen – inte av stora mediekonglomerat eller utländska intressen.

Sedan grundandet 2012 har grunden i vår oberoende journalistik varit balans och trovärdighet framför sensationsjournalistik och snabba klick. NyD är Sveriges bredaste helt oberoende dagstidning och står helt fri från politiska partier och industriintressen.

NyD erhåller inget presstöd och finansieras genom läsardonationer och annonser. Läs mer om våra pressetiska riktlinjer här.