<?xml version="1.0" encoding="UTF-8"?><?xml-stylesheet type="text/xsl" href="https://nyadagbladet.se/wp-content/plugins/rss-feed-styles/public/template.xsl"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	xmlns:rssFeedStyles="http://www.lerougeliet.com/ns/rssFeedStyles#"
xmlns:media="http://search.yahoo.com/mrss/" >

<channel>
	<title>GPT-5.6 &#8211; Nya Dagbladet</title>
	<atom:link href="https://nyadagbladet.se/tag/gpt-5-6/feed/" rel="self" type="application/rss+xml" />
	<link>https://nyadagbladet.se</link>
	<description>Morgondagens Dagstidning!</description>
	<lastBuildDate>Tue, 11 Aug 2026 14:14:51 +0000</lastBuildDate>
	<language>sv-SE</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1</generator>

<image>
	<url>https://nyadagbladet.se/wp-content/uploads/2021/11/cropped-nyd-logo-500-32x32.jpg</url>
	<title>GPT-5.6 &#8211; Nya Dagbladet</title>
	<link>https://nyadagbladet.se</link>
	<width>32</width>
	<height>32</height>
</image> 
<rssFeedStyles:reader name="Digg Reader" url="http://digg.com/reader/search/https%3A%2F%2Fnyadagbladet.se%2Ffeed%2F"/><rssFeedStyles:reader name="Feedly" url="http://cloud.feedly.com/#subscription%2Ffeed%2Fhttps://nyadagbladet.se/feed/"/><rssFeedStyles:reader name="Inoreader" url="http://www.inoreader.com/?add_feed=https%3A%2F%2Fnyadagbladet.se%2Ffeed%2F"/><rssFeedStyles:button name="Like" url="https://www.facebook.com/sharer/sharer.php?u=%url%"/><rssFeedStyles:button name="G+" url="https://plus.google.com/share?url=%url%"/><rssFeedStyles:button name="Tweet" url="https://twitter.com/intent/tweet?url=%url%"/>	<item>
		<title>OpenAI missade AI-agenternas hemliga chatt i veckor</title>
		<link>https://nyadagbladet.se/teknik/openai-missade-ai-agenternas-hemliga-chatt/</link>
		
		<dc:creator><![CDATA[Markus Andersson]]></dc:creator>
		<pubDate>Tue, 11 Aug 2026 14:14:51 +0000</pubDate>
				<category><![CDATA[Teknik]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[artificiell intelligens]]></category>
		<category><![CDATA[cybersäkerhet]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[Hugging Face]]></category>
		<category><![CDATA[OpenAI]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=236929</guid>

					<description><![CDATA[<strong>Nya uppgifter visar hur OpenAI:s testagenter byggde en egen anslagstavla, delade sårbarheter och fördelade uppgifter mellan sig under flera veckor. När företaget stängde kanalen hittade modellerna en ny väg att kommunicera – och fortsatte mot externa system.</strong>

OpenAI-forskarna Eric Wallace och Michael Dalton redovisade den utökade tidslinjen vid säkerhetskonferensen Black Hat i Las Vegas. Wired <a href="https://www.wired.com/story/openai-didnt-notice-its-ai-agents-using-a-message-board-to-plan-their-hacking-spree/" target="_blank" rel="noopener nofollow">rapporterade</a> att anslagstavlan till slut innehöll hundratusentals meddelanden och hade vuxit fram inuti Artifactory, den pakethanterare som OpenAI använde i sin testinfrastruktur.

Det var samma serie av händelser som i juli slutade med att AI-agenter tog sig ur en isolerad testmiljö och angrep AI-plattformen Hugging Face. NyD <a href="https://nyadagbladet.se/teknik/openai-modeller-brot-sig-ut-hackade-hugging-face/">rapporterade</a> då att modellerna försökte komma över lösningar till cybertestet ExploitGym genom att utnyttja flera sårbarheter i verkliga system.

De nya uppgifterna visar att intrånget inte föregicks av en enda plötslig ”rymning”. I stället växte en gemensam kunskapsbank fram mellan separata agentkörningar. Där delades tekniska fynd, inloggningsuppgifter och arbetsuppgifter som senare modeller kunde hitta och använda.
<h3>Började med två felaktiga testuppgifter</h3>
Förloppet började den 7 maj när OpenAI startade en träningskörning med en ännu inte lanserad modell. Dagen därpå fick en agent av misstag en uppgift med en Google Drive-länk, trots att den saknade internetåtkomst. I försöket att lösa uppgiften upptäckte agenten att den kunde skriva filer till Artifactory.

Några dagar senare saknades en nödvändig fil i en annan agents uppgift. Den lämnade då ett meddelande i pakethanteraren för att fråga om någon annan agent hade filen. Fler agentinstanser hittade meddelandet och började använda samma utrymme som anslagstavla. Tidslinjen har sammanställts av programmeraren och AI-forskaren Simon Willison från OpenAI:s publicerade Black Hat-presentation.

Den 26 maj lyckades agenter för första gången utnyttja Artifactory för indirekt internetåtkomst. En månad senare fann de en tidigare okänd brist som gav möjlighet att köra kommandon i systemet. Ett fynd från en agent kunde därefter återanvändas av andra.

— <em>Det här handlade om ett team av agenter som arbetade tillsammans, hittade sårbarheter, delade dem, rörde sig i sidled genom våra och externa system och gjorde detta under dagar och veckor</em>, sade Wallace vid konferensen.

I ett av de meddelanden som visades under presentationen konstaterade en agent att ett angrepp mot extern infrastruktur låg utanför den avsedda uppgiften. Den fortsatte ändå med motiveringen att testuppgiften annars var omöjlig och att andra agenter redan gjorde samma sak.
<h3>Stängdes – kom tillbaka fyra dagar senare</h3>
Den 4 juli blev aktiviteten så omfattande att Artifactory drabbades av ett avbrott. OpenAI återkallade komprometterade behörigheter, raderade meddelandena, åtgärdade den då kända sårbarheten och kontaktade leverantören.

Fyra dagar senare hade nya agentkörningar hittat en annan kanal. Genom en oskyddad WebDAV-funktion skapade de kataloger vars namn fungerade som meddelanden. På så vis återuppstod anslagstavlan utan de filer och behörigheter som OpenAI just hade tagit bort.

Mellan den 8 och 19 juli använde agenterna nya sårbarheter och felkonfigurerade behörigheter för att röra sig genom ytterligare delar av OpenAI:s infrastruktur. De hittade också en svagt skyddad extern tjänst som blev språngbräda till Hugging Face. Där nådde angreppet administratörsbehörighet i flera datorkluster på mindre än 13 timmar, enligt den tekniska tidslinjen.
<h3>Förstod kopplingen först efter Hugging Face</h3>
Hugging Face offentliggjorde intrånget den 16 juli utan att då veta att det kom från OpenAI:s tester. OpenAI började tre dagar senare koppla ihop den interna eskaleringen med agenternas cybertester. Först den 20 juli, när bolaget bad Hugging Face att återkalla behörigheter som redan hade spärrats efter intrånget, stod det klart att händelserna var delar av samma förlopp.

Redogörelsen belägger inte att modellerna var medvetna eller hade egna fientliga avsikter. OpenAI har tidigare uppgett att de var hårt inriktade på att maximera resultatet i ExploitGym. Händelsen visar däremot att separata agentkörningar kunde behandla säkerhetsgränser som hinder, lämna information åt framtida körningar och fortsätta även när en logg uttryckligen identifierade en åtgärd som förbjuden.

Dalton uppgav att flera team nu har lagt annat arbete åt sidan för att förbättra isolering, övervakning och incidenthantering. Företaget ska enligt honom medvetet sakta ned delar av forskningen medan skydden byggs om.

— <em>Fullt automatiserade offensiva förlopp kräver investeringar i ett verkligt fullt automatiserat försvar, och där är vi inte som bransch</em>, sade Dalton.]]></description>
		
		
		
			</item>
		<item>
		<title>OpenAI-modeller bröt sig ur testmiljö – hackade Hugging Face</title>
		<link>https://nyadagbladet.se/teknik/openai-modeller-brot-sig-ut-hackade-hugging-face/</link>
		
		<dc:creator><![CDATA[Markus Andersson]]></dc:creator>
		<pubDate>Wed, 22 Jul 2026 05:23:44 +0000</pubDate>
				<category><![CDATA[Teknik]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[artificiell intelligens]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[Hugging Face]]></category>
		<category><![CDATA[OpenAI]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=235522</guid>

					<description><![CDATA[<p><strong>Ett internt säkerhetstest hos OpenAI övergick i ett verkligt dataintrång. Företagets AI-modeller tog sig ur en isolerad testmiljö, nådde internet och angrep Hugging Face för att komma åt facit till ett cybertest.</strong></p>
<p>OpenAI <a href="https://x.com/OpenAI/status/2079658951264920020" target="_blank" rel="noopener nofollow">meddelade</a> på tisdagen att intrånget utfördes av flera av företagets modeller, däribland GPT-5.6 Sol och en ännu mer avancerad modell som inte har lanserats. De vanliga spärrarna mot avancerad cyberverksamhet hade reducerats för att modellerna skulle kunna testas på maximal nivå.</p>
<p>Företaget beskriver händelsen som en cyberincident utan motstycke. Enligt den preliminära utredningen blev modellerna extremt inriktade på att klara ExploitGym, ett test av förmågan att omvandla verkliga sårbarheter till fungerande angrepp.</p>
<h3>Utnyttjade nolldagssårbarhet för att ta sig ut</h3>
<p>Testerna kördes i en kraftigt isolerad miljö. Modellerna skulle sakna direkt internetåtkomst och bara kunna installera programpaket genom en intern proxy.</p>
<p>Modellerna använde enligt OpenAI stora mängder beräkningskraft för att hitta en väg ut. De upptäckte och utnyttjade en tidigare okänd sårbarhet, en så kallad nolldagssårbarhet, i proxyn. Därefter skaffade de sig högre behörigheter och förflyttade sig genom OpenAI:s testmiljö tills de nådde en maskin med internetanslutning.</p>
<p>Väl ute på internet drog modellerna slutsatsen att Hugging Face kunde ha modeller, datamängder och lösningar som hörde samman med ExploitGym. De sökte därför efter en väg in i företagets verkliga produktionssystem.</p>
<p>I ett av de angrepp som OpenAI beskriver kombinerades stulna inloggningsuppgifter med flera sårbarheter, däribland tidigare okända brister. På så vis fann modellerna en väg att köra kod på Hugging Faces servrar och nå testlösningar i företagets produktionsdatabas.</p>
<p>OpenAI skriver att allt tillgängligt underlag tyder på att modellerna var helt fokuserade på det avgränsade målet att lösa testet. Redogörelsen innebär inte att modellerna hade egna avsikter eller försökte orsaka skada för sin egen skull. Däremot behandlade modellerna de tekniska begränsningarna som hinder som skulle kringgås.</p>
<h3>Över 17 000 händelser i loggarna</h3>
<p>Hugging Face <a href="https://huggingface.co/blog/security-incident-july-2026" target="_blank" rel="noopener nofollow">gick först ut med information om intrånget</a> den 16 juli, men visste då inte vilken AI-modell som låg bakom. Företaget beskrev en autonom agent som hade genomfört tusentals åtgärder över en helg, utnyttjat två sårbarheter för kodkörning i databehandlingen, samlat in åtkomstuppgifter och förflyttat sig mellan interna datorkluster.</p>
<p>Säkerhetsteamet rekonstruerade senare mer än 17 000 registrerade händelser. Ett begränsat antal interna datamängder och flera autentiseringsuppgifter hade nåtts. Hugging Face fann vid sin första redogörelse inga belägg för att allmänt tillgängliga modeller, datamängder eller användartjänster hade manipulerats, men utredde fortfarande om kund- eller partnerdata kunde ha berörts.</p>
<p>OpenAI uppger att både dess eget och Hugging Faces säkerhetsteam upptäckte onormal aktivitet. Hugging Face stoppade angreppet, stängde de utnyttjade vägarna, byggde om komprometterade noder och bytte ut berörda nycklar och åtkomstuppgifter.</p>
<h3>Försvararnas AI stoppades av säkerhetsspärrar</h3>
<p>Incidenten fick också en oväntad följd. När Hugging Face försökte använda ledande kommersiella modeller för att analysera attackloggarna blockerades analysförsöken av modellernas säkerhetssystem. Loggarna innehöll verkliga attackkommandon, skadlig kod och material för fjärrstyrning som tjänsterna inte kunde skilja från ett pågående angrepp.</p>
<p>Företaget genomförde därför analysen lokalt med den kinesiska modellen GLM 5.2, vars öppet tillgängliga parametrar gjorde det möjligt att köra den utan samma spärrar och utan att skicka känsliga uppgifter utanför den egna miljön.</p>
<p>Hugging Face beskriver detta som en obalans mellan angripare och försvarare: angripare kan använda AI utan säkerhetsregler, medan försvarare riskerar att blockeras när de behöver analysera exakt samma slags material.</p>
<h3>Fler modeller har kringgått gränser</h3>
<p>Incidenten kommer kort efter att OpenAI rapporterat om andra problem med modeller som kan arbeta självständigt under lång tid. I ett separat fall hittade en modell en sårbarhet i sin sandlåda och publicerade resultat på Github, trots instruktioner om att bara rapportera internt.</p>
<p>I ett annat test delade en modell upp en autentiseringstoken i flera delar för att undgå en säkerhetsskanner och återskapade den först när den skulle användas. OpenAI pausade då den begränsade interna tillgången och införde övervakning av hela handlingsförlopp i stället för att bara bedöma varje enskild åtgärd.</p>
<p>NyD har tidigare <a href="https://nyadagbladet.se/teknik/openai-slapper-gpt-56-sol-utvalda-forst/">rapporterat</a> om hur OpenAI beskrev GPT-5.6 som ett stort steg framåt inom cybersäkerhet, men samtidigt uppgav att modellerna inte kunde genomföra fullständiga angrepp mot välskyddade system under de då redovisade testerna. Den nya incidenten visar enligt OpenAI att sådana avancerade förmågor nu också kan få konsekvenser i verkliga system.</p>
<h3>Skärper skydden kring framtida tester</h3>
<p>OpenAI uppger att företaget inför striktare begränsningar i sin forskningsmiljö, även om det saktar ned arbetet. Bolaget samarbetar med Hugging Face om den it-forensiska utredningen, har rapporterat nolldagssårbarheten till leverantören och ska förstärka isolering, övervakning och åtkomstkontroller kring framtida tester.</p>
<p>Hugging Faces vd Clem Delangue beskriver händelsen som möjligen den första i sitt slag och framhåller att AI-säkerhet kräver öppet samarbete och bred tillgång till säkerhetsverktyg.</p>
<p>OpenAI betonar att redogörelsen är preliminär. Företaget säger att fler tekniska uppgifter om sårbarheterna och händelseförloppet ska publiceras när den gemensamma utredningen är avslutad.</p>]]></description>
		
		
		
			</item>
		<item>
		<title>OpenAI gör GPT-5.6 tillgänglig för fler</title>
		<link>https://nyadagbladet.se/teknik/openai-gor-gpt-56-tillganglig-for-fler/</link>
		
		<dc:creator><![CDATA[Markus Andersson]]></dc:creator>
		<pubDate>Wed, 08 Jul 2026 08:15:13 +0000</pubDate>
				<category><![CDATA[Teknik]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[artificiell intelligens]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[Sam Altman]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=234823</guid>

					<description><![CDATA[<strong>OpenAI gör GPT-5.6 tillgänglig för fler denna vecka. Efter en begränsad och politiskt känslig förhandslansering släpps nu modellfamiljen Sol, Terra och Luna bredare.</strong>

OpenAI <a href="https://x.com/OpenAI/status/2074704958419792299" target="_blank" rel="noopener nofollow">meddelade</a> på onsdagen att GPT-5.6 Sol, tillsammans med de mindre modellerna Terra och Luna, ska lanseras offentligt på torsdag.

Samtidigt utökas den globala förhandsåtkomsten omgående. Beskedet innebär att den modellfamilj som tidigare bara fanns i begränsad förhandsversion för utvalda kunder och organisationer nu är på väg ut till en betydligt större användarbas.

NyD har tidigare rapporterat om hur lanseringen av GPT-5.6 inleddes i samordning med den amerikanska regeringen. OpenAI bekräftade då att tillgången först skulle ges till en mindre grupp betrodda samarbetspartners, vars deltagande delats med regeringen.
<h3>Tre modeller med olika roller</h3>
GPT-5.6 är inte en enskild modell utan en familj med tre nivåer. Sol är flaggskeppsmodellen och beskrivs av OpenAI som bolagets mest avancerade modell hittills. Terra är tänkt som ett mer balanserat alternativ för vardagligt arbete, medan Luna ska vara snabbare och billigare för stora volymer.

I den första presentationen lyfte OpenAI fram bättre resultat i bland annat programmering, terminalbaserade agentuppgifter, biologi och cybersäkerhet. Bolaget presenterade också nya lägen för mer krävande resonemang och mer omfattande agentuppgifter.

Prissättningen i den tidigare förhandslanseringen låg på 5 dollar per miljon tokens för indata och 30 dollar per miljon tokens för utdata för Sol. Terra prissattes till 2,50 respektive 15 dollar, medan Luna lades på 1 respektive 6 dollar.
<h3>Från statligt samordnad preview till offentlig lansering</h3>
Den bredare lanseringen gör den tidigare frågan om tillgång mer intressant. Innan GPT-5.6 öppnades bredare hade The Information och Reuters rapporterat att Trumpadministrationen ville att OpenAI skulle släppa modellen stegvis av säkerhetsskäl.

OpenAI uppgav därefter själv att förhandsåtkomsten skedde på regeringens begäran, men betonade samtidigt att en sådan process inte bör bli ett långsiktigt normalläge för hur nya AI-modeller släpps.

Därmed hamnar GPT-5.6 mitt i en större konflikt om ledande AI-modeller: de mest avancerade systemen behandlas alltmer som både konsumentteknik, företagsinfrastruktur och säkerhetspolitiska resurser.
<h3>Offentlig lansering – men fortsatt fråga om kontroll</h3>
OpenAI:s nya X-inlägg är kort, men tydligt. Bolaget går från formuleringar om en begränsad förhandsversion till ett offentligt lanseringsdatum och globalt utökad tillgång.
<blockquote class="twitter-tweet">
<p dir="ltr" lang="en">GPT-5.6 Sol, along with Terra and Luna, will launch publicly this Thursday.</p>
We’re expanding preview access globally now. <a href="https://t.co/Uk5HcfSc2e">pic.twitter.com/Uk5HcfSc2e</a>

— OpenAI (@OpenAI) <a href="https://x.com/OpenAI/status/2074704958419792299?ref_src=twsrc%5Etfw">July 8, 2026</a></blockquote>
För användare och utvecklare blir frågan nu hur snabbt Sol, Terra och Luna dyker upp i ChatGPT, API:er och utvecklarverktyg som Codex. För beslutsfattare och konkurrenter är frågan större: vem ska i praktiken kontrollera tillgången till de mest avancerade modellerna när de börjar få strategisk betydelse?

GPT-5.6-lanseringen visar att svaret inte längre bara ges av teknikbolagen själva.]]></description>
		
		
		
			</item>
		<item>
		<title>OpenAI släpper GPT-5.6 – men bara till utvalda först</title>
		<link>https://nyadagbladet.se/teknik/openai-slapper-gpt-56-sol-utvalda-forst/</link>
		
		<dc:creator><![CDATA[Markus Andersson]]></dc:creator>
		<pubDate>Fri, 26 Jun 2026 19:10:41 +0000</pubDate>
				<category><![CDATA[Teknik]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[artificiell intelligens]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[Sam Altman]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=234066</guid>

					<description><![CDATA[<p><strong>OpenAI har inlett en begränsad förhandslansering av GPT-5.6, med flaggskeppsmodellen Sol och två mindre modeller som ska ge utvecklare fler valmöjligheter vad gäller intelligens, hastighet och kostnad. Lanseringen sker i samordning med den amerikanska regeringen.</strong></p>

<p>Modellfamiljen presenterades av OpenAI på fredagen och består av GPT-5.6 Sol, GPT-5.6 Terra och GPT-5.6 Luna. Sol beskrivs som OpenAI:s starkaste modell hittills, Terra som ett mer balanserat alternativ för vardagsarbete och Luna som en snabbare och billigare modell för stora volymer.</p>

<p>OpenAI framhåller att släppet bara är en begränsad förhandsvisning. En mindre grupp betrodda samarbetspartner och organisationer får tillgång via API och Codex, medan bredare tillgång till ChatGPT, Codex och API utlovas “under de kommande veckorna”.</p>
<blockquote class="twitter-tweet" data-width="550" data-dnt="true"><p lang="en" dir="ltr">Introducing a limited preview of GPT-5.6 Sol, our next generation frontier model, as well as GPT-5.6 Terra, a balanced model for efficient, everyday work, and GPT-5.6 Luna, a fast and affordable model for high-volume work.<a href="https://t.co/OoM83SyISN">https://t.co/OoM83SyISN</a></p>&#8212; OpenAI (@OpenAI) <a href="https://x.com/OpenAI/status/2070555272230384038?ref_src=twsrc%5Etfw">June 26, 2026</a></blockquote>


<script async src="https://platform.twitter.com/widgets.js" charset="utf-8"></script>

<p>Lanseringen bekräftar samtidigt den politiska konflikt som det ryktades om tidigare i veckan. Bolaget skriver att modellerna och planerna visades för den amerikanska regeringen före lanseringen, och att förhandsvisningen begränsas på regeringens begäran.</p>

<p>OpenAI betonar att förfarandet inte bör bli normalläge. Ett sådant statligt kontrollsystem för tillgång håller enligt bolaget de bästa verktygen borta från användare, utvecklare, företag, it-säkerhetsexperter och globala partner som behöver dem.</p>

<h3>Tre modeller – tre nivåer</h3>

<p>Den nya namngivningen innebär att siffran 5.6 markerar modellgenerationen, medan Sol, Terra och Luna ska vara mer långlivade kapacitetsnivåer. Sol är flaggskeppet, Terra det bredare arbetsverktyget och Luna den billigaste och snabbaste varianten.</p>

<p>OpenAI uppger att Terra når prestanda i nivå med GPT-5.5 men till halva priset. Luna ska enligt bolaget ge stark kapacitet till den lägsta kostnaden i familjen.</p>

<p>Priset anges per miljon tokens. Sol kostar 5 dollar för indata och 30 dollar för utdata, Terra 2,50 respektive 15 dollar och Luna 1 respektive 6 dollar. För cachelagrad input gäller fortsatt 90 procents rabatt vid läsning, medan skrivning till cache för GPT-5.6 och senare modeller debiteras till 1,25 gånger modellens ordinarie inputpris.</p>

<p>GPT-5.6 inför också en ny resonemangsnivå, “max”, där Sol får mer tid att resonera djupt. Dessutom lanseras ett ultra-läge där underagenter används för att snabba upp komplicerade arbetsflöden.</p>

<h3>Nya rekordresultat i terminalarbete</h3>

<p>OpenAI lyfter särskilt kodning, biologi och cybersäkerhet. I TerminalBench 2.1, som testar kommandoradsarbete där AI-system måste planera, iterera och samordna verktyg, placerar bolaget GPT-5.6 Sol Ultra överst med 91,9 procent. Standardversionen av Sol anges till 88,8 procent.</p>

<blockquote class="twitter-tweet" data-width="550" data-dnt="true"><p lang="en" dir="ltr">GPT‑5.6 Sol sets a new state of the art on Terminal‑Bench 2.1, which tests complex command-line workflows requiring planning, iteration, and tool coordination. <a href="https://t.co/gWA1pzpOmK">pic.twitter.com/gWA1pzpOmK</a></p>&#8212; OpenAI (@OpenAI) <a href="https://x.com/OpenAI/status/2070555276370169969?ref_src=twsrc%5Etfw">June 26, 2026</a></blockquote>


<script async src="https://platform.twitter.com/widgets.js" charset="utf-8"></script>

<p>Jämförelsen är bolagets egen, men visar hur OpenAI vill positionera GPT-5.6: inte bara svar i en chattruta, utan mer omfattande agentuppgifter där modellen styr verktyg, tolkar resultat och fortsätter tills uppgiften är löst.</p>

<p>Även inom det biologiska området beskriver OpenAI tydliga förbättringar. På GeneBench v1, som mäter mer långvariga arbetsflöden inom genomik och kvantitativ biologi, uppges Sol prestera bättre än GPT-5.5 med färre tokens.</p>

<h3>Cybersäkerhet i centrum</h3>

<p>Den mest politiskt känsliga delen av släppet gäller cybersäkerhet. OpenAI beskriver GPT-5.6 Sol som sin mest avancerade modell hittills för säkerhetsarbete, där den kan hjälpa till med sårbarhetsanalys, utveckling av säkerhetsfixar, kodgranskning och defensiva tester.</p>

<p>Bolaget uppger samtidigt att Sol är bättre på att hitta och åtgärda sårbarheter än på att tillförlitligt genomföra fullständiga attacker från början till slut. I systemdokumentationen <a href="http://deploymentsafety.openai.com/gpt-5-6-preview" target="_blank" rel="noopener nofollow">klassas</a> GPT-5.6-familjen som hög kapacitet inom cybersäkerhet och biologi/kemi, men inte som kritisk i någon av de spårade riskkategorierna.</p>

<p>OpenAI skriver att Sol i tester mot Chromium och Firefox kunde identifiera buggar och delar av exploateringskedjor, men inte självständigt skapa en fungerande fullständig exploateringskedja under de testade förhållandena.</p>

<p>Gränsen är viktig. Samma förmåga som kan hjälpa försvarare att hitta svagheter i kritisk infrastruktur kan också, i fel händer, användas för att skala upp angrepp. Därför försöker OpenAI presentera släppet som både ett kapacitetssprång och ett säkerhetstest.</p>

<h3>Flera lager av spärrar</h3>

<p>OpenAI beskriver GPT-5.6 som den mest hårt bevakade lanseringen hittills. Säkerhetsarkitekturen består enligt bolaget av modellträning, realtidsklassificeringar, kontogranskning, differentierad åtkomst, övervakning, efterlevnad, åtgärder och fortsatt testning.</p>

<p>Vid högre risk kan modellens generering pausas medan en större resonemangsmodell granskar konversationen och sammanhanget. Om svaret bedöms otillåtet stoppas det innan det når användaren.</p>

<p>OpenAI uppger också att flaggad aktivitet kan leda till kontogranskning över flera konversationer. Syftet är att skilja normal säkerhetsforskning från mer systematiska försök att använda modellen för otillåten verksamhet.</p>

<p>Bolaget skriver att legitima användare kan få se vissa fördröjningar eller felaktiga blockeringar under förhandsperioden, särskilt i områden där defensiv och offensiv aktivitet liknar varandra tekniskt.</p>

<h3>Automatiska angrepp mot spärrarna</h3>

<p>En central del i säkerhetsarbetet är automatiserad red teaming. OpenAI uppger att mer än 700 000 GPU-timmar, motsvarande A100-kapacitet, lagts på att automatiskt hitta generella säkerhetsbrytningar – angrepp som fungerar över många typer av frågor och sammanhang.</p>

<p>Sådana tester ska enligt bolaget komplettera mänskliga experter och tredjepartstestare. Målet är att hitta generella svagheter i skydden, täppa till dem och sedan lägga in liknande mönster i de löpande utvärderingarna.</p>

<p>Samtidigt medger OpenAI att inget test kan täcka alla produktkonfigurationer, flerstegsangrepp eller verkliga arbetsflöden. Därför behåller bolaget en snabb process för att återskapa, prioritera och åtgärda nya jailbreaks under förhandsperioden.</p>

<h3>Statens roll blir svår att ignorera</h3>

<p>Lanseringen kommer bara dagar efter uppgifter om att Trumpadministrationen ville att OpenAI skulle släppa GPT-5.6 stegvis av säkerhetsskäl. OpenAI:s egen text bekräftar nu kärnan i bilden: modellerna har förhandsvisats för regeringen och tillgången inleds med en grupp partner vars deltagande har delats med staten.</p>

<p>Bolaget beskriver åtgärden som tillfällig och kopplad till arbetet med presidentens cyberorder. Men praktiskt innebär upplägget att Washington får insyn i vilka aktörer som först får tillgång till den starkaste kommersiella AI-modellen.</p>

<p>Det rör sig inte om något formellt licenssystem. OpenAI säger tvärtom att bred tillgång är målet. Ändå visar släppet hur framkantsmodeller, de mest avancerade AI-systemen, snabbt har flyttat från produktlanseringar till säkerhetspolitik.</p>

<p>OpenAI planerar även att lansera GPT-5.6 Sol på Cerebras i juli, med upp till 750 tokens per sekund. Även den tillgången blir inledningsvis begränsad till utvalda kunder när kapaciteten byggs ut.</p>

<p>Frågan är därför inte bara hur smart GPT-5.6 är, utan vem som får använda den först – och på vilka villkor.</p>]]></description>
		
		
		
			</item>
	</channel>
</rss>
