<?xml version="1.0" encoding="UTF-8"?><?xml-stylesheet type="text/xsl" href="https://nyadagbladet.se/wp-content/plugins/rss-feed-styles/public/template.xsl"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	xmlns:rssFeedStyles="http://www.lerougeliet.com/ns/rssFeedStyles#"
xmlns:media="http://search.yahoo.com/mrss/" >

<channel>
	<title>Astra &#8211; Nya Dagbladet</title>
	<atom:link href="https://nyadagbladet.se/tag/astra/feed/" rel="self" type="application/rss+xml" />
	<link>https://nyadagbladet.se</link>
	<description>Morgondagens Dagstidning!</description>
	<lastBuildDate>Thu, 03 Sep 2026 20:46:56 +0000</lastBuildDate>
	<language>sv-SE</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1</generator>

<image>
	<url>https://nyadagbladet.se/wp-content/uploads/2021/11/cropped-nyd-logo-500-32x32.jpg</url>
	<title>Astra &#8211; Nya Dagbladet</title>
	<link>https://nyadagbladet.se</link>
	<width>32</width>
	<height>32</height>
</image> 
<rssFeedStyles:reader name="Digg Reader" url="http://digg.com/reader/search/https%3A%2F%2Fnyadagbladet.se%2Ffeed%2F"/><rssFeedStyles:reader name="Feedly" url="http://cloud.feedly.com/#subscription%2Ffeed%2Fhttps://nyadagbladet.se/feed/"/><rssFeedStyles:reader name="Inoreader" url="http://www.inoreader.com/?add_feed=https%3A%2F%2Fnyadagbladet.se%2Ffeed%2F"/><rssFeedStyles:button name="Like" url="https://www.facebook.com/sharer/sharer.php?u=%url%"/><rssFeedStyles:button name="G+" url="https://plus.google.com/share?url=%url%"/><rssFeedStyles:button name="Tweet" url="https://twitter.com/intent/tweet?url=%url%"/>	<item>
		<title>OpenAI lanserar GPT-6 Astra – ”Välkommen till AGI-eran”</title>
		<link>https://nyadagbladet.se/teknik/openai-gpt-6-astra-agi-cybersakerhet/</link>
		
		<dc:creator><![CDATA[Markus Andersson]]></dc:creator>
		<pubDate>Thu, 03 Sep 2026 19:05:28 +0000</pubDate>
				<category><![CDATA[Teknik]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[AI-agenter]]></category>
		<category><![CDATA[AI-modell]]></category>
		<category><![CDATA[Astra]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[cybersäkerhet]]></category>
		<category><![CDATA[GPT-6]]></category>
		<category><![CDATA[OpenAI]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=239300</guid>

					<description><![CDATA[<p><strong>OpenAI lanserar GPT-6 Astra och talar om början på en ny epok för artificiell intelligens. Modellen gör stora språng inom forskning, datoranvändning och cybersäkerhet – men kostar betydligt mer och väcker nya frågor om kontroll.</strong></p>

<p>Lanseringen skedde på torsdagen efter en period av begränsade tester. Astra blir först tillgänglig för företagskunder i OpenAI:s Daybreak-program. Därefter ska modellen rullas ut till användare av Plus, Pro, Business och Enterprise samt via OpenAI:s programmeringsgränssnitt och Amazon Web Services ”under de kommande dagarna”, <a href="https://thenewstack.io/openai-gpt6-astra-benchmarks/" rel="nofollow noopener" target="_blank">skriver</a> teknikpublikationen The New Stack, som deltog i en pressgenomgång inför lanseringen.</p>

<p>OpenAI-chefen Greg Brockman gick längre än företagets vanliga språkbruk och avslutade genomgången med orden ”Välkommen till AGI-eran”. Samtidigt medgav han att AGI – generell artificiell intelligens – fortfarande är ett ”grått och otydligt” begrepp. Uttalandet var därför inte en formell deklaration om att OpenAI bevisat mänsklig generell intelligens i en maskin.</p>

<blockquote class="twitter-tweet"><p lang="en" dir="ltr">This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast.</p>— OpenAI (@OpenAI) <a href="https://x.com/OpenAI/status/2095595741528125780">September 3, 2026</a></blockquote>

<p>I sin officiella lanseringsartikel <a href="https://openai.com/index/gpt-6-astra/" rel="nofollow noopener" target="_blank">beskriver</a> OpenAI Astra som en datoragent som bland annat kan fylla i webbformulär, uppdatera kundregister, organisera kalendrar, skapa webbplatser samt självständigt installera och testa program. Modellen ska även kunna genomföra research och skriva sammanfattningar direkt i användarens e-post eller dokumentredigerare.</p>

<p>Bakom prestandalyftet ligger OpenAI:s största träningskörning hittills. Enligt bolaget tränades Astra på mer än 100 000 grafikprocessorer vid Stargate-anläggningen i Texas. Det är också första gången tidigare OpenAI-modeller ska ha spelat en betydande roll i att övervaka träningen av en ny generation.</p>

<h3>Stora språng utanför programmering</h3>

<p>På OpenAI:s egna tester är förbättringarna störst inom matematik, naturvetenskap och uppgifter där modellen måste använda program och verktyg. Astra får enligt den slutliga lanseringsartikeln 99,9 procent på ARC-AGI-3, 97,6 procent på den svåraste nivån av FrontierMath och 64,6 procent på Terminal-Bench Science. På det sistnämnda testet nådde föregångaren GPT-5.6 Sol 22,4 procent.</p>

[caption id="attachment_239299" align="alignnone" width="1024"]<a href="https://nyadagbladet.se/wp-content/uploads/2026/09/openai-gpt6-astra-benchmarks-1024x880-1.jpg"><img class="size-large wp-image-239299" src="https://nyadagbladet.se/wp-content/uploads/2026/09/openai-gpt6-astra-benchmarks-1024x880-1.jpg" alt="Tabell med OpenAI:s benchmarkresultat för GPT-6 Astra jämfört med andra AI-modeller" width="1024" height="880" /></a> OpenAI:s tidigare jämförelsetabell visar 98,6 procent på ARC-AGI-3, medan den slutliga lanseringsartikeln anger 99,9 procent. Övriga redovisade Astra-värden i tabellen omfattar 97,6 procent på FrontierMath Tier 4 och 64,6 procent på Terminal-Bench Science. Bild: OpenAI.[/caption]

<p>Siffrorna kräver ändå försiktighet. OpenAI har tidigare visat att ett system som låter modellen behålla sitt resonemang mellan stegen och sammanfatta äldre historik kan tredubbla resultatet på ARC-AGI-3 utan att själva grundmodellen byts ut. Astras toppresultat mäter därför både modellen och OpenAI:s omgivande agentsystem.</p>

<p>På FrontierMath finns en annan reservation. Organisationen Epoch AI, som driver testet, <a href="https://epoch.ai/benchmarks/frontiermath-tier-4-v2" rel="nofollow noopener" target="_blank">uppger</a> att OpenAI finansierat utvecklingen och har exklusiv tillgång till en del av de privata uppgifterna. Astra har ännu inte heller lagts till på flera oberoende offentliga topplistor.</p>

<p>Inom programmering är ledningen mindre tydlig. OpenAI redovisar 74,1 procent på DeepSWE v1.1, medan den offentliga <a href="https://deepswe.datacurve.ai/" rel="nofollow noopener" target="_blank">topplistan</a> placerar Gemini 3.8 Flash och Claude Opus 5 på omkring 74 procent och GPT-5.6 Sol på 73 procent. Felmarginalerna överlappar, vilket gör det svårt att utse en ensam vinnare.</p>

<h3>Minnet sträcker sig över längre arbeten</h3>

<p>För användarna kan Astras nya minnesfunktioner bli viktigare än enskilda testresultat. Dagens kodagenter sammanfattar ofta äldre delar av ett långt arbete när kontextfönstret fylls. Då kan avgörande detaljer försvinna: varför en tidigare lösning misslyckades, vilka tester som kördes eller vilket krav användaren lade till i början.</p>

<p>Astra kan i stället föra anteckningar mellan kontextfönster och söka i tidigare meddelanden och verktygsresultat. Funktionen är inledningsvis experimentell i Codex, men ska enligt OpenAI bli standard för Astra under de kommande veckorna. Modellen kan också ställa en fråga till användaren och fortsätta med de delar av arbetet som inte beror på svaret. Tidigare kontextfönster förblir sökbara, så modellen kan återfinna krav och testresultat som inte kom med i de löpande anteckningarna.</p>

<p>OpenAI visade under pressgenomgången hur Astra använde bland annat Excel, Blender, Power BI och elektronikkonstruktionsprogrammet KiCad. På OSWorld V2-Offline, som mäter arbete i vanliga datorprogram, uppges modellen ha höjt resultatet från 65,7 till 72,6 procent och minskat tiden per uppgift med omkring 47 procent, från cirka 75 till 40 minuter. Tillsammans med ett uppdaterat Codex-system ska Astra dessutom slutföra uppgifter 1,9 gånger snabbare än GPT-5.6 Sol på Mind2Web.</p>

<h3>Dyrare än föregångaren</h3>

<p>Prestandan kommer med ett tydligt prispåslag. Via programmeringsgränssnittet kostar Astra 10 dollar per miljon indatatokens och 50 dollar per miljon utdatokens. Det är två och en halv gånger GPT-5.6 Sols tillfälliga pris, enligt The New Stack. OpenAI erbjuder även ett snabbläge som uppges ge upp till 2,5 gånger högre hastighet, men till dubbla standardpriset. Pro-, Business- och Enterprise-kunder ska dessutom få tillgång till en särskild Astra Pro-version.</p>

<p>OpenAI hävdar att priset per löst uppgift är viktigare än kostnaden per token, eftersom Astra i flera tester använder färre steg och mindre text. Bolaget har dock inte redovisat tillräckligt med data för att visa att effektivitetsvinsten väger upp hela prisskillnaden i vanligt arbete.</p>

<h3>Första OpenAI-modellen på kritisk cybernivå</h3>

<p>Den mest omvälvande förbättringen finns inom cybersäkerhet. OpenAI klassar Astra som sin första modell på nivån ”kritisk” cyberförmåga. Med rätt verktyg och åtkomst ska den kunna hitta tidigare okända säkerhetshål och bygga fungerande angrepp mot väl skyddade system utan att en människa styr varje steg.</p>

<p>I företagets tester fick Astra full poäng på ExploitBench och hittade två tidigare okända sårbarheter som kunde kombineras till en angreppskedja. De mest avancerade funktionerna släpps därför inte fritt. Vanliga användare får en version som stoppar vissa typer av arbete, medan utvalda säkerhetsforskare ges vidare åtkomst genom Daybreak Blue.</p>

<p>På det nya SRE-Bench, som mäter omvänd analys av program utan tillgång till källkoden, löste Astra enligt OpenAI 88,0 procent av uppgifterna vid första försöket och 99,2 procent inom fyra försök. I expertledda tester utan produktionsskydd kunde modellen dessutom använda okända sårbarheter för att köra kod i härdade webbläsare och skapa angrepp som höjer behörigheten i härdade operativsystem.</p>

<p>Begränsningarna kan samtidigt drabba legitimt arbete. OpenAI varnar för att användare kan möta fördröjningar, pauser eller stopp när systemet misstänker cybermissbruk – även vid uppgifter som inte verkar handla om cybersäkerhet.</p>

<h3>Mer lydig – men svårare att övervaka</h3>

<p>OpenAI beskriver Astra som sin mest anpassade modell hittills. I ett test med avsiktligt svåra eller omöjliga cyberuppgifter gick en oskyddad GPT-5.6 Sol utanför det tillåtna målet i 48,2 procent av fallen. Astra gjorde inga sådana försök.</p>

<p>I ett separat internt stresstest för datoranvändning redovisar bolaget 2,4 procent felanpassade utfall för Astra, jämfört med 22,0 procent för GPT-5.6 Sol. OpenAI uppger också att Astra var tre gånger mindre benägen än Sol att lämna missvisande besked om vad modellen kan göra.</p>

<p>Men samma modell är svårare att följa. Företaget uppger att Astras nedskrivna resonemang blev mindre lättövervakat i tester som uttryckligen försökte framkalla undvikande beteende. OpenAI:s forskningschef Jakub Pachocki sade därför att bolaget kommer att hålla tillbaka ytterligare uppskalning tills det återfått tillräckligt förtroende för övervakningen.</p>

<p>Problemet går till kärnan i lanseringen. OpenAI vill ge modellen längre arbetsminne, fler verktyg och större handlingsutrymme, samtidigt som företaget medger att insynen inte utvecklas lika snabbt som intelligensen. NyD har tidigare <a href="https://nyadagbladet.se/teknik/openai-missade-ai-agenternas-hemliga-chatt/">rapporterat</a> om hur OpenAI missade interna AI-agenters kommunikation i flera veckor – ett exempel på hur kontrollsystem kan halka efter när modellerna blir mer självständiga.</p>

<p>Om Astra verkligen markerar början på AGI-eran går inte att avgöra med de tester som OpenAI presenterat. Lanseringen visar däremot att gränsen flyttats: från modeller som främst svarar på frågor till system som kan arbeta i timmar, använda datorprogram, bedriva forskning och hitta sårbarheter med allt mindre mänsklig ledning.</p>
]]></description>
		
		
		
			</item>
	</channel>
</rss>
