<?xml version="1.0" encoding="UTF-8"?><?xml-stylesheet type="text/xsl" href="https://nyadagbladet.se/wp-content/plugins/rss-feed-styles/public/template.xsl"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	xmlns:rssFeedStyles="http://www.lerougeliet.com/ns/rssFeedStyles#"
xmlns:media="http://search.yahoo.com/mrss/" >

<channel>
	<title>ComfyUI &#8211; Nya Dagbladet</title>
	<atom:link href="https://nyadagbladet.se/tag/comfyui/feed/" rel="self" type="application/rss+xml" />
	<link>https://nyadagbladet.se</link>
	<description>Morgondagens Dagstidning!</description>
	<lastBuildDate>Mon, 03 Aug 2026 08:02:35 +0000</lastBuildDate>
	<language>sv-SE</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1</generator>

<image>
	<url>https://nyadagbladet.se/wp-content/uploads/2021/11/cropped-nyd-logo-500-32x32.jpg</url>
	<title>ComfyUI &#8211; Nya Dagbladet</title>
	<link>https://nyadagbladet.se</link>
	<width>32</width>
	<height>32</height>
</image> 
<rssFeedStyles:reader name="Digg Reader" url="http://digg.com/reader/search/https%3A%2F%2Fnyadagbladet.se%2Ffeed%2F"/><rssFeedStyles:reader name="Feedly" url="http://cloud.feedly.com/#subscription%2Ffeed%2Fhttps://nyadagbladet.se/feed/"/><rssFeedStyles:reader name="Inoreader" url="http://www.inoreader.com/?add_feed=https%3A%2F%2Fnyadagbladet.se%2Ffeed%2F"/><rssFeedStyles:button name="Like" url="https://www.facebook.com/sharer/sharer.php?u=%url%"/><rssFeedStyles:button name="G+" url="https://plus.google.com/share?url=%url%"/><rssFeedStyles:button name="Tweet" url="https://twitter.com/intent/tweet?url=%url%"/>	<item>
		<title>Kinesiska MiniMax öppnar unik videomodell för hemmadatorn</title>
		<link>https://nyadagbladet.se/teknik/minimax-h3-oppen-videomodell-hemmadator/</link>
		
		<dc:creator><![CDATA[Markus Andersson]]></dc:creator>
		<pubDate>Mon, 03 Aug 2026 09:15:07 +0000</pubDate>
				<category><![CDATA[Teknik]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[artificiell intelligens]]></category>
		<category><![CDATA[ComfyUI]]></category>
		<category><![CDATA[Kina]]></category>
		<category><![CDATA[MiniMax]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=236335</guid>

					<description><![CDATA[<strong>Det kinesiska AI-labbet MiniMax har släppt vikterna till videomodellen H3, som kan förena text, bilder, filmer och ljud i samma skapandeprocess. Genom en samtidig integration i ComfyUI ska den avancerade modellen kunna köras på en vanlig men kraftfull hemdator – ett nytt exempel på hur kinesiska utvecklare flyttar fram positionerna med öppna AI-modeller.</strong>

MiniMax lade ut modellfilerna den 2 augusti och redan följande morgon fanns inbyggt stöd i det fria bild- och videogränssnittet ComfyUI. I stället för att vara hänvisad till en avgiftsbelagd molntjänst kan en användare i princip ladda ned vikterna, bygga egna arbetsflöden och låta känsligt material stanna på den egna datorn.

Lanseringen följer ett mönster som blivit allt tydligare efter DeepSeeks genombrott. Kinesiska laboratorier som Alibaba Qwen, DeepSeek, Moonshot och MiniMax har gjort öppna vikter, låga priser och snabb spridning bland utvecklare till ett konkurrensmedel mot amerikanska bolag som främst erbjuder sina starkaste modeller genom låsta nättjänster. Nya Dagbladet har tidigare <a href="https://nyadagbladet.se/teknik/kinesisk-ai-modell-utmanar-amerikanska-jattar-till-en-brakdel-av-priset/">uppmärksammat</a> hur samma strategi pressat priserna för språkmodeller.

För H3 krävdes dock omfattande optimering innan hemmakörning blev realistisk. ComfyUI <a href="https://blog.comfy.org/p/minimax-h3-day-0-support-in-comfyui" target="_blank" rel="noopener nofollow">beskriver</a> hur minnesbehovet för den minsta modellvarianten minskats från 123,6 till 42,5 gigabyte genom beskärning av parametrar, åttabitarskomprimering och dynamisk avlastning till datorns arbetsminne. Enligt utvecklarna gör det möjligt att köra modellen med ett Nvidia RTX 3060, även om hastigheten i praktiken också beror på mängden arbetsminne och en snabb lagringsenhet.
<h3>Fem uppgifter i samma modell</h3>
Det mest utmärkande är inte enbart bildkvaliteten, utan att H3 samlar fem tidigare åtskilda uppgifter. Modellen kan skapa video från en textbeskrivning, animera en stillbild, styra både första och sista bildrutan, överföra motiv, rörelser eller röster från referensmaterial samt redigera ett befintligt klipp utan att börja om från början.

Användaren kan exempelvis ange en bild för personen, en film för kamerarörelsen och ett ljudklipp för rösten, och därefter beskriva hur delarna ska kombineras. Den officiella dokumentationen anger stöd för upp till nio referensbilder, tre videoklipp och tre ljudklipp inom samma uppdrag. Resultatet kan vara mellan fyra och 15 sekunder långt, med 24 bilder per sekund och stereoljud.
<blockquote class="twitter-tweet" data-width="550" data-dnt="true">
<p dir="ltr" lang="en">MiniMax H3 is native in ComfyUI, day zero with the weights.

Model highlights:

→ Text-to-video, prompt only

→ Image-to-video

→ First-and-last-frame - control the opening frame, the closing frame, or both

→ Reference-to-video - carry a subject, a motion, or a voice… <a href="https://t.co/1ac09WsHBs">pic.twitter.com/1ac09WsHBs</a></p>
— ComfyUI (@ComfyUI) <a href="https://x.com/ComfyUI/status/2084110113078751465?ref_src=twsrc%5Etfw">August 3, 2026</a></blockquote>
<script async src="https://platform.twitter.com/widgets.js" charset="utf-8"></script>

MiniMax <a href="https://www.minimax.io/blog/minimax-h3" target="_blank" rel="noopener nofollow">skriver</a> att syftet är att gå från specialiserade verktyg till en generell modell som förstår relationen mellan flera medietyper. I oberoende användaromröstningar hos Artificial Analysis placerar sig H3 för närvarande högst bland testade modeller för videoredigering, medan den ligger bland de tre främsta för både text-till-video och bild-till-video.
<h3>Öppna vikter – men inte hela systemet</h3>
Öppna vikter betyder att de tränade parametrarna går att ladda ned och undersöka, men inte att hela utvecklingsprocessen är öppen. MiniMax har inte publicerat träningsdata eller fullständig träningskod. Två viktiga delar av den kompletta H3-kedjan hålls dessutom tills vidare på företagets servrar.

Den lokala basmodellen skapar video i 768p. Företagets system för att tolka komplicerade kombinationer av referensmaterial, H3-Context-IR, och steget som återskapar filmen i 2K, H3-Regenerate-2K, ingår inte i den öppna utgåvan. Den som vill återskapa hela den officiella 2K-processen måste därför fortfarande använda MiniMax programmeringsgränssnitt.

Även licensen innehåller en märklig begränsning. MiniMax H3 Community License undantar EU, Storbritannien, USA och Sydkorea från sitt normala tillämpningsområde och hänvisar användare i dessa regioner till att söka ett separat tillstånd. Tekniskt går modellfilerna ändå att ladda ned och köra lokalt även i Sverige, utan att någon central nättjänst avgör åtkomsten. För vanliga användare med en tillräckligt kraftfull dator innebär släppet därför en konkret möjlighet att själva prova avancerad AI-video. Licensens geografiska undantag lämnar samtidigt européer med sämre och mer osäkra formella villkor än användare i stora delar av övriga världen.
<h3>Kinas öppna ekosystem växer</h3>
Trots dessa begränsningar illustrerar H3 en större förskjutning. Reuters rapporterade tidigare i år att kombinationen av öppen tillgång, stark prestanda och låga kostnader blivit kännetecknande för kinesiska grundmodeller. En rapport från den amerikanska kongressens granskningskommission för relationerna med Kina konstaterade samtidigt att kinesiska modeller under 2025 gick om amerikanska i sammanlagda nedladdningar på Hugging Face, medan Qwen-familjen fått fler än 100 000 vidareutvecklingar.

H3 för över samma idé till avancerad videogenerering: inte bara billig åtkomst genom ett nätprogram, utan modellfiler som utvecklare kan bygga vidare på och vanliga kreatörer kan ladda ned och köra utan att lämna över sitt material till en central tjänst. Om MiniMax öppnar de återstående komponenterna och förbättrar licensvillkoren kan släppet därför få större betydelse än ännu en imponerande demonstrationsfilm.]]></description>
		
		
		
			</item>
		<item>
		<title>Ideogram släpper öppen AI-modell – kan köras lokalt</title>
		<link>https://nyadagbladet.se/teknik/ideogram-4-ai-bildmodell-lokal-korning/</link>
		
		<dc:creator><![CDATA[Redaktionen]]></dc:creator>
		<pubDate>Wed, 03 Jun 2026 21:45:26 +0000</pubDate>
				<category><![CDATA[Teknik]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[artificiell intelligens]]></category>
		<category><![CDATA[bildgenerering]]></category>
		<category><![CDATA[ComfyUI]]></category>
		<category><![CDATA[Hugging Face]]></category>
		<category><![CDATA[Ideogram]]></category>
		<category><![CDATA[öppen källkod]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=232328</guid>

					<description><![CDATA[<p><strong>Ideogram släpper sin första öppna AI-bildmodell. Ideogram 4.0 kan laddas ned, anpassas och köras lokalt – en lansering som gör avancerad bildgenerering mer tillgänglig för vanliga användare med kraftfulla konsumentdatorer.</strong></p>
<p>AI-bildbolaget Ideogram, som gjort sig känt för ovanligt bra text i genererade bilder, presenterade på onsdagen Ideogram 4.0 som företagets första öppna modell för att skapa bilder utifrån text. Bolagets budskap är att modellen inte bara ska användas i Ideograms egen tjänst, utan också kunna laddas ned, anpassas med eget material och köras på egen hårdvara.</p>
<p>Det gör lanseringen särskilt intressant för kreatörer, utvecklare och teknikvana användare som vill köra bildmodeller lokalt i stället för att vara helt beroende av låsta molntjänster. För svenska användare kan det handla om att experimentera med affischer, logotyper, produktbilder och texttunga designutkast på den egna datorn, förutsatt att grafikkortet är tillräckligt starkt.</p>
<p>Samtidigt är Ideogram 4.0 inte en helt fri modell. Modellfilerna finns på Hugging Face, men åtkomsten kräver registrering och licensen anges som Ideogram 4 Non-Commercial, alltså för icke-kommersiellt bruk. Den praktiska friheten handlar därför främst om att kunna köra modellen lokalt, experimentera och anpassa den – inte om fri kommersiell användning utan villkor.</p>
<h3>Byggd för text och layout</h3>
<p>I företagets <a href="https://github.com/ideogram-oss/ideogram4" target="_blank" rel="noopener">kodarkiv på GitHub</a> beskrivs Ideogram 4 som en text-till-bild-modell med 9,3 miljarder parametrar, tränad från grunden och inte genom finjustering eller destillering av en befintlig modell. Två mer kompakta versioner listas: NF4 för CUDA och FP8 med bredare hårdvarustöd.</p>
<p>Ideograms främsta styrka är fortfarande text i bild. Där många bildmodeller misslyckas med bokstäver, menyer, affischer och etiketter lyfter bolaget fram korrekt textåtergivning, 2K-upplösning, genomskinlig bakgrund och mer exakt layoutstyrning som huvudnyheter.</p>
<!-- wp:html -->
<blockquote class="twitter-tweet">
<p dir="ltr" lang="en">Introducing Ideogram 4.0: the best open image model in the world.<br /><br />Think it. Make it. Own it.<br /><br />Download the weights, fine-tune on your own data, and run it on your hardware. Live on every Ideogram plan and the API today. <a href="https://t.co/AdH9hfSEdb">pic.twitter.com/AdH9hfSEdb</a></p>
— Ideogram (@ideogram_ai) <a href="https://x.com/ideogram_ai/status/2062202208700313872?ref_src=twsrc%5Etfw">June 3, 2026</a></blockquote>
<!-- /wp:html -->
<p>Modellen kan styras via strukturerade instruktioner i JSON-format. I stället för att bara skriva en vanlig instruktion kan användaren ange färgpaletter, objekt, textytor och koordinater för hur olika delar ska placeras. Ideogram <a href="https://github.com/ideogram-oss/ideogram4" target="_blank" rel="noopener">skriver</a> att modellen tränats med bildutsnitt och beskrivningar som gör att den bättre förstår var objekt, text och layoutelement hör hemma.</p>
<p>För praktiskt designarbete är det just kontrollen – inte bara bildkvaliteten – som avgör om verktyget kan användas i det dagliga arbetet. Ett verktyg som kan återge läsbar text, placera objekt mer förutsägbart och skapa genomskinliga bilddelar är mer användbart i professionella sammanhang än en modell som enbart gör visuellt slående bilder.</p>
<h3>Konsumenthårdvara i centrum</h3>
<p>Den viktigaste nyheten är därför inte bara att Ideogram vill konkurrera med OpenAI och Google i bildkvalitet. Det handlar också om att en avancerad bildmodell nu görs tillgänglig på ett sätt som kan flytta delar av användningen från molnet till lokala datorer.</p>
<p>För vanliga användare är tröskeln fortfarande högre än för en webbtjänst. Modellen kräver nedladdning, rätt programmiljö och tillräckligt kraftfull dator. Men lokalt körbara modeller har redan blivit en viktig del av AI-kulturen kring verktyg som ComfyUI, där användare bygger egna arbetsflöden och kombinerar flera modeller och tillägg.</p>
<p>ComfyUI, som fick stöd för Ideogram 4.0 från start, <a href="https://blog.comfy.org/p/ideogram-4-day-0-support-in-comfyui" target="_blank" rel="noopener">beskriver</a> lanseringen som en stor nyhet för användare som väntat på en öppen modell som klarar affischer, layouter och läsbar text utan att alla instruktioner måste skickas till ett låst eller molnbaserat API.</p>
<h3>Högt rankad bland öppna AI-modeller</h3>
<p>Ideogram hävdar att 4.0 är den högst rankade öppna text-till-bild-modellen på DesignArena, en oberoende rankning för grafiskt skapande. På den totala listan ligger den bakom stängda modeller från OpenAI och Google, men före andra öppna modeller, enligt bolagets redovisning.</p>
<p>I GitHub-materialet hänvisar Ideogram även till ett blindtest av modellens förmåga att skapa text i bild från ContraLabs, där tio professionella designers fick jämföra modeller. Ideogram 4 valdes som bästa modell i 47,9 procent av fallen, före Gemini 3.1 Flash Image Preview, FLUX.2 max och Grok Imagine 1.0. Samma designers gav också Ideogram 4 högst betyg på frågan om modellen skulle användas i riktiga kunduppdrag.</p>
<p>Resultaten bör tolkas med viss försiktighet. Flera mätningar kommer från eller återges av bolaget självt, och bildmodeller är svåra att jämföra objektivt eftersom resultatet påverkas kraftigt av instruktioner, urval och användningsfall. Men riktningen är tydlig: öppna modeller blir snabbt bättre på områden som tidigare krävde stängda tjänster.</p>
<h3>Finns på flera plattformar</h3>
<p>Ideogram 4.0 riktar sig inte bara till utvecklare som vill arbeta direkt med modellfilerna. Enligt bolaget finns modellen även i Ideograms egna abonnemang, via företagets API och hos partners som Hugging Face, ComfyUI, fal, Runware, Magnific, Krea, Leonardo, Picsart, Cloudflare och Replicate.</p>
<!-- wp:html -->
<blockquote class="twitter-tweet">
<p dir="ltr" lang="en">Ideogram 4.0 pushes the frontier of design with:<br />- Dense, accurate text rendering<br />- Native 2K resolution<br />- Native background transparency<br />- Precise layout control<br /><br />Editable text, movable layers, and full image editing are coming soon. <a href="https://t.co/EHZ2NFEb41">pic.twitter.com/EHZ2NFEb41</a></p>
— Ideogram (@ideogram_ai) <a href="https://x.com/ideogram_ai/status/2062202271367336383?ref_src=twsrc%5Etfw">June 3, 2026</a></blockquote>
<!-- /wp:html -->
<p>Det breda partnerstödet är viktigt. För en modell som riktar sig till design, marknadsföring och innehållsproduktion räcker det inte att finnas på en modellhub. Den måste också finnas där kreatörer redan arbetar – i verktyg baserade på noder, API-flöden, designplattformar och automatiserade arbetsflöden.</p>
<p>Den mer långsiktiga frågan är hur mycket av marknaden för generativ AI som flyttas från låsta bildtjänster till modeller som användare kan anpassa och köra själva. För svenska kreatörer, mindre bolag och teknikintresserade privatpersoner kan det handla både om kostnad, dataskydd och kontroll över arbetsflödet.</p>
<p>Samtidigt ökar öppna bildmodeller de befintliga riskerna. När högkvalitativ bildgenerering, text i bild och lokal anpassning blir enklare behövs tydligare rutiner för vattenmärkning eller märkning av AI-genererat innehåll, upphovsrätt och varumärkesskydd. Ideogram 4.0 visar hur snabbt tekniken mognar – men också hur snabbt ansvaret flyttar när verktygen lämnar de stängda plattformarna.</p>]]></description>
		
		
		
			</item>
	</channel>
</rss>
