<?xml version="1.0" encoding="UTF-8"?><?xml-stylesheet type="text/xsl" href="https://nyadagbladet.se/wp-content/plugins/rss-feed-styles/public/template.xsl"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	xmlns:rssFeedStyles="http://www.lerougeliet.com/ns/rssFeedStyles#"
xmlns:media="http://search.yahoo.com/mrss/" >

<channel>
	<title>AI-video &#8211; Nya Dagbladet</title>
	<atom:link href="https://nyadagbladet.se/tag/ai-video/feed/" rel="self" type="application/rss+xml" />
	<link>https://nyadagbladet.se</link>
	<description>Morgondagens Dagstidning!</description>
	<lastBuildDate>Tue, 11 Aug 2026 21:45:50 +0000</lastBuildDate>
	<language>sv-SE</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.1.1</generator>

<image>
	<url>https://nyadagbladet.se/wp-content/uploads/2021/11/cropped-nyd-logo-500-32x32.jpg</url>
	<title>AI-video &#8211; Nya Dagbladet</title>
	<link>https://nyadagbladet.se</link>
	<width>32</width>
	<height>32</height>
</image> 
<rssFeedStyles:reader name="Digg Reader" url="http://digg.com/reader/search/https%3A%2F%2Fnyadagbladet.se%2Ffeed%2F"/><rssFeedStyles:reader name="Feedly" url="http://cloud.feedly.com/#subscription%2Ffeed%2Fhttps://nyadagbladet.se/feed/"/><rssFeedStyles:reader name="Inoreader" url="http://www.inoreader.com/?add_feed=https%3A%2F%2Fnyadagbladet.se%2Ffeed%2F"/><rssFeedStyles:button name="Like" url="https://www.facebook.com/sharer/sharer.php?u=%url%"/><rssFeedStyles:button name="G+" url="https://plus.google.com/share?url=%url%"/><rssFeedStyles:button name="Tweet" url="https://twitter.com/intent/tweet?url=%url%"/>	<item>
		<title>LTX-2.5 flyttar avancerad AI-film till den egna datorn</title>
		<link>https://nyadagbladet.se/teknik/ltx-2-5-ai-video-lokalt-oppen-modell/</link>
		
		<dc:creator><![CDATA[Markus Andersson]]></dc:creator>
		<pubDate>Tue, 11 Aug 2026 21:45:50 +0000</pubDate>
				<category><![CDATA[Teknik]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[AI-video]]></category>
		<category><![CDATA[artificiell intelligens]]></category>
		<category><![CDATA[Lightricks]]></category>
		<category><![CDATA[LTX-2.5]]></category>
		<category><![CDATA[öppen källkod]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=236957</guid>

					<description><![CDATA[<strong>LTX har släppt LTX-2.5, en öppen AI-modell som skapar video och synkroniserat ljud, håller ihop personer och miljöer över flera klipp och kan köras på användarens egen dator. I stället för att låsa filmare och utvecklare till ännu en molntjänst publiceras vikterna, koden och träningsverktygen för lokal körning och egen anpassning.</strong>

Modellen lanserades den 11 augusti och är den hittills största uppgraderingen av LTX:s system för AI-genererad film. Företaget beskriver LTX-2.5 som en 22-miljarders ”världsmodell”: ett system som inte bara framställer enskilda bilder, utan försöker hålla rörelse, rum, ljud, personer och miljöer sammanhängande över tid.

Den stora nyheten för vanliga kreatörer är ägandet. Modellfilerna kan <a href="https://huggingface.co/Lightricks/LTX-2.5" target="_blank" rel="noopener nofollow">laddas ned</a> från Hugging Face och köras lokalt, medan källkod, referensflöden och verktyg för finjustering ligger öppet på Github. Råmaterial, röster och ännu opublicerade projekt behöver därmed inte skickas till ett utomstående AI-bolags servrar.

LTX-2.5 får samtidigt inbyggt stöd från första dagen i ComfyUI, det fria nodbaserade gränssnitt som blivit ett nav för lokal bild- och videogenerering. Det gör vägen från nedladdade modellvikter till ett fungerande visuellt arbetsflöde betydligt kortare än när nya modeller kräver specialskrivna installationer.

På den punkten går LTX längre än flera uppmärksammade konkurrenter. MiniMax H3, som Nya Dagbladet nyligen <a href="https://nyadagbladet.se/teknik/minimax-h3-oppen-videomodell-hemmadator/">skrev</a> om, kan också köras lokalt men har en communitylicens som undantar bland annat EU. LTX:s nya licens gäller globalt och tillåter kostnadsfri kommersiell användning för företag med mindre än tio miljoner dollar i årsomsättning.
<div style="position: relative; padding-bottom: 56.25%; height: 0; overflow: hidden; max-width: 100%; margin: 24px 0;"><iframe style="position: absolute; top: 0; left: 0; width: 100%; height: 100%; border: 0;" title="LTX-2.5: The World Model the World Builds On" src="https://www.youtube.com/embed/ZDfjZae7Da0" allowfullscreen="allowfullscreen"></iframe></div>
<h3>Flera filmscener i ett enda svep</h3>
En av de mest spännande nyheterna är så kallad multiscengenerering. Modellen ska kunna skapa en följd av sammanhängande klipp i en körning och behålla samma karaktärer, miljö, ljus och röster genom klippen. Just sådan kontinuitet har länge varit en av AI-filmens stora svagheter: en person kan byta ansikte, kläder eller röst så fort kameravinkeln ändras.

En särskilt anpassad version av Googles språkmodell Gemma 4 med tolv miljarder parametrar tolkar instruktionerna. LTX uppger att modellen därmed klarar mer komplicerade beskrivningar med flera personer och händelser, samtidigt som en ny funktion själv kan avgöra hur långt klippet behöver vara för att hinna genomföra den efterfrågade handlingen.

Systemet kan användas för text-till-video, bild-till-video och video-till-video. Det stöder även redigering av delar av ett befintligt klipp, styrning med nyckelbilder, läppsynkroniserad dubbning och samtidig generering av bild och ljud. För professionella filmflöden finns stöd för 4K, HDR och EXR-filer i färgsystemet ACES, enligt den officiella <a href="https://ltx.io/blog/the-foundation-film-is-made-on" target="_blank" rel="noopener nofollow">lanseringen</a>.
<h3>Ny metod ska ge skarpare AI-film</h3>
Den tekniska huvudnyheten kallas Diffusion Fidelity Rendering. I stället för att lägga lika mycket datorkraft på varje ögonblick analyserar systemet scenens svårighetsgrad och skapar extra detaljrika nyckelbilder där de behövs mest. Rörelse och grundstruktur byggs först i ett kraftigt komprimerat arbetsutrymme, varefter en separat diffusionsbaserad videodekoder återskapar detaljer i bland annat ansikten och snabba rörelser.

LTX hävdar att detta ger jämnare rörelser, färre visuella fel och bildkvalitet som håller även på en bioduk. På företagets egen modellsida redovisas ett preliminärt automatiserat test där LTX-2.5 Pro hade färre synliga bildfel än nio jämförda modeller. Resultatet är bolagets egen mätning och upplösningarna skiljer sig mellan systemen, så det bör inte betraktas som ett slutgiltigt oberoende prestandatest.

Mer intressant än en enskild topplacering är ändå att samma teknik går att ladda ned. Utvecklare kan bygga egna tillägg, träna LoRA-anpassningar för en viss figur eller filmstil och förändra hela arbetskedjan utan att vänta på att en molnleverantör ska godkänna funktionen.
<h3>Kan köras lokalt – men kräver fortfarande kraft</h3>
Lokal körning betyder inte att LTX-2.5 förvandlar vilken kontorsdator som helst till en filmstudio över natten. Den officiella modellsidan anger 16 gigabyte grafikminne som lägstanivå och företaget lyfter en ensam RTX 5090 som ett praktiskt exempel. För den fulla standardinstallationen anger Github samtidigt omkring 66 gibibyte modellfiler, även om åtta- och fyrabitarsversioner samt avlastning till arbetsminne eller disk kan sänka kraven på grafikminnet.

Det innebär att en kraftfull speldator eller arbetsstation är den realistiska startpunkten för snabbare lokal generering. Men skillnaden mot en låst molntjänst är grundläggande: användaren kan själv välja kompromissen mellan hastighet, bildkvalitet och minnesåtgång, uppgradera hårdvaran och behålla allt material lokalt.
<h3>Öppen – med en tydlig licensgräns</h3>
LTX kallar utgåvan ”open source”, men mer exakt handlar det om öppna modellvikter och öppen kod under LTX-2.x Community License. Licensen tillåter användning, ändringar, vidareutveckling och kommersiellt bruk, men företag med en sammanlagd årsomsättning på minst tio miljoner dollar måste teckna ett betalt avtal för kommersiell användning. Det är därför inte en helt villkorslös standardlicens i samma mening som Apache eller MIT.

För privatpersoner, mindre studior, forskare och de flesta fristående utvecklare är friheten ändå ovanligt konkret. De kan ladda ned modellen, undersöka hur den fungerar, anpassa den till egna data och skapa film utan obligatorisk märkning eller löpande avgifter till en central tjänst.

LTX-2.5 visar därmed en möjlig väg bort från en framtid där all avancerad AI-film kontrolleras av ett fåtal nätplattformar. Den verkliga prövningen börjar när oberoende användare testar kvaliteten på sina egna datorer, men kombinationen av starkare bild, synkroniserat ljud, flera sammanhängande scener och lokal kontroll gör släppet till ett av årets mest intressanta steg för öppen AI-video.]]></description>
		
		
		
		<media:content url="https://www.youtube.com/embed/ZDfjZae7Da0" medium="video" width="1280" height="720">
			<media:player url="https://www.youtube.com/embed/ZDfjZae7Da0" />
			<media:title type="plain">LTX-2.5: The World Model the World Builds On</media:title>
			<media:description type="html"><![CDATA[LTX-2.5 is live, the biggest upgrade yet to the open world model that film, robotics, and real-time worlds already run on. This isn&#039;t a new tool. It&#039;s the sa...]]></media:description>
			<media:thumbnail url="https://nyadagbladet.se/wp-content/uploads/2026/08/ltx-2-5-officiell-1170x600-1.jpg" />
			<media:rating scheme="urn:simple">nonadult</media:rating>
		</media:content>
	</item>
		<item>
		<title>FLUX 3 skapar film med ljud och lär robotar arbeta</title>
		<link>https://nyadagbladet.se/it-overvakning/flux-3-film-ljud-robotar-oppna-vikter/</link>
		
		<dc:creator><![CDATA[Markus Andersson]]></dc:creator>
		<pubDate>Thu, 23 Jul 2026 15:43:13 +0000</pubDate>
				<category><![CDATA[IT/Övervakning]]></category>
		<category><![CDATA[AI-video]]></category>
		<category><![CDATA[artificiell intelligens]]></category>
		<category><![CDATA[Black Forest Labs]]></category>
		<category><![CDATA[FLUX 3]]></category>
		<category><![CDATA[öppen källkod]]></category>
		<category><![CDATA[robotik]]></category>
		<guid isPermaLink="false">https://nyadagbladet.se/?p=235671</guid>

					<description><![CDATA[<strong>Bild, film, ljud – och robotrörelser. Black Forest Labs nya FLUX 3 är byggd för att skapa och förstå allt i samma modell. Videoversionen finns redan i tidig åtkomst, medan en öppen modellvariant utlovas längre fram.</strong>

FLUX-familjen är sedan tidigare känd för bildgenerering. Med FLUX 3 tar det tyska AI-bolaget steget vidare till video med inbyggt ljud, bildredigering och förutsägelser av fysiska handlingar.

Tanken är att samma grundmodell ska lära sig hur världen ser ut, rör sig och låter – i stället för att behandla bild, video och ljud som separata problem. En ljudhändelse ska passa det som händer i filmen, en rörelse ska följa föremålets vikt och nästa bildruta ska vara en rimlig fortsättning på den förra.

Videomodellen kan enligt <a href="https://bfl.ai/announcements/flux-3" target="_blank" rel="noopener nofollow">Black Forest Labs</a> skapa klipp på upp till 20 sekunder med ljud i en enda generering. Den stöder text-till-video, bild-till-video, video-till-video, fortsättning av befintliga klipp, flerspråkig dialog och styrda övergångar mellan nyckelbilder.

[caption id="attachment_235669" align="alignnone" width="640"]<a href="https://nyadagbladet.se/wp-content/uploads/2026/07/flux-3-image-samples-1170.jpg"><img class="size-medium wp-image-235669" src="https://nyadagbladet.se/wp-content/uploads/2026/07/flux-3-image-samples-1170-640x323.jpg" alt="Åtta tidiga bildprover skapade med FLUX 3 i flera olika stilar." width="640" height="323" /></a> Tidiga bildprover från FLUX 3 – från illustration och måleri till produktbild och fotorealism. Bild: Black Forest Labs.[/caption]
<blockquote class="twitter-tweet" data-width="550" data-dnt="true">
<p dir="ltr" lang="en">Introducing FLUX 3.</p>
One multi-modal model for Image, Video, Audio and Action-Prediction. Creations are truer to life in every kind of style.

FLUX 3 Video is now available in early access (link below).

Jointly trained in one unified architecture, our model can be extended to… <a href="https://t.co/voQ5iUJJZY">pic.twitter.com/voQ5iUJJZY</a>

— Black Forest Labs (@bfl_ai) <a href="https://x.com/bfl_ai/status/2080308988961554582?ref_src=twsrc%5Etfw">July 23, 2026</a></blockquote>
<script async src="https://platform.twitter.com/widgets.js" charset="utf-8"></script>
<h3>Samma AI ska också kunna styra robotar</h3>
Den mest oväntade delen av lanseringen finns utanför bildskärmen. En tidig FLUX 3-version har byggts vidare till FLUX-mimic, en modell för robotrörelser som utvecklats tillsammans med mimic robotics och har testats i Audis produktion.

Resonemanget är att en modell som kan skapa trovärdig video redan måste lära sig något om kontakt, rörelse, vikt samt orsak och verkan. Samma förståelse kan sedan användas för att förutse hur en robotarm bör agera i den fysiska världen.

Black Forest Labs uppger att systemen hos Audi har klarat hantering av mjuka och flexibla föremål som varit svåra att automatisera med traditionellt programmerade robotceller. Uppgifterna kommer från bolagen själva och FLUX-mimic befinner sig fortfarande i ett tidigt skede.
<h3>Lovar öppna vikter</h3>
FLUX 3 Video erbjuds nu i tidig åtkomst. Bildgenerering, bildredigering och fler versioner ska rullas ut stegvis efter testning. Black Forest Labs planerar dessutom FLUX 3 Dev, där en multimodal grundmodell ska släppas med öppna vikter för skapande och handlingsprognoser. Något exakt datum har ännu inte angivits.

Det innebär att FLUX 3 kan bli mer än ännu en sluten videotjänst: utvecklare ska kunna bygga vidare på samma grund för bilder, filmer, ljud och robotik. Däremot gäller den öppna planen en kommande modellvariant, inte hela den tidiga videotjänsten.

[caption id="attachment_235670" align="alignnone" width="640"]<a href="https://nyadagbladet.se/wp-content/uploads/2026/07/flux-3-video-evaluation-1170.jpg"><img class="size-medium wp-image-235670" src="https://nyadagbladet.se/wp-content/uploads/2026/07/flux-3-video-evaluation-1170-640x400.jpg" alt="Black Forest Labs preliminära jämförelse av hur ofta testpersoner föredrog FLUX 3 framför andra videomodeller." width="640" height="400" /></a> I Black Forest Labs preliminära jämförelser föredrogs en tidig FLUX 3-version framför flera konkurrerande videomodeller. Bild: Black Forest Labs.[/caption]

I bolagets egna tidiga jämförelser föredrog testpersoner FLUX 3 framför Grok Imagine Video i 69 procent av fallen, Runway Gen-4.5 i 77 procent och Luma Ray 3.2 i 93 procent. Mot Gemini Omni Flash och Seedance 2.0 var resultatet 52 procent. Black Forest Labs betonar att utvärderingarna är preliminära och att både modellen och testmiljön fortfarande utvecklas.

Om satsningen håller vad den lovar kan FLUX 3 bli en ovanlig korsning: en kreativ studio för bild och film, en ljudmodell och en grund för robotstyrning – samlade i samma system.]]></description>
		
		
		
			</item>
	</channel>
</rss>
