LTX.io, yeni nesil video modeli LTX-2.5‘i duyurdu. Bu yeni sürüm, video üretiminde Dynamic Diffusion Fidelity Rendering teknolojisiyle çığır açıyor. Model, sahne karmaşıklığına göre işlem gücünü dinamik olarak dağıtarak yüz detayları, metin doğruluğu ve hızlı hareket efektlerinde önemli iyileştirmeler sunuyor.
Dynamic Diffusion Fidelity Rendering
LTX-2.5’in en önemli özelliklerinden biri Dynamic Diffusion Fidelity Rendering sistemidir. Bu teknoloji, her kare için sabit bir işlem bütçesi ayırmak yerine, sahne karmaşıklığına göre dinamik kaynak dağılımı yapıyor. Yüz bölgeleri, karmaşık dokular ve hızlı hareket eden nesneler daha fazla hesaplama gücü alırken, sade arka planlar daha az kaynak tüketiyor.
Yeni Diffusion Video Decoder
Modeldeki yeni nesil Diffusion Video Decoder, erken sürümlerde sıkça karşılaşılan erime, gölge ve titreme sorunlarını önemli ölçüde azaltıyor. Bu gelişme, özellikle profesyonel içerik üreticileri için LTX-2.5’i vazgeçilmez kılıyor.
Native Multi-Shot Ozelligi
LTX-2.5’in dikkat çeken bir diğer özelliği ise Native Multi-shot desteği. Kullanıcılar tek bir üretimde birden fazla ardışık sahne oluşturabiliyor ve bu sahneler arasında karakter, ortam, aydınlatma ve görsel stil tutarlılığı korunuyor. Bu özellik, film ve dizi sektöründe büyük ilgi göreceğe benziyor.
Teknik Ozellikler ve Erişilebilirlik
Model, native 4K HDR, EXR giriş/çıkış ve RAW workflow desteği sunuyor. Ayrıca açık ağırlıklar ile yerel dağıtım, kendi verilerinizle fine-tune etme ve LoRA/IC-LoRA desteği mevcut. Minimum VRAM gereksinimi 16GB olarak belirlenmiş; 2 adet GB200 kartında 10 saniyelik bir video yalnızca 6,8 saniyede üretilebiliyor.
LTX, bu modeli bir “World Model” temeli olarak konumlandırıyor. yapay zeka video uretimi alanında yaşanan bu gelişme, sektörde yeni bir rekabet dönemini başlatacak gibi görünüyor. Daha fazla bilgi için AI haberleri sayfamızı takip edebilirsiniz.
Kaynak: @MaxForAI
Henüz yorum yok. İlk yorumu siz yapın!