Black Forest Labs, görüntü, video ve ses verilerinden öğrenen bir çok modlu temel model olan Flux 3'ü yayınladı. Model, video üretiminde doğal ses entegrasyonuna ilk kez sahip, maksimum 20 saniye uzunluğunda sesiyle birlikte video oluşturabiliyor.\n\nBlack Forest Labs'in kendi testlerine göre Flux 3, sektör lideri Seedance 2.0'ın hafif ötesine konumlanıyor ancak bağımsız değerlendirme sonuçları henüz mevcut değil. Şirket, uzun vadede bir dünya modeli (world model) inşa etme hedefine sahip ve Flux 3'ü robotik görevlerde test etmeye zaten başlamış durumda.
Black Forest Labs Flux 3: Video Üretiminde Doğal Ses Desteği
Black Forest Labs tarafından geliştirilen Flux 3, görüntü, video ve ses verilerinden öğrenen çok modlu bir temel model olarak ilk kez doğal sesiyle video üretebiliyor. Model, 20 saniyeye kadar video oluşturabiliyor.
Bu haber The Decoder ↗ kaynağındaki içerikten derlenerek hazırlanmıştır.
İlgili Haberler

Neill Blomkamp, "Nightborne" Adlı İlk Yapay Zeka Filmi Yayınladı

Google resim aramasını kişisel ilgi alanlarına göre yeniden tasarladı

Samsung CEO: Yapay Zekanın Geleceği İnsan Odaklı Tasarımda Yatıyor

Meta, Muse Image görsel üretim modelini tanıttı

Cohere, Arapça Konuşma Tanıma için Açık Kaynak Model Yayınladı
