ByteDance Sederance 2.5, video ve audio sentezini birleştirilmiş bir modelde sunan yeni bir AI video generation sistemi. Model, 30 saniyeye kadar uzunlukta video klipleri doğrudan ses eşliğinde üretebiliyor; bu, Google'ın Gemini Omni Flash modelinin 10 saniyelik sınırının üç katı.\n\nKullanıcılar giriş olarak onlarca görüntü, video ve ses dosyasını referans malzeme olarak sisteme besleyebiliyor. Model bu çeşitli medya girdilerini işleyerek tutarlı, eşleştirilmiş video-ses çıktısı üretiyor.\n\nAdvertising ve content creation ekipleri için sistem, klipler üzerindeki manuel kurgu ve senkronizasyon sürecini önemli ölçüde basitleştirebilir. Tek seferde görsel ve işitsel öğelerin birleştirilmiş şekilde üretilmesi, iteratif kurgu döngüsünü ortadan kaldırarak üretim hızını artırabilir.
ByteDance Sederance 2.5: 30 Saniye Video ve Ses Üretimi Tek Adımda
ByteDance'ın yeni video üretim modeli Sederance 2.5, video ve ses üretimini tek bir işlemde gerçekleştiriyor. 30 saniyeye kadar video çıktısı sunan model, Google Gemini Omni Flash'ın kapasitesinin üç katı uzunlukta klipler oluşturabiliyor.
Bu haber The Decoder ↗ kaynağındaki içerikten derlenerek hazırlanmıştır.
İlgili Haberler

Google, Lyria 3.5 ile Müzik Jenerasyon Modelinde Seçmeli Düzenleme Özelliğini Sundu

Meta AI, Muse Spark 1.1 ile agentic özelliklere kavuştu: Planlamadan raporlamaya aktif görev yürütmesi

OpenAI verisinde: Çalışanlar ChatGPT ile başka mesleklerin işlerini yapıyor

Cursor'un agent swarm'u: Planlama görevini frontier modeller üstlenince ucuz modeller çoğu kodlama işini yapabiliyor
Black Forest Labs Flux 3: Video Üretiminde Doğal Ses Desteği
