Google DeepMind tarafından geliştirilen GenCeption modeli, video üreticisini klasik bilgisayar görmesi görevleri için yeniden kullanarak derinlik tahmini ve görüntü segmentasyonu gibi alanlarda en ileri sistemlerle eşdeğer sonuçlar elde ediyor. Model, neredeyse tamamen sentetik videolar üzerinde eğitilmiş.\n\nGenCeption'ın başarısı, video generatörlerin halihazırda evrensel bir dünya modeli türü içerip içermediği sorusunu yeniden gündeme getiriyor. Araştırmanın bulguları, video üretme yeteneğinin 3D uzay, fizik ve nesnelerin davranışı hakkında geniş bir anlayışı gerektiğini, bu bilginin ise diğer görsel görevler için de faydalı olabileceğini gösteriyor.
Google DeepMind, Video Generatörlerin Evrensel Dünya Modelini İçerdiğini Savunuyor

Google DeepMind, video üreticilerine dayalı GenCeption modelinin, bilgisayar görmesi görevlerinde (derinlik tahmini, segmentasyon gibi) çok daha az eğitim verisiyle en ileri sistemlerle eşdeğer performans gösterdiğini ortaya koydu.
Bu haber The Decoder ↗ kaynağındaki içerikten derlenerek hazırlanmıştır.
Araştırma & Bilimvideo generatörlerdünya modeliGenCeptionbilgisayar görmesiderinlik tahminisegmentasyon
İlgili Haberler

90'lar Bilgisayarlarının Usta Analizi: Jurassic Park'ın Teknoloji Dünyası

Feynman'ın Ters Sprinkler Paradoksunun Çözümü "Akıl Almaz" Sprinklerlerine de Uygulanıyor

1.700 Yıl Sonra Polinezyalılar Neden Doğuya Yelken Açtı? İklim Verileri Yanıt Veriyor

GPT-5.6 Sol Ultra, 50 yıllık matematik problemini çözdüğü iddia ediliyor

Homo floresiensis'in Beslenme Alışkanlıkları Evrim Tarihine Işık Tutuyor
