Nvidia, yeni açık ağırlıklı Nemotron 3.5 Lightning modelini tanıttı. Modelin mimarisi, yalnızca 3.6 milyar aktif parametre içeriyor ve bu sayıya rağmen Intelligence Index ölçütünde OpenAI'ın gpt-oss-120b'ye denk performans gösteriyor. Kıyaslamada gpt-oss-120b'nin dört kat daha büyük olmasına karşın, Nvidia'nın modeli benzer zeka seviyesini başarıyor.
Hız konusunda Nemotron 3.5 Lightning öne çıkıyor. Model saniyede yaklaşık 670 token işleyerek, karşılaştırma yapılan diğer modelleri geride bırakıyor. Bu performans, Nvidia'nın dil modellerinde ham parametre sayısı yerine hesaplama verimliliğine odaklandığını gösteriyor.
Modelin açık ağırlık olarak sunulması, araştırmacılar ve geliştiriler tarafından erişilebilirliği artırıyor. Nvidia, bu yaklaşımla verimli, düşük gecikmeli çıkarım gerektiren uygulamalarda yüksek performans sunmak için model boyutu ile hız arasında dengeli bir çözüm ortaya koyuyor.




