Nvidia, RTX 5090’da Muse Glimmer ile 200 token/s Hızına Ulaştı

Nvidia, RTX ve DGX platformları için yeni açık yapay zeka modelleri ve performans optimizasyonlarını duyurdu. Güncellemeler arasında Meta’nın 30 milyar parametreli Muse Glimmer modeli, LTX-2.5 video üretim modeli ve farklı açık ağırlıklı AI modellerine yönelik destek bulunuyor.
Haberi okuduğunuz için teşekkürler, bizi takip etmeyi unutmayın!
RTX 5090, 200 token/s seviyesine ulaştı
Nvidia’nın açıklamasına göre Meta’nın yeni Muse Glimmer modeli, şirketin donanımında yerel olarak çalışacak şekilde ayarlandı. 120.000’den fazla bağlam penceresine sahip 30 milyar parametreli bu model, kodlama ve yapay zeka ajanları için geliştirildi ve RTX 5090’da saniyede 200 tokenın üzerinde bir hız sağlıyor.
Model, yerel dosyaları ve belgeleri analiz etme, API anahtarları ve kimlik doğrulama bilgileriyle çalışabilme, çok adımlı görevleri yerine getirme ve uzun süre devam eden iş akışlarını sürdürebilme gibi özellikler sunuyor. Öte yandan Nvidia, LTX-2.5 video üretim modelini RTX ve DGX sistemlerine getiriyor.
Model, çoklu çekim üretimi ve üretken düzenleme yetenekleriyle birlikte Nvidia RTX GPU’larında iki katına kadar performans artışı ve yüzde 40’a kadar bellek tasarrufu vaat ediyor. RTX PRO 6000 96 GB, LTX‑2.5 ile video üretiminde önceki çözümlere göre yüzde 20 daha yüksek performans ve yüzde 40 daha az bellek tüketimi sunuyor.
Nvidia, NVFP4, FastVideo ve ComfyUI desteğini de bu iş akışlarına dahil ediyor. Şirket bunun yanında Cosmos 3 Edge, MiniMax-H3, Laguna S 2.1, DeepSeek-V4-Flash, Wan-Animate-2 ve Inkling-Small gibi yeni açık modellere destek veriyor. Modeller 4 milyardan 284 milyara kadar farklı parametre seviyelerine sahip.
ARM64 Linux için Google Chrome desteği
Nvidia’nın verileri, RTX 5090’ın Wan‑Animate‑2 modelinde Apple M3 Ultra’ya göre 26 katına kadar, RTX PRO 5000 Blackwell’in ise 16 katına kadar daha yüksek performans sunabileceğini gösteriyor. DGX Spark platformu, birden fazla sistemi tek bir kümede birleştirmek için NVIDIA Sync Cluster Assistant’ı tanıtıyor. Bu araç, sistemler arası ağ bağlantısını, iş yükü dağıtımını ve kaynak izlemeyi yönetiyor.
Ayrıca Spark, ARM64 Linux ortamında yerel Google Chrome desteği alıyor. Yeni Nvidia Sync Resource Monitor, tek bir sistem ya da oluşturulan kümenin CPU ve GPU kullanımını gerçek zamanlı ve geçmiş verilerle izlemeyi mümkün kılıyor. Nvidia, aynı zamanda açık kaynaklı Unsloth Desktop uygulamasına da destek eklediğini açıkladı. Bu uygulama üzerinden yerel AI modelleri çalıştırılabilir, görsel ve video üretimi yapılabilir, model ince ayarı, AI ajanları, web araştırması ve kod çalıştırma işlemleri gerçekleştirilebilir.
Tek tıkla reaksiyon bırakabilirsin.




Yorumlar
0 yorum