NVIDIA’nın DSX MaxLPS Teknolojisi Megawatt Başına %40 Daha Fazla Token Verimliliği Sunuyor

NVIDIA’nın DSX MaxLPS Teknolojisi Megawatt Başına %40 Daha Fazla Token Verimliliği Sunuyor

NVIDIA, Vera Rubin platformlarında enerji verimliliğini artırarak megawatt başına %40 daha yüksek token işleme kapasitesine ulaştı. Lambda, 19 düğümlü bir kümede DSX MaxLPS kullanarak güç bütçesini aşmadan token işleme hızını 4 milyondan 5 milyona çıkardı. NVIDIA Vera CPU'lar; Perplexity, ClickHouse ve Redpanda gibi şirketlerin testlerinde yüksek performans ve düşük gecikme süreleriyle dikkat çekti. Yeni nesil AI fabrikaları, artık sadece tepe FLOPS değerlerine değil, megawatt başına doğrulanmış token verimliliğine odaklanıyor.

  • NVIDIA, Vera Rubin platformlarında enerji verimliliğini artırarak megawatt başına %40 daha yüksek token işleme kapasitesine ulaştı.
  • Lambda, 19 düğümlü bir kümede DSX MaxLPS kullanarak güç bütçesini aşmadan token işleme hızını 4 milyondan 5 milyona çıkardı.
  • NVIDIA Vera CPU’lar; Perplexity, ClickHouse ve Redpanda gibi şirketlerin testlerinde yüksek performans ve düşük gecikme süreleriyle dikkat çekti.
  • Yeni nesil AI fabrikaları, artık sadece tepe FLOPS değerlerine değil, megawatt başına doğrulanmış token verimliliğine odaklanıyor.

NVIDIA, AI altyapılarının enerji tüketimi üzerindeki baskısını hafifletmek amacıyla geliştirdiği yeni çözüm setlerini AI Infra Summit kapsamında tanıttı. Şirketin tam kapsamlı AI fabrikası platformu; Vera Rubin sistemleri, Dynamo çıkarım yazılımı ve NeMo kütüphaneleri gibi bileşenleri bir araya getirerek enerji verimliliğini optimize etmeyi hedefliyor.

DSX MaxLPS ile Artan Token Verimliliği

NVIDIA’nın DSX MaxLPS teknolojisi, megawatt başına %40’a varan oranda daha fazla token işleme kapasitesi sağlıyor. Emerald AI tarafından Conductor platformunda kullanılan bu teknoloji, veri merkezlerinin güç ihtiyaçlarını şebeke koşullarına göre dinamik olarak ayarlayabiliyor. Bu sayede, şebekenin kısıtlı olduğu zamanlarda bile kritik AI iş yüklerinde kesinti yaşanmıyor.

Bulut sağlayıcısı Lambda, 19 düğümlü bir kümede gerçekleştirdiği testlerde bu teknolojinin etkisini kanıtladı. Sabit bir güç bütçesiyle çalışan Lambda, 16 düğüm yerine 19 düğüm çalıştırarak küme genelinde token işleme hızını 4 milyondan 5 milyona yükseltti. Bu sonuç, watt başına performansta %23’lük bir artış anlamına geliyor.

Vera CPU’ların Performans Sonuçları

NVIDIA Vera CPU’lar, çeşitli AI firmalarının testlerinde yüksek verimlilik değerleriyle öne çıkıyor. Perplexity, SPACE platformunda Vera CPU kullanarak sandbox başlatma sürelerini 1.9 kat hızlandırdığını belirtirken, Redpanda benchmark testlerinde diğer CPU’lara kıyasla 5.5 kat daha düşük gecikme ve %73 daha yüksek işleme kapasitesi elde ettiğini raporladı.

ClickHouse, ClickBench üzerinde Vera CPU’nun ölçtükleri en hızlı makine olduğunu vurgularken, Kinetica analitik sorgu performansında 2.7 kat artış gözlemledi. Bu sonuçlar, Vera CPU’nun veri yoğunluklu iş yükleri için yüksek bant genişliği ve tutarlı bellek gecikmesi sunduğunu doğruluyor.

Bir yanıt yazın