enflasyonemeklilikötvdövizakpchpmhp
DOLAR
48,0206
EURO
56,1267
ALTIN
7.107,39
BIST
14.514,82
Adana Adıyaman Afyon Ağrı Aksaray Amasya Ankara Antalya Ardahan Artvin Aydın Balıkesir Bartın Batman Bayburt Bilecik Bingöl Bitlis Bolu Burdur Bursa Çanakkale Çankırı Çorum Denizli Diyarbakır Düzce Edirne Elazığ Erzincan Erzurum Eskişehir Gaziantep Giresun Gümüşhane Hakkari Hatay Iğdır Isparta İstanbul İzmir K.Maraş Karabük Karaman Kars Kastamonu Kayseri Kırıkkale Kırklareli Kırşehir Kilis Kocaeli Konya Kütahya Malatya Manisa Mardin Mersin Muğla Muş Nevşehir Niğde Ordu Osmaniye Rize Sakarya Samsun Siirt Sinop Sivas Şanlıurfa Şırnak Tekirdağ Tokat Trabzon Tunceli Uşak Van Yalova Yozgat Zonguldak
İstanbul
Parçalı Bulutlu
31°C
İstanbul
31°C
Parçalı Bulutlu
Pazartesi Açık
31°C
Salı Açık
30°C
Çarşamba Parçalı Bulutlu
31°C
Perşembe Parçalı Bulutlu
29°C

NVIDIA Blackwell B200 performansı H100’ü 4’e katladı!

NVIDIA Blackwell B200 MLPerf 4.1 performans sonuçları açıklandı. Hopper mimarisine dayanan H100’den dört kat daha fazla performans.

NVIDIA Blackwell B200 performansı H100’ü 4’e katladı!
30.08.2024 01:00
16
A+
A-

NVIDIA, Blackwell B200 işlemcisi için ilk MLPerf 4.1 sonuçlarını yayınladı. Sonuçlar, Blackwell GPU’nun, Hopper mimarisine dayanan H100’den dört kat daha fazla performans sunduğunu gösterdi. Fakat, bu sonuçları değerlendirirken kimi çok önemli noktaları göz önünde bulundurmak gerekiyor. İşte detaylar…

NVIDIA, Blackwell B200 performansı H100’den 4 kat daha hızlı

NVIDIA’nın sonuçlarına göre, Blackwell tabanlı B200 GPU, bir sunucu testinde saniyede 10,755 token ve çevrimdışı bir testte saniyede 11,264 token üretiyor. Bu sonuçlar, MLPerf Llama 2 70B benchmark testinde dört H100 GPU’nun sunduğu sonuçlarlalik gösteriyor ve Nvidia’nın tezini doğruluyor: Blackwell, H100’den 3,7 ila 4 kat daha süratli.

Ancak, bu performans artışının bir kısmı, Blackwell’in beşinci jenerasyon Tensor Çekirdeklerinin desteklediği FP4 (dört bitlik kayan nokta) hassasiyeti kullanmasından kaynaklanıyor. H100 ise sırf FP8 (sekiz bitlik kayan nokta) formatını destekliyor. FP4, FP8’den iki kat daha yüksek bir verimlilik sunuyor, bu da Blackwell’in performansında çok önemli bir rol oynuyor.

Bununla birlikte, NVIDIA’nın tek bir B200 GPU’yu dört H100 GPU ile karşılaştırması da dikkate değer. Çoklukla, tek GPU performansı, çoklu GPU performansından daha iyi olur, bu nedenle bu karşılaştırmanın tamamen adil olduğunu söylemek zor.

Ayrıca, H100 için tek GPU sonuçları MLPerf 4.1’de listelenmemiş, yalnızca B200 için sonuçlar var. Tek bir H200 GPU ise saniyede 4,488 token üretiyor, bu da B200’ün yalnızca 2,5 kat daha süratli olduğunu gösteriyor. Bellek kapasitesi ve bant genişliği de bu performans farklılıklarında büyük bir rol oynuyor.

Test edilen B200 GPU, 180 GB HBM3E bellek taşıyor, H100 SXM ise 80 GB HBM (bazı konfigürasyonlarda 96 GB’a kadar) taşıyor. H200 ise 96 GB HBM3 ve 144 GB’a kadar HBM3E bellek taşıyabiliyor.

Row 0 – Cell 0# of GPUsOfflineServerper GPU Offlineper GPU Server
Nvidia B200 180GB HBM3E111264107551126410755
Nvidia H100 80GB HBM3410700952226752381
Nvidia H200 141GB HBM3E14488420244884202
Nvidia H200 141GB HBM3E8321242973940163717

Şu an için NVIDIA, Blackwell B200’ün performansını sırf MLPerf 4.1’de Llama 2 70B modeli üzerindeki üretken AI benchmark testinde paylaştı. NVIDIA’nın diğer testlerdeki performansını şimdi paylaşmamış olması, şimdi üzerinde çalıştıkları ya da öbür faktörlerden kaynaklanabilir.

Siz ne düşünüyorsunuz? Görüşlerinizi aşağıdaki yorumlar kısmına yazabilirsiniz.

Yorumlar

Henüz yorum yapılmamış. İlk yorumu yukarıdaki form aracılığıyla siz yapabilirsiniz.