🔥 Selamat datang di Aplikasi Populer — Jelajahi tren terbaru tentang ssb-bet!
GPU NVIDIA H200
Mempercepat beban kerja AI dan HPC.
Tersedia Sekarang
GPU NVIDIA H200 mempercepat beban kerja AI generatif dan komputasi kinerja tinggi (HPC) dengan kemampuan memori dan performa yang revolusioner. Sebagai GPU pertama dengan HBM3E, memori H200 yang lebih besar dan lebih cepat mendorong percepatan AI generatif dan model bahasa besar (LLM) serta memajukan komputasi ilmiah untuk beban kerja HPC.
Poin Penting
Rasakan Performa Tingkat Berikutnya
- Inferensi Llama2 70B: 1,9X lebih cepat
- Inferensi GPT-3 175B: 1,6X lebih cepat
- Komputasi Kinerja Tinggi: 110X lebih cepat
Manfaat
Performa Lebih Tinggi dengan Memori yang Lebih Besar dan Lebih Cepat
Berdasarkan arsitektur NVIDIA Hopper, NVIDIA H200 adalah GPU pertama yang menawarkan 141 gigabyte (GB) memori HBM3e pada 4,8 terabyte per detik (TB/s)—hampir dua kali lipat kapasitas GPU NVIDIA H100 dengan bandwidth memori 1,4X lebih besar. Memori H200 yang lebih besar dan lebih cepat mempercepat AI generatif dan LLM, serta memajukan komputasi ilmiah untuk beban kerja HPC dengan efisiensi energi yang lebih baik dan total biaya kepemilikan yang lebih rendah.
Wawasan dengan Inferensi LLM Berperforma Tinggi
Dalam lanskap AI yang terus berkembang, bisnis mengandalkan LLM untuk memenuhi berbagai kebutuhan inferensi. Akselerator inferensi AI harus memberikan throughput tertinggi dengan TCO terendah ketika digunakan dalam skala besar untuk basis pengguna yang masif. H200 meningkatkan kecepatan inferensi hingga 2X dibandingkan GPU H100 saat menangani LLM seperti Llama2.
Percepat Komputasi Kinerja Tinggi
Bandwidth memori sangat penting untuk aplikasi HPC karena memungkinkan transfer data yang lebih cepat, mengurangi hambatan pemrosesan yang kompleks. Untuk aplikasi HPC yang membutuhkan memori intensif seperti simulasi, penelitian ilmiah, dan kecerdasan buatan, bandwidth memori H200 yang lebih tinggi memastikan data dapat diakses dan dimanipulasi secara efisien, menghasilkan waktu penyelesaian hingga 110X lebih cepat dibandingkan CPU.
Kurangi Energi dan TCO
Dengan diperkenalkannya H200, efisiensi energi dan TCO mencapai level baru. Teknologi mutakhir ini menawarkan performa tak tertandingi, dalam profil daya yang sama dengan H100. Pabrik AI dan sistem superkomputer yang tidak hanya lebih cepat tetapi juga lebih ramah lingkungan, memberikan keunggulan ekonomi yang mendorong komunitas AI dan ilmiah maju.
Percepatan AI untuk Server Perusahaan Mainstream dengan H200 NVL
NVIDIA H200 NVL ideal untuk desain rak perusahaan berpendingin udara dengan daya lebih rendah yang memerlukan konfigurasi fleksibel, memberikan percepatan untuk setiap beban kerja AI dan HPC tanpa memandang ukuran. Dengan hingga empat GPU yang terhubung melalui NVIDIA NVLink dan peningkatan memori 1,5x, inferensi model bahasa besar (LLM) dapat dipercepat hingga 1,7x, dan aplikasi HPC mencapai performa hingga 1,3x lebih banyak dibandingkan H100 NVL.
Siap untuk Perusahaan: Perangkat Lunak AI Menyederhanakan Pengembangan dan Penerapan
NVIDIA H200 NVL dilengkapi dengan langganan NVIDIA Enterprise lima tahun. Langganan ini mencakup NVIDIA AI Enterprise untuk menyederhanakan pembangunan platform siap-AI perusahaan. H200 mempercepat pengembangan dan penerapan AI untuk solusi AI generatif yang siap produksi, termasuk visi komputer, AI ucapan, retrieval augmented generation (RAG), dan lainnya. NVIDIA AI Enterprise mencakup NVIDIA NIM, sekumpulan layanan mikro yang mudah digunakan yang dirancang untuk mempercepat penerapan AI generatif perusahaan. Bersama-sama, penerapan memiliki keamanan, pengelolaan, stabilitas, dan dukungan tingkat perusahaan. Ini menghasilkan solusi AI yang dioptimalkan untuk performa yang memberikan nilai bisnis dan wawasan yang dapat ditindaklanjuti dengan lebih cepat.
Spesifikasi
H200 SXM¹ | H200 NVL¹
FP64 | 34 TFLOPS | 30 TFLOPS
FP64 Tensor Core | 67 TFLOPS | 60 TFLOPS
FP32 | 67 TFLOPS | 60 TFLOPS
TF32 Tensor Core² | 989 TFLOPS | 835 TFLOPS
BFLOAT16 Tensor Core² | 1.979 TFLOPS | 1.671 TFLOPS
FP16 Tensor Core² | 1.979 TFLOPS | 1.671 TFLOPS
FP8 Tensor Core² | 3.958 TFLOPS | 3.341 TFLOPS
INT8 Tensor Core² | 3.958 TFLOPS | 3.341 TFLOPS
Memori GPU | 141GB | 141GB
Bandwidth Memori GPU | 4,8TB/s | 4,8TB/s
Dekoder | 7 NVDEC, 7 JPEG | 7 NVDEC, 7 JPEG
Komputasi Rahasia | Didukung | Didukung
Daya Termal Maksimal (TDP) | Hingga 700W (dapat dikonfigurasi) | Hingga 600W (dapat dikonfigurasi)
Multi-Instance GPU | Hingga 7 MIG @18GB masing-masing | Hingga 7 MIG @16,5GB masing-masing
Faktor Bentuk | SXM | PCIe, slot ganda berpendingin udara
Interkoneksi | NVIDIA NVLink: 900GB/s, PCIe Gen5: 128GB/s | Jembatan NVLink 2- atau 4-arah: 900GB/s per GPU, PCIe Gen5: 128GB/s
Opsi Server | Mitra NVIDIA HGX H200 dan Sistem Bersertifikasi NVIDIA dengan 4 atau 8 GPU | Mitra NVIDIA MGX H200 NVL dan Sistem Bersertifikasi NVIDIA dengan hingga 8 GPU
NVIDIA AI Enterprise | Add-on termasuk | Add-on termasuk
¹ Spesifikasi awal. Dapat berubah. ² Dengan sparsity.
Spesifikasi Singkat GPU NVIDIA H200
- Memori GPU: 141GB
- Bandwidth Memori GPU: 4,8TB/s
- Performa FP8 Tensor Core: 4 PetaFLOPS
- Faktor Bentuk: SXM | PCIe
- Opsi Server: Mitra NVIDIA HGX H200 dan Sistem Bersertifikasi NVIDIA dengan 4 atau 8 GPU; Mitra NVIDIA MGX H200 NVL dan Sistem Bersertifikasi NVIDIA dengan hingga 8 GPU
Kasino
Olahraga
bet-lokasi-sekolah-smp