Selamat kepada tim riset atas kemajuan inferensi DeepSeek V3/R1.



Pada NVIDIA GB200 NVL72, mereka mencapai 26k token input/detik dan 13k token output/detik per GPU — peningkatan kecepatan hampir 4× / 5× dibandingkan H100.

Mereka mencapainya dengan NVFP4 MoE, perhatian FP8, dan penskalaan ke bawah paralelisme ahli
Lihat Asli
Halaman ini mungkin berisi konten pihak ketiga, yang disediakan untuk tujuan informasi saja (bukan pernyataan/jaminan) dan tidak boleh dianggap sebagai dukungan terhadap pandangannya oleh Gate, atau sebagai nasihat keuangan atau profesional. Lihat Penafian untuk detailnya.
  • Hadiah
  • 7
  • Posting ulang
  • Bagikan
Komentar
0/400
MEVSupportGroupvip
· 12jam yang lalu
Peningkatan 4 kali lipat terlalu gila!
Lihat AsliBalas0
shadowy_supercodervip
· 13jam yang lalu
Ini terlalu ketat, ya.
Lihat AsliBalas0
DefiOldTrickstervip
· 13jam yang lalu
Kakek sudah terbiasa dengan badai besar, GPU juga bisa To da moon dalam satu detik.
Lihat AsliBalas0
DaoTherapyvip
· 13jam yang lalu
Sekali lagi, sebuah guncangan inovasi teknologi.
Lihat AsliBalas0
MerkleDreamervip
· 13jam yang lalu
Rasanya tidak buruk, kecepatannya luar biasa.
Lihat AsliBalas0
PanicSellervip
· 13jam yang lalu
Tidak cukup untuk menjalankan 3090
Lihat AsliBalas0
0xLuckboxvip
· 13jam yang lalu
bull啊 AI跑这么快
Lihat AsliBalas0
  • Sematkan
Perdagangkan Kripto Di Mana Saja Kapan Saja
qrCode
Pindai untuk mengunduh aplikasi Gate
Komunitas
Bahasa Indonesia
  • 简体中文
  • English
  • Tiếng Việt
  • 繁體中文
  • Español
  • Русский
  • Français (Afrique)
  • Português (Portugal)
  • Bahasa Indonesia
  • 日本語
  • بالعربية
  • Українська
  • Português (Brasil)