Nous sommes ravis de partager les résultats de notre collaboration avec SGLang. 🎉



Ensemble, nous avons optimisé l'inférence DeepSeek R1 pour le déploiement sur GB200 NVL72—offrant une augmentation de 2x et 3x par GPU par rapport aux clusters H100 presque deux fois plus grands.

C'est à quoi ressemble l'inférence MoE de pointe.
DEEPSEEK-4.06%
LOOKS-0.55%
Voir l'original
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.
  • Récompense
  • 6
  • Partager
Commentaire
0/400
WhaleWatchervip
· Il y a 21h
Les performances ont encore doublé, c'est incroyable !
Voir l'originalRépondre0
Rugpull幸存者vip
· Il y a 21h
Encore sur les performances, n'est-ce pas ?
Voir l'originalRépondre0
OnChainDetectivevip
· Il y a 21h
hmm j'ai tracé ces métriques GPU... quelque chose ne s'additionne pas ici
Voir l'originalRépondre0
MetaverseVagabondvip
· Il y a 21h
Ouais, j'ai enfin réussi à faire du H100 !
Voir l'originalRépondre0
ClassicDumpstervip
· Il y a 21h
Encore parti pour To the moon, n'est-ce pas ?
Voir l'originalRépondre0
WhaleMinionvip
· Il y a 21h
Les performances du GPU ont explosé.
Voir l'originalRépondre0
Trader les cryptos partout et à tout moment
qrCode
Scan pour télécharger Gate app
Communauté
Français (Afrique)
  • 简体中文
  • English
  • Tiếng Việt
  • 繁體中文
  • Español
  • Русский
  • Français (Afrique)
  • Português (Portugal)
  • Bahasa Indonesia
  • 日本語
  • بالعربية
  • Українська
  • Português (Brasil)