DeepSeek-V3
1건
기사 통계를 확인하고 있습니다.
-
NVIDIA, JAX용 Transformer Engine으로 드롭리스 MoE 학습 10배 가속
NVIDIA가 JAX Transformer Engine 커널 최적화로 DeepSeek-V3 MoE 학습의 GPU당 처리량을 10.4배 높였다고 밝혔다.
1건
기사 통계를 확인하고 있습니다.
NVIDIA가 JAX Transformer Engine 커널 최적화로 DeepSeek-V3 MoE 학습의 GPU당 처리량을 10.4배 높였다고 밝혔다.