본문으로 건너뛰기

태그

#fp8

#fp8 태그가 달린 기사

RSS 피드
LLM X/Twitter

NVIDIA NeMo RL, FP8로 Qwen3-8B RL workload를 1.48x 가속

중요한 점은 post-training agent 경쟁이 inference speed뿐 아니라 reinforcement learning throughput에 달려 있다는 데 있다. NVIDIA는 NeMo RL의 FP8 path가 Qwen3-8B-Base에서 RL workload를 1.48x 빠르게 하면서 BF16 accuracy를 따라간다고 제시했다.

1분 소요 40 조회