LLM X/Twitter Apr 22, 2026 1 min read NVIDIA NeMo RL、FP8でQwen3-8BのRL post-training workloadを1.48x高速化 重要なのは、post-training agentsの競争がinference speedだけでなくreinforcement learning throughputにも左右されることだ。NVIDIAは、NeMo RLのFP8 pathがQwen3-8B-BaseでRL workloadsを1.48x高速化し、BF16 accuracyに沿うと示した。 #nvidia#nemo-rl#fp8 31