LLM X/Twitter Apr 8, 2026 1 min read Cursor、Blackwell向けwarp decodeを公開… MoE inference 1.84倍高速化を主張 Cursorは2026年4月6日のXで、NVIDIA Blackwell GPUs向けにMoE modelのtoken generation pathを作り直したと述べた。あわせて公開したengineering postでは、「warp decode」によりthroughputが1.84倍になり、outputsがFP32 referenceに1.4倍近づくと主張している。 #cursor#moe#inference 30