LLM X/Twitter 3h ago 1 min read NVIDIA ModelExpress、DeepSeek-V4 Pro起動を8分から1分台へ 大規模モデル運用の待ち時間が重み転送に集約されている。NVIDIAはModelExpressでDeepSeek-V4 Proの起動を8分から1分44秒に短縮した。 #nvidia#modelexpress#inference 1