LLM Reddit Feb 15, 2026 1 min read llama.cppのQwen3Nextグラフ最適化がマージ、LocalLLaMAで推論高速化報告 r/LocalLLaMAで注目された投稿は、llama.cpp PR #19375のマージを共有し、Qwen3Next推論の速度向上を検証した。PR本文のベンチマークとコミュニティ計測の双方で、copy削減によるt/s改善が確認されている。 #llama-cpp#qwen3next#inference 31