LLM Hacker News Jun 28, 2026 1 min read DeepSeek DSpark, LLM 추론 병목을 “검증 길이”에서 다시 잡은 이유 관심은 단순한 속도 수치보다 “어떤 토큰을 검증할 것인가”에 모였다. DSpark는 speculative decoding의 낭비를 줄여 DeepSeek-V4에서 사용자 체감 생성 속도를 60~85% 높였다고 설명한다. #deepseek#speculative-decoding#llm-inference 18