본문으로 건너뛰기

태그

#parallel-decoding

#parallel-decoding 태그가 달린 기사

RSS 피드
LLM 해커뉴스

Hacker News가 붙잡은 포인트는 이것이다: I-DLM은 diffusion LLM의 속도 이득을 AR 품질과 같이 가져가려 한다

Hacker News 댓글은 이 논문을 단순한 diffusion text demo가 아니라, 기존 autoregressive serving stack에 얹을 수 있는 더 빠른 LLM 후보로 읽고 있다. 프로젝트 페이지는 I-DLM-8B가 AIME-24 69.6, LiveCodeBench-v6 45.7, 그리고 high concurrency에서 2.9-4.1x throughput을 제시한다고 설명한다.

2분 소요 41 조회