본문으로 건너뛰기

태그

#qwen

#qwen 태그가 달린 기사

RSS 피드
LLM 해커뉴스

Hacker News가 붙잡은 포인트는 이것이다: I-DLM은 diffusion LLM의 속도 이득을 AR 품질과 같이 가져가려 한다

Hacker News 댓글은 이 논문을 단순한 diffusion text demo가 아니라, 기존 autoregressive serving stack에 얹을 수 있는 더 빠른 LLM 후보로 읽고 있다. 프로젝트 페이지는 I-DLM-8B가 AIME-24 69.6, LiveCodeBench-v6 45.7, 그리고 high concurrency에서 2.9-4.1x throughput을 제시한다고 설명한다.

2분 소요 41 조회
LLM 레딧

Intel Arc Pro B70 32GB로 Qwen3.5-27B를 돌린 커뮤니티 실측

r/LocalLLaMA에 올라온 벤치마크는 Intel Arc Pro B70 32GB와 Intel vLLM fork 조합으로 Qwen3.5-27B int4를 어느 정도 실용적으로 서빙할 수 있음을 보여준다. 다만 tensor parallel보다 pipeline parallel이 더 유리했고, setup 안정화에도 적지 않은 시행착오가 필요했다.

1분 소요 50 조회
LLM 해커뉴스

Hacker News가 포착한 저비용 코드 모델 개선 경로

Hacker News에서 주목받은 새 논문은 verifier나 teacher model, reinforcement learning 없이도 모델이 자기 답안을 바탕으로 코드 생성 성능을 높일 수 있다고 주장한다. 논문은 Qwen3-30B-Instruct가 LiveCodeBench v6 pass@1에서 42.4%에서 55.3%로 상승했다고 보고했다.

2분 소요 40 조회
LLM 레딧

r/LocalLLaMA, Qwen3.5-27B를 llama.cpp와 OpenCode에 붙이는 실전 구성 주목

2026년 3월 r/LocalLLaMA에서 126 points와 45 comments를 모은 글은 Qwen3.5-27B를 llama.cpp로 구동하고 OpenCode에 연결하는 실전 가이드를 조명했다. 이 글이 주목받은 이유는 quant 선택, chat-template 수정, VRAM 예산, Tailscale 네트워킹, tool-calling 동작처럼 로컬 coding 환경을 실제로 좌우하는 운영 디테일을 다뤘기 때문이다.

2분 소요 50 조회