본문으로 건너뛰기

태그

#localllm

#localllm 태그가 달린 기사

RSS 피드
LLM 레딧

Gemma 4 26B A4B는 245K context에서도 버틸까

r/LocalLLaMA의 한 stress test는 Gemma 4 26B A4B가 llama.cpp에서 262,144 context window의 약 94% 지점에서도 일관성을 유지했다고 주장한다. 정식 benchmark는 아니지만, failure mode와 tuning 값을 함께 공개했다는 점에서 현장감 있는 자료다.

1분 소요 50 조회
LLM 레딧

Intel Arc Pro B70 32GB로 Qwen3.5-27B를 돌린 커뮤니티 실측

r/LocalLLaMA에 올라온 벤치마크는 Intel Arc Pro B70 32GB와 Intel vLLM fork 조합으로 Qwen3.5-27B int4를 어느 정도 실용적으로 서빙할 수 있음을 보여준다. 다만 tensor parallel보다 pipeline parallel이 더 유리했고, setup 안정화에도 적지 않은 시행착오가 필요했다.

1분 소요 50 조회