LLM X/Twitter 4h ago 2 min read Meta Muse Glimmer, 30B 에이전트 모델을 20GB 아래로 압축해 RTX 5090에서 3.1배 가속 30B 매개변수 에이전트 모델이 20GB 미만으로 줄어들면서 24GB급 소비자 장비에서도 로컬 실행이 가능해졌다. Meta는 DFlash가 RTX 5090의 디코딩 속도를 3.1배 높였다고 제시했다. #meta#muse-glimmer#local-ai