본문으로 건너뛰기

태그

#moe

#moe 태그가 달린 기사

RSS 피드
LLM 해커뉴스

Liquid AI, 38조 토큰 학습 MoE 모델 공개

Liquid AI가 38조 토큰으로 학습한 8B-A1B MoE 모델 LFM2.5를 공개했다. M5 Max에서 초당 253토큰, 모바일에서 30토큰, H100에서 초당 1만 8500토큰의 추론 성능을 자랑하며 동급 밀집 모델을 상회한다.

1분 소요 36 조회
LLM 레딧

MiMo-V2.5-Pro, LocalLLaMA가 본 집에서 돌리는 Opus 후보

LocalLLaMA가 MiMo-V2.5-Pro에 크게 반응한 이유는 오픈소스와 스펙이 동시에 세게 들어왔기 때문이다. MIT 라이선스, 1.02T total, 42B active, 1M context라는 숫자는 매력적이었지만, 댓글은 곧바로 “이걸 누가 어떤 장비로 돌리나”로 넘어갔다.

2분 소요 42 조회