본문으로 건너뛰기

태그

#onnx

#onnx 태그가 달린 기사

RSS 피드
LLM 레딧

Liquid AI의 브라우저 추론 데모, LocalLLaMA가 주목한 이유

LocalLLaMA의 한 post는 Liquid AI의 LFM2-24B-A2B가 M4 Max browser에서 약 50 tokens per second로 동작한다고 주장하며 79 points와 11 comments를 모았다. Community의 관심은 sparse MoE architecture, ONNX packaging, 그리고 WebGPU가 local AI deployment target을 어디까지 넓힐 수 있는지에 집중됐다.

2분 소요 41 조회