본문으로 건너뛰기

태그

#local-llm

#local-llm 태그가 달린 기사

RSS 피드
LLM 해커뉴스

Ollama, Apple Silicon용 MLX 기반 미리보기 공개

3월 31일 Hacker News 상위권에 오른 Ollama의 MLX 발표는 Apple Silicon에서 로컬 coding agent 성능을 높이려는 시도다. MLX, NVFP4, 그리고 개선된 cache 전략을 묶어 macOS 로컬 추론 병목을 줄이겠다는 내용이 핵심이다.

2분 소요 47 조회
LLM 레딧

r/LocalLLaMA, Qwen3.5-27B를 llama.cpp와 OpenCode에 붙이는 실전 구성 주목

2026년 3월 r/LocalLLaMA에서 126 points와 45 comments를 모은 글은 Qwen3.5-27B를 llama.cpp로 구동하고 OpenCode에 연결하는 실전 가이드를 조명했다. 이 글이 주목받은 이유는 quant 선택, chat-template 수정, VRAM 예산, Tailscale 네트워킹, tool-calling 동작처럼 로컬 coding 환경을 실제로 좌우하는 운영 디테일을 다뤘기 때문이다.

2분 소요 50 조회
LLM 레딧

Liquid AI의 브라우저 추론 데모, LocalLLaMA가 주목한 이유

LocalLLaMA의 한 post는 Liquid AI의 LFM2-24B-A2B가 M4 Max browser에서 약 50 tokens per second로 동작한다고 주장하며 79 points와 11 comments를 모았다. Community의 관심은 sparse MoE architecture, ONNX packaging, 그리고 WebGPU가 local AI deployment target을 어디까지 넓힐 수 있는지에 집중됐다.

2분 소요 41 조회
LLM 해커뉴스

Hacker News가 주목한 Ente의 privacy-first 로컬 LLM 앱 Ensu

Hacker News는 Ente의 Ensu 발표를 크게 다뤘다. Ensu는 local LLM software를 단순한 benchmark 경쟁이 아니라 privacy와 ownership의 제품으로 다루며, 주요 플랫폼 전반의 offline chat, open source core logic, 그리고 계획된 encrypted sync를 내세운다.

2분 소요 39 조회