LLM Reddit Jun 18, 2026 1 min read
LocalLLaMA의 관심은 더 큰 모델 자체가 아니라 96-128GB unified memory에서 쓸 만한 “느리지만 큰” 실사용 모델 구간에 모였다.
LocalLLaMA의 관심은 더 큰 모델 자체가 아니라 96-128GB unified memory에서 쓸 만한 “느리지만 큰” 실사용 모델 구간에 모였다.
LocalLLaMA 유저가 NVIDIA DGX Spark 16대를 200Gbps 패브릭으로 연결한 클러스터 구축을 완료했다. 통합 메모리 극대화를 목표로 DeepSeek, Kimi 등 대형 모델 서빙을 테스트 중이다.