Reddit, MemPalace를 memory infrastructure 이슈로 띄우다… 핵심은 96.6% raw score와 README self-correction
r/singularity의 인기 글은 MemPalace를 무료 AI memory system으로 띄웠지만, 실제 핵심은 repo가 96.6% raw score와 optional rerank 100%를 스스로 다시 구분해 적은 correction note에 있다.
원문: An actress Milla Jovovich just released a free open-source AI memory system that scored 100% on LongMemEval, beating every paid solution 원문 보기 →
높은 추천을 받은 r/singularity post는 MemPalace를 메인 AI 피드로 끌어올리며 “무료 open-source AI memory system이 LongMemEval 100%를 기록했고 paid product까지 앞섰다”는 강한 headline을 붙였다. 연결된 GitHub repo는 장기 memory retrieval에 관한 인상적인 수치를 제시하지만, 더 흥미로운 부분은 maintainers가 launch 직후 README 안에서 스스로 claim을 다시 좁혔다는 점이다.
MemPalace의 핵심 아이디어는 LLM에게 무엇을 기억할지 먼저 고르게 하지 않는 것이다. 대신 raw conversation text를 local에 ChromaDB로 저장하고, 나중에 retrieval로 필요한 구절을 찾는다. README와 benchmark document에 따르면 system은 raw verbatim mode에서 API call 없이 LongMemEval recall@5 96.6%를 기록했고, optional한 Haiku 또는 Sonnet rerank를 붙이면 100%까지 도달할 수 있다고 한다. maintainers는 이를 현재 AI-memory tool 업계의 기본 가정, 즉 다른 model이 먼저 fact나 summary를 추출해 context를 버려야 한다는 생각에 대한 반론으로 제시한다.
이 이야기가 pure hype로만 끝나지 않은 이유는 repo의 own correction note 때문이다. 2026년 4월 7일자 note에서 maintainers는 기존 README가 “30x lossless compression” 표현을 과장했고, AAAK token-count example도 잘못됐으며, raw mode 96.6%와 rerank result를 충분히 구분하지 못했다고 인정했다. 또 “100% with Haiku rerank” 결과는 실제로 존재하지만, note 시점에는 public benchmark scripts에 그 pipeline이 아직 fully reflected되지 않았다고 적었다. 이 caveat는 중요하다. repo는 state-of-the-art를 주장하는 동시에, launch 시점의 presentation이 공개 재현 경로보다 앞서 나간 부분도 문서로 남기고 있는 셈이다.
그런데도 Reddit가 반응한 이유
그럼에도 Reddit가 크게 반응한 이유는 이해하기 어렵지 않다. subscription 없이, data를 device에 남겨 두고, MCP tools를 노출하면서, cloud-heavy memory product와 경쟁할 수 있다는 이야기는 지금 AI power users가 가장 듣고 싶어 하는 infrastructure narrative다. 이 post는 celebrity gossip보다는 시장 신호에 가까웠다. developers는 increasingly summary-first memory system에 회의적이고, MemPalace는 raw-first baseline이 더 강할 수 있다고 주장한다. 무엇보다 repo가 스스로 correction을 남기면서 trade-off를 숨기지 않았다는 점이, 오히려 이 project를 더 진지한 토론 대상으로 만들고 있다.
관련 기사
HN 화제: Context Mode, Claude Code MCP 워크플로의 컨텍스트 사용량 98% 절감 주장
Hacker News에서 주목받은 Context Mode는 Claude Code 도구 출력의 컨텍스트 사용량을 315 KB에서 5.4 KB로 줄였다고 보고했다.
K2 Horizon 6종, 0.9B~375B 전면 공개…코드·훈련 데이터까지 연 공개형 LLM
0.9B부터 375B까지 이어지는 6개 모델이 가중치뿐 아니라 코드, 훈련 데이터, 방법론까지 Apache 2.0으로 풀렸다. 가장 작은 모델은 시계급 기기를, 가장 큰 모델은 기업용 추론을 겨냥하며 토큰 블록 병렬 생성으로 약 3배 속도 향상을 내세운다.
텐센트 Hy4: 770B 파라미터, 1M 컨텍스트, 재귀적 자기 최적화
텐센트가 770B 총 파라미터(활성 49B)와 100만 토큰 이상의 컨텍스트 윈도우를 지원하는 Hy4 프리뷰를 오픈소스로 공개했다. 모델 자체가 추론 시스템을 자율적으로 최적화해 31.8% 성능 향상을 이끈 재귀적 자기 개선 사례다.