Microsoft Research가 Memora를 저장 내용과 검색 방식을 분리한 에이전트 기억 시스템으로 소개했다. 연구 블로그는 LoCoMo와 LongMemEval에서 Mem0, RAG, full-context inference를 앞서며 컨텍스트 토큰을 최대 98% 줄였다고 설명한다.
Microsoft Research가 Memora를 저장 내용과 검색 방식을 분리한 에이전트 기억 시스템으로 소개했다. 연구 블로그는 LoCoMo와 LongMemEval에서 Mem0, RAG, full-context inference를 앞서며 컨텍스트 토큰을 최대 98% 줄였다고 설명한다.
Xbox Series X가 미국에서 $800까지 오른 같은 주, Lenovo는 DRAM·NAND 가격이 최소 5년가량 이전 수준으로 돌아가기 어렵다고 밝혔다. Reddit 반응은 중고 구매와 수리, 업그레이드 연기 쪽으로 모였다.
마이크론 $MU는 회계연도 3분기 매출 $41.46B와 비GAAP EPS $25.11을 제시한 뒤 프리마켓에서 약 18% 상승했다. 매출은 시장 추정 $35.91B를 약 $5.54B 웃돌았고, 4분기 매출 가이던스는 $50B±$1B로 제시됐다.
개인화 AI의 경쟁축이 대화창 안 답변에서 장기 기억 품질로 이동한다. OpenAI는 미국 Plus·Pro 사용자에게 새 메모리를 먼저 적용하고, Free 확장을 위해 연산 비용을 약 5배 낮췄다고 설명했다.
댓글의 관심은 “AI 서버 투자”가 스마트폰과 노트북 가격표까지 건드리는 공급망 메커니즘에 모였다.
arXiv에 공개된 Δ-Mem 논문이 HN에서 142점을 기록했다. 고정 크기 온라인 메모리 상태를 통해 LLM의 장기 기억 능력을 크게 향상시키며, MemoryAgentBench에서 기준 대비 1.31배 성능 개선을 달성했다.
닌텐도(7974.T) 주가가 약 8% 급락했다. 스위치 2 본체 가격을 인상하고 메모리 공급 위기 심화를 이유로 연간 콘솔 판매 전망을 낮췄기 때문이다. AI 수요 확대와 이란발 공급망 교란이 겹치며 낸드·D램 조달 비용이 높아진 것이 직접 원인이다.
AMD Ryzen AI Max Pro 495(코드명 Gorgon Halo)가 192GB 통합 메모리를 탑재한 것으로 유출됐다. 기존 Strix Halo의 128GB에서 50% 늘어난 용량으로, 더 큰 AI 모델을 로컬에서 구동할 수 있게 된다.
중요한 점은 agent가 매번 상태를 잃는 문제를 managed product 안으로 끌어왔다는 데 있다. Anthropic는 4월 23일 public beta를 시작하며 agent가 모든 session에서 배울 수 있다고 적었다.
HN이 이 RAM shortage story에 붙은 이유는 HBM 수요가 AI data center 밖의 phones, laptops, handhelds 가격까지 밀어 올린다는 불편한 연결고리였다.
왜 중요한가: 장시간 실행되는 agent는 모든 메시지를 다시 넣지 않고도 이전 상태를 기억해야 한다. Cloudflare는 private beta로 공개한 Agent Memory가 context window를 채우지 않으면서 필요한 정보를 다시 제공한다고 설명했다.
Hacker News에서 화제가 된 OpenClaw 비판 글은 약 1,000건의 deployment 관찰을 바탕으로, persistent agent의 핵심 문제는 flashy demo가 아니라 memory reliability라고 주장한다.