본문으로 건너뛰기

카테고리

LLM

Insights의 LLM 기사

RSS 피드
LLM 레딧

LocalLLaMA, true 1-bit LLM용 XOR patch 방식 "Bankai" 실험에 주목

LocalLLaMA에서 주목받은 Bankai는 true 1-bit LLM의 binary weights에 sparse XOR patch를 적용해 post-training behavior를 바꾸는 실험적 방법이다. GitHub repo와 paper에 따르면 Bonsai 8B에서 약 1 KB 크기의 patch로 held-out 문제 17개 중 4개를 고치고, 이미 맞히던 13개는 깨지지 않았으며, 적용과 제거는 microseconds 수준의 XOR 연산으로 끝난다.

2분 소요 26 조회
LLM 해커뉴스

Hacker News, Karpathy의 "LLM Wiki" 패턴에 주목

Andrej Karpathy가 2026년 4월 4일 공개한 LLM Wiki는 query 시점마다 raw 문서를 다시 뒤지는 RAG 대신, agent가 지속적으로 갱신하는 interlinked wiki를 중간 계층으로 두자는 제안이다. Hacker News에서는 raw sources, wiki, schema의 3층 구조와 ingest·query·lint workflow를 personal research와 team knowledge base 모두에 적용 가능한 패턴으로 받아들였다.

2분 소요 44 조회
LLM 해커뉴스

Hacker News, coding agent를 구성하는 여섯 가지 핵심 블록 정리

Sebastian Raschka가 2026년 4월 4일 공개한 글은 coding agent의 성능 차이가 단순히 base model보다 harness 설계에서 나온다고 주장한다. 그는 live repo context, prompt/cache reuse, structured tools, context reduction, session memory, bounded subagents를 여섯 가지 핵심 구성요소로 정리했고, Hacker News에서는 이를 Codex·Claude Code류 도구를 이해하는 실무적 기준으로 받아들였다.

2분 소요 42 조회
LLM X/Twitter

Together Research, LLM으로 잘못된 database query plan 보정…최대 4.78배 가속 주장

Together Research는 DBPlanBench를 통해 LLM이 DataFusion의 물리 query plan을 직접 수정해 일부 TPC-H·TPC-DS 워크로드에서 최대 4.78배 속도 향상을 냈다고 밝혔다. 핵심은 전체 plan을 다시 생성하지 않고 기존 plan에 국소 패치를 적용하는 방식이다.

1분 소요 31 조회
LLM X/Twitter

Cursor, 사전학습 연장부터 실제 워크플로 RL까지 Composer 2 학습 스택 공개

Cursor는 2026년 3월 26일 real-time RL을 통해 5시간마다 개선된 checkpoint를 배포할 수 있다고 밝혔다. Cursor의 3월 27일 technical report는 Composer 2가 Kimi K2.5 기반 continued pretraining과 realistic Cursor session에서의 대규모 RL을 결합하며, CursorBench 61.3, SWE-bench Multilingual 73.7, Terminal-Bench 61.7을 기록했다고 설명한다.

2분 소요 49 조회