본문으로 건너뛰기

카테고리

LLM

Insights의 LLM 기사

RSS 피드
LLM X/Twitter

Claude Platform, Sonnet·Haiku에 Opus 조언자를 붙이는 advisor tool beta 공개

Claude는 2026년 4월 9일 advisor strategy를 Claude Platform beta로 공개했다. Sonnet 또는 Haiku가 단일 Messages API request 안에서 Opus에 계획 조언을 요청할 수 있게 하며, Anthropic은 이 구성이 Sonnet 단독 대비 SWE-bench Multilingual을 2.7포인트 높이고 task당 비용은 11.9% 낮췄다고 설명한다.

2분 소요 48 조회
LLM

GitHub, Copilot 상호작용 데이터를 기본적으로 모델 학습에 활용

GitHub는 April 24, 2026부터 Copilot Free, Pro, Pro+ 사용자의 상호작용 데이터를 사용자가 opt out하지 않는 한 AI 모델 학습과 개선에 활용하겠다고 밝혔다. Business와 Enterprise 플랜은 제외되지만, 개인 요금제 Copilot 사용 데이터가 모델 개발로 다시 흘러가는 범위는 크게 넓어진다.

1분 소요 46 조회
LLM X/Twitter

Databricks, AI agent의 다음 bottleneck은 reasoning보다 memory라고 주장

Databricks AI Research는 2026년 4월 10일 Memory Scaling for AI Agents를 공개하며, real-world agent 성능은 더 긴 reasoning보다 external memory 축적과 retrieval 품질에 더 크게 좌우될 수 있다고 주장했다. 글은 labeled 예제, user log, organizational knowledge로 정확도와 효율이 함께 개선되는 결과를 제시한다.

2분 소요 49 조회
LLM 레딧

llama.cpp의 backend-agnostic tensor parallelism, Reddit은 반기지만 아직은 실험 단계

LocalLLaMA의 고득점 스레드는 llama.cpp에 merge된 PR #19378을 계기로 <code>--split-mode tensor</code> 기반 multi-GPU 실행이 더 현실적인 옵션이 됐다고 봤다. 다만 현재 성숙도는 CUDA 중심이며, ROCm은 돌아가도 layer split보다 느릴 수 있고 Vulkan은 성능과 안정성 모두 과제로 남아 있다.

2분 소요 46 조회
LLM 해커뉴스

논문과 경쟁 코드를 먼저 읽는 에이전트, Hacker News가 본 실전 성능 개선

Hacker News에서 주목한 SkyPilot 글은 coding agent가 코드를 건드리기 전에 논문과 경쟁 구현을 읽도록 하면 llama.cpp CPU inference 최적화 품질이 실제로 올라간다고 주장했다. 4대의 cloud VM과 약 29달러 비용으로 TinyLlama 1.1B 기준 x86 text generation을 15%, ARM을 5% 끌어올렸다는 점이 핵심이다.

2분 소요 36 조회