본문으로 건너뛰기

카테고리

LLM

Insights의 LLM 기사

RSS 피드
LLM 해커뉴스

HN이 주목한 llm-circuit-finder: layer duplication은 LLM 향상의 지름길인가, capability steering인가

Hacker News에서 화제가 된 llm-circuit-finder는 training 없이 layer routing만으로 reasoning score를 끌어올릴 수 있다고 주장한다. 하지만 README의 전체 benchmark는 IFEval/MBPP와 평균 점수 하락도 보여 주며, 이 접근은 universal improvement보다 capability steering으로 보는 편이 더 타당하다.

3분 소요 40 조회
LLM X/Twitter

Ollama, NVIDIA Nemotron-Cascade-2 공개… local·agent workflow용 30B MoE reasoning 모델 투입

Ollama는 2026년 3월 20일 NVIDIA의 Nemotron-Cascade-2를 자사 로컬 모델 스택에서 실행할 수 있다고 밝혔다. 공식 모델 페이지는 이를 3B activated parameter를 쓰는 open 30B MoE 모델로 소개하며, thinking·instruct 모드와 OpenClaw·Codex·Claude 연동 경로를 함께 제공한다.

2분 소요 42 조회
LLM X/Twitter

OpenAI, GPT-5.4 프론트엔드 품질 높이는 실전 가이드 공개… 제약 조건·참조 이미지·실데이터 강조

OpenAI는 2026년 3월 20일 GPT-5.4로 더 나은 프론트엔드를 만들려면 모호한 프롬프트보다 명확한 제약 조건, 시각 참조, 실제 콘텐츠가 중요하다고 밝혔다. 함께 공개한 OpenAI Developers 글은 이를 실제 웹 인터페이스 제작 방법론으로 정리한다.

2분 소요 32 조회
LLM

IBM Granite, Mellea 0.4.0과 Granite Libraries 공개

IBM Granite는 2026-03-20 Mellea 0.4.0과 Granite 4.0 Micro용 Granite Libraries 3종을 공개했다. prompt-only orchestration 대신 구조화되고 safety-aware한 workflow를 만들려는 팀에 초점을 둔 release다.

1분 소요 35 조회
LLM X/Twitter

GitHub, Copilot code review 6천만 건 돌파… AI 시대의 review 병목 해소를 겨냥

GitHub는 2026년 3월 20일 Copilot code review가 6천만 건을 넘어섰다고 밝혔다. 회사의 3월 5일 블로그에 따르면 사용량은 출시 후 10배 증가했고, 현재 GitHub 전체 code review의 5건 중 1건 이상을 차지하며, 더 높은 signal을 목표로 한 agentic architecture 위에서 동작한다.

2분 소요 47 조회
LLM X/Twitter

Google, AI Studio를 Antigravity·Firebase 결합형 full-stack vibe coding 환경으로 확장

Google은 2026년 3월 19일 Google AI Studio가 Antigravity coding agent와 Firebase 통합을 바탕으로 full-stack vibe coding을 지원한다고 밝혔다. 회사는 Build mode가 자연어 prompt만으로 multiplayer app 생성, server-side logic 처리, secure secret 관리, Google Maps 및 authentication 흐름 연결까지 다룰 수 있다고 설명했다.

2분 소요 51 조회