본문으로 건너뛰기

카테고리

LLM

Insights의 LLM 기사

RSS 피드
LLM

GitHub, pull request 댓글에서 @copilot으로 기존 PR 수정 요청 지원

GitHub는 이제 pull request 안에서 <code>@copilot</code>을 멘션해 같은 PR에 대한 수정 작업을 요청할 수 있다고 밝혔다. 회사는 Copilot coding agent가 cloud development environment에서 변경을 수행하고 테스트와 lint를 거쳐 푸시하며, fork 기반 PR은 아직 지원하지 않는다고 설명했다.

1분 소요 43 조회
LLM

Vercel, production 앱과 agent workflow용으로 v0 전면 재구축

Vercel은 새 v0를 demo형 vibe coding 도구가 아니라 production 앱과 agent를 위한 제품으로 다시 설계했다고 밝혔다. 이번 버전은 sandbox runtime 기반 repo import, git-native branch·pull request 흐름, Snowflake·AWS database 연동, enterprise-grade security control을 묶어 제공한다.

2분 소요 45 조회
LLM X/Twitter

Cloudflare, sandboxed AI code execution용 Dynamic Workers를 open beta로 확대

Cloudflare는 2026년 3월 24일 Dynamic Workers가 AI가 생성한 코드를 보안이 적용된 경량 isolate 안에서 실행할 수 있게 하며, 이 접근이 기존 container보다 100배 빠르다고 밝혔다. Cloudflare 블로그는 이 기능이 유료 Workers 사용자를 대상으로 open beta에 들어갔고, <code>globalOutbound: null</code>로 직접적인 외부 인터넷 접근을 차단할 수 있다고 설명한다.

2분 소요 44 조회
LLM X/Twitter

Google DeepMind, 저지연 voice·vision agent용 Gemini 3.1 Flash Live 공개

Google DeepMind는 2026년 3월 26일 Gemini 3.1 Flash Live가 Google AI Studio의 Live API를 통해 preview로 제공된다고 밝혔다. Google 블로그에 따르면 이 모델은 실시간 voice·vision agent를 겨냥하며, noisy 환경에서의 tool triggering을 개선하고 90개가 넘는 언어의 multimodal 대화를 지원한다.

2분 소요 48 조회
LLM 레딧

r/LocalLLaMA가 주목한 NVIDIA의 open-weight 전략, $26B 투자 보도보다 더 중요한 Nemotron 신호

r/LocalLLaMA에서는 NVIDIA가 향후 5년간 open-weight AI model에 $26 billion을 투입할 수 있다는 보도가 빠르게 확산됐지만, 핵심 논의는 숫자보다 전략에 있었다. March 2026에 공개된 Nemotron 3 Super는 NVIDIA가 open model, tooling, Blackwell 최적화 deployment를 하나의 묶음으로 밀고 있음을 보여주는 가장 분명한 증거다.

2분 소요 53 조회
LLM X/Twitter

Vercel, provider·user·가격 티어 전반을 아우르는 AI Gateway 통합 리포팅 출시

Vercel은 2026년 3월 25일 AI Gateway용 Custom Reporting API가 Pro 및 Enterprise 플랜에서 beta로 제공된다고 밝혔다. 블로그에 따르면 팀은 BYOK 요청을 포함한 AI Gateway 트래픽의 cost, token usage, request volume을 조회하고, model, provider, user ID, tags, credential type 기준으로 세부 분석할 수 있다.

2분 소요 49 조회
LLM X/Twitter

Anthropic, Claude Code auto mode를 분류기 기반 에이전트 자율성 중간지대로 설명

Anthropic는 2026년 3월 25일 Claude Code auto mode가 다수의 permission prompt를 분류기로 대체해, 모든 승인을 건너뛰는 방식보다 더 안전한 자율 실행 경로를 제공한다고 밝혔다. 엔지니어링 글은 이 기능이 prompt-injection probe와 2단계 transcript classifier를 결합하며, 전체 파이프라인 기준 실제 트래픽에서 0.4% false-positive rate를 기록했다고 설명한다.

2분 소요 55 조회