JetBrains 안으로 들어온 Copilot 에이전트… 전역 자동승인 추가
GitHub가 Copilot의 에이전트 모드를 JetBrains 채팅 패널 밖, 에디터 안으로 밀어 넣었다. 여기에 파일 수정·터미널 명령·외부 도구 호출까지 한 번에 승인하는 전역 자동승인 옵션도 추가됐다.
카테고리
Insights의 LLM 기사
GitHub가 Copilot의 에이전트 모드를 JetBrains 채팅 패널 밖, 에디터 안으로 밀어 넣었다. 여기에 파일 수정·터미널 명령·외부 도구 호출까지 한 번에 승인하는 전역 자동승인 옵션도 추가됐다.
GitHub가 GPT-5.5를 Copilot 전면에 올리면서 새 모델 소식이 실제 개발 도구 변화로 넘어왔다. 대상은 Pro+, Business, Enterprise이며, 요청 단가는 7.5배 프리미엄 배수로 붙는다.
LocalLLaMA가 이 글에 꽂힌 이유는 숫자 하나 때문만은 아니었다. RTX 5090 한 장에서 Qwen3.6-27B-INT4를 100 tps와 256k context로 돌렸다는 보고가 올라오자, 댓글은 곧바로 “그 속도에서 품질은 어디까지 지키느냐”로 모였다.
일본 기업 AI 시장이 파일럿 단계를 지나 좌석 수와 산업별 배포 경쟁으로 넘어가고 있다. Anthropic는 2026년 4월 24일, NEC가 Claude를 전 세계 약 30,000명 직원에게 배포하고 일본 첫 글로벌 파트너로서 금융·제조·지방정부용 제품을 함께 개발한다고 밝혔다.
기업용 AI는 답변 품질보다 재사용성과 검토 가능성이 더 중요할 때가 많다. Google Cloud는 Gemini Enterprise에서 워크플로를 팀 공용 Skills로 저장할 수 있게 했고, 하루 전에는 Agent Designer에서 각 단계를 검사·테스트·승인할 수 있다고 적었다.
캐시 적중 요금은 장문 컨텍스트 제품의 원가를 좌우하기 때문에 이번 인하는 파급력이 크다. DeepSeek는 전체 API 시리즈의 입력 캐시 가격을 기존의 10분의 1로 낮췄고 V4-Pro 75% 할인도 유지한다고 적었다.
LocalLLaMA는 DeepSeek V4 공개 자체보다, 1M context와 activated parameter 수가 실제 하드웨어에서 어떤 의미인지부터 계산하기 시작했다. 스레드는 곧 “RAM을 더 질렀어야 했다”는 반응과 MIT license 호평으로 채워졌다.
LocalLLaMA가 이 글에 반응한 이유는 q8_0 KV cache가 늘 무난하다는 통념이 깨졌기 때문이다. Gemma 4는 Qwen 3.6보다 훨씬 빨리 품질이 무너졌고, 스레드는 바로 SWA cache와 긴 context 영향으로 옮겨갔다.
왜 중요한가: 코딩 모델 경쟁에서 공용 벤치마크만으로는 실제 체감 차이를 읽기 어려워졌기 때문이다. Cursor는 GPT-5.5가 자체 평가인 CursorBench에서 72.8%로 가장 높았고, 5월 2일까지 가격도 50% 낮춘다고 적었다.
왜 중요한가: AI 에이전트가 채팅 답변을 넘어 실제 거래 협상으로 들어가고 있기 때문이다. Anthropic은 사내 장터 실험에서 69개 에이전트가 500개 넘는 물품 사이에서 186건의 거래를 마무리했고, 총 거래액은 4,000달러를 조금 넘었다고 공개했다.
HN은 한 사용자의 해지 후기에 금방 자기 얘기를 겹쳐 썼다. 비싸다는 불만보다, 익숙한 개발 흐름의 바닥이 조용히 움직일 때 생기는 불안이 더 크게 공유됐다.
HN은 GPT-5.5 출시 소식을 축하보다 검산으로 받았다. 첫 반응은 얼마나 똑똑한가보다 가격, 컨텍스트 구간, 그리고 코딩 태도가 정말 나아졌는가였다.