2.8T 파라미터와 1M-token context를 내건 Kimi K3가 공개되며 open-weight 모델의 규모 경쟁이 다시 커졌다. 전체 가중치는 2026년 7월 27일까지 공개될 예정이고, 현재는 Kimi.com·Kimi Code·API에서 사용할 수 있다.
#coding
RSS 피드낮은 가격대의 Sonnet 모델이 agent 작업에서 Opus 4.8에 가까운 구간까지 올라섰다. Free·Pro 기본 모델과 API, Claude Code에 동시에 들어오며, 8월 31일까지 입력 100만 토큰당 $2·출력 100만 토큰당 $10의 도입 가격이 적용된다.
오픈웨이트 모델의 코딩 성능 경쟁이 새 기준선을 넘었다. Vals AI는 GLM 5.2가 Vibe Code Bench v1.1에서 64%를 기록해 다른 오픈웨이트 모델보다 최소 14%포인트 앞섰다고 밝혔다.
Microsoft AI가 7개 자체 모델을 내놓으며 OpenAI 의존도를 낮추는 경로를 더 구체화했다. 핵심 수치는 MAI-Thinking-1의 35B active parameter, 256K context, AIME 2025 97%, SWE Bench Pro 53%다.
새 Opus는 같은 가격, 더 싼 fast mode, Claude Code의 dynamic workflows로 논점이 좁혀졌다. 커뮤니티 반응은 “대형 발표”보다 실제 agent 작업에서 체감될 개선 폭을 따지는 쪽에 가까웠다.
Le Chat이 Vibe로 바뀌며 장시간 업무 처리와 코딩 에이전트가 같은 제품 안으로 들어왔다. 웹·모바일 Work Mode, 원격 Code Mode, VS Code 확장, CLI가 함께 열렸고 Pro는 월 $14.99부터 시작한다.
개발자 Josh Comeau가 AI 도구는 기술 역량을 대체하는 것이 아니라 증폭한다고 분석했습니다. 전문 지식이 깊을수록 AI 효용이 기하급수적으로 늘어나는 반면, 초보자는 아키텍처 벽에 빠르게 부딪힙니다.
Poolside AI가 4월 28일 첫 오픈 웨이트 모델 Laguna XS.2를 Apache 2.0으로 공개했다. 33B/3B 활성 MoE 구조로 단일 GPU에서 구동 가능하며, SWE-bench Verified 68.2%로 에이전틱 코딩 특화 모델에서 최상위권이다.
중요한 점은 새 model이 개발자가 이미 하루 종일 열어 두는 tool 안으로 들어왔다는 데 있다. GitHub는 GPT-5.5가 복잡한 multi-step coding에서 가장 강한 성능을 보였다고 했고, rollout에는 7.5배 premium request multiplier가 붙었다.
LocalLLaMA는 Qwen3.6-27B를 model card가 아니라 바로 quantize하고 돌려볼 수 있는 ownership 순간으로 받아들였다.
r/LocalLLaMA가 900점 넘게 반응한 이유는 Qwen3.6 score표가 아니라, local coding agent가 canvas bug와 wave completion issue를 스스로 찾아 고쳤다는 사용기였다.
Factory가 $150 million Series C를 유치하며 $1.5 billion valuation에 올라섰다. AI coding agent 시장이 개인 개발자 도구를 넘어 enterprise infrastructure 예산을 겨냥하고 있다는 신호다.