Qwen3.6-27B, 397B급 이전 모델 넘고 Apache 2.0으로 공개…코딩 특화 27B dense
중요한 점은 open-weight 27B dense 모델이 훨씬 큰 코딩 시스템과 agent task에서 직접 비교되고 있다는 데 있다. Qwen 모델 카드는 Qwen3.6-27B의 SWE-bench Verified를 77.2, Qwen3.5-397B-A17B를 76.2로 적었고 라이선스는 Apache 2.0이다.
원문: Qwen pushed Qwen3.6-27B as an Apache 2.0 open-weight dense model that beats its 397B predecessor on coding benchmarks 원문 보기 →
트윗이 드러낸 것
Qwen은 이번 출시를 open model 진영이 좋아할 만한 방식으로 던졌다. 핵심 문장은 Qwen3.6-27B surpasses Qwen3.5-397B-A17B across all major coding benchmarks and supports thinking & non-thinking modes. 이다. 동시에 dense 구조, open-source, Apache 2.0 라이선스를 함께 강조했다. Qwen 라인의 상업적 매력 포인트를 한 문장에 묶은 셈이다.
Qwen 계정은 1차 모델 출시와 생태계 링크를 싣는 공식 채널이다. 이번 포스트가 material한 이유는 비교 대상이 구체적이기 때문이다. 단순히 “작은데 강하다”가 아니라, 27B dense 모델이 397B급 이전 계열을 major coding benchmark 전반에서 앞선다고 주장하고 있다.
public model card가 보탠 정보
Hugging Face README는 트윗보다 훨씬 유용하다. Qwen3.6-27B를 Qwen3.6의 첫 open-weight variant로 설명하면서, 안정성과 real-world utility를 목표로 했다고 적는다. native context length는 262,144 tokens이고, 과거 대화의 reasoning context를 유지하는 thinking preservation 기능도 넣었다. 라이선스는 Apache 2.0으로 명시된다.
벤치마크 표도 공개돼 있다. Qwen3.6-27B는 SWE-bench Verified 77.2로 Qwen3.5-397B-A17B의 76.2를 넘고, SWE-bench Pro는 53.5 대 50.9, SkillsBench는 48.2 대 30.0, NL2Repo는 36.2 대 32.2를 기록한다. Terminal-Bench 2.0에서는 둘 다 59.3으로 같다. 핵심은 Qwen이 모든 frontier closed model을 넘었다는 게 아니다. 실제로 몇몇 행에서는 Claude 4.5 Opus가 더 높다. 하지만 open coding system의 size·cost argument를 빠르게 좁히고 있다는 신호는 분명하다.
다음 관전 포인트
이제 필요한 것은 제3자 검증이다. 공개된 숫자가 외부 harness에서도 유지되는지, thinking/non-thinking mode가 실제 production workflow에서 어떻게 작동하는지, vLLM과 SGLang 같은 serving stack이 262K context 경로를 얼마나 빨리 안정화하는지가 중요하다. 이 조건이 맞아떨어지면 Qwen3.6-27B는 코딩 모델 시장에서 가장 중요한 open deployment option 중 하나가 될 수 있다.
Sources: X source tweet · Hugging Face model card · GitHub README
관련 기사
27B가 여기까지 왔나, LocalLLaMA가 Qwen3.6에 술렁인 이유
LocalLLaMA가 이 글을 밀어 올린 이유는 모두가 벤치마크를 믿어서가 아니다. 27B 오픈 모델이 에이전트형 작업에서 갑자기 경쟁권으로 들어온 듯 보였고, 그래서 더 중요해 보이면서도 동시에 더 수상해 보이는 결과가 토론을 키웠다.
Qwen3.8-Max-0902, CodeArena 1,691점으로 1위…100만 토큰 유지
Qwen3.8-Max의 9월 2일 체크포인트가 프런트엔드 CodeArena에서 1,691점으로 선두에 올랐다. 기반 규모를 바꾼 신모델이 아니라 코딩과 장기 에이전트 작업을 겨냥한 후훈련 갱신이며, 100만 토큰 문맥과 API 호환성을 그대로 유지한다.
27B dense로 여기까지, Qwen3.6에 HN이 꽂힌 이유
HN은 Qwen3.6-27B를 벤치마크 승리보다 현실적으로 돌릴 수 있는 오픈 코딩 모델로 읽었다. 댓글도 점수표보다 메모리 요구량, self-hosting 가능성, dense 구조의 운영 단순성에 몰렸다.