ByteDance, 에이전트 시대 겨냥한 Doubao 2.0 공개 — GPT-5.2 동급 성능에 10분의 1 비용
바이트댄스가 음력 설을 앞두고 Doubao 2.0을 출시했다. AIME 2025 98.3점, Codeforces 3020 등 주요 벤치마크에서 GPT-5.2와 비슷한 성능을 주장하면서도 가격은 서구 경쟁사 대비 약 10분의 1에 불과하다.
개요
바이트댄스(ByteDance)가 2026년 2월 15일 AI 어시스턴트 Doubao 2.0을 출시했다. 출시 시점은 음력 설 연휴를 전략적으로 노린 것으로, 지난해 춘절 기간 DeepSeek의 전격 등장이 세계 증시를 흔들었던 전례를 의식한 포석이다.
성능 지표
Doubao 2.0 Pro는 주요 벤치마크에서 다음과 같은 결과를 기록했다.
- AIME 2025: 98.3점
- Codeforces 레이팅: 3,020
- VideoMME(장시간 영상 이해): 89.5%
회사 측은 OpenAI GPT-5.2, Google Gemini 3 Pro와 대등한 성능을 갖추면서도 Volcano Engine API 기준 비용은 서구 경쟁사 대비 약 10분의 1에 그친다고 강조했다.
에이전트 패러다임
Doubao 2.0은 AI가 단순 질의응답에 그치는 것이 아닌, 복잡한 실세계 과업을 자율적으로 수행하는 에이전트 시대를 겨냥해 설계됐다. Pro 버전은 고급 추론과 다단계 작업 실행 기능을 갖추며, Doubao 앱·데스크톱·웹의 신규 전문가 모드(Expert Mode)에서 이용할 수 있다.
시장 경쟁 구도
Doubao는 주간 활성 사용자 1억 5,500만 명으로 중국 AI 챗봇 시장 1위 자리를 지키고 있다. DeepSeek(8,160만 명 WAU)이 뒤를 잇고, Alibaba Qwen은 일간 활성 사용자가 700만 명에서 5,800만 명으로 급증하며 치열한 경쟁이 펼쳐지고 있다.
Source: The Jakarta Post
관련 기사
톰슨 로이터, 자체 LLM '톰슨' 출시—법률·세무 전용, ChatGPT·Claude 성능 능가
톰슨 로이터가 4,000만 달러를 투자해 개발한 자체 AI 모델 '톰슨'을 8월 24일 공개했다. Westlaw·Practical Law·Reuters 독자 데이터로 파인튜닝됐으며 법인세 질의에서 ChatGPT·Claude를 능가했다.
OpenAI, GPT-5.5 Instant으로 ChatGPT 기본 모델 교체 — 환각 52.5% 감소
OpenAI가 ChatGPT 기본 모델을 GPT-5.5 Instant으로 교체했다. 의료·법률·금융 등 고위험 분야에서 환각 오류가 52.5% 줄었고, 응답 길이도 30.2% 단축됐다.
Gas Town 크레딧 논란, HN은 결국 AI agent 신뢰 문제로 읽었다
HN은 steal이라는 단어싸움보다 더 큰 지점을 붙잡았다. 유료 LLM credit과 GitHub 권한을 가진 agent가 명시적 opt-in 없이 upstream 유지보수까지 건드리면, 그 순간 문제는 편의성이 아니라 신뢰와 동의가 된다는 반응이다.