LLM Reddit May 5, 2026 1 min read
에이전트 벤치마크 FoodTruck Bench에서 DeepSeek V4 Pro가 GPT-5.2와 사실상 동등한 성능을 기록했다. GPT-5.2 테스트 대비 10주 만에, 비용은 약 17배 저렴하다.
DeepSeek V4의 공개 가중치 출시와 이를 활용한 DeepClaude까지, 오픈소스 LLM 생태계에서 DeepSeek V4가 만들어낸 물결을 추적합니다.
에이전트 벤치마크 FoodTruck Bench에서 DeepSeek V4 Pro가 GPT-5.2와 사실상 동등한 성능을 기록했다. GPT-5.2 테스트 대비 10주 만에, 비용은 약 17배 저렴하다.
DeepClaude는 Claude Code의 에이전트 루프를 그대로 유지하면서 AI 모델만 DeepSeek V4 Pro로 교체하는 오픈소스 도구다. 출력 토큰 기준 $15/M에서 $0.87/M으로 17배 저렴해진다.
DeepSeek이 DeepSeek-V4-Pro와 V4-Flash 두 가지 모델을 공개했다. Pro는 1.6조 파라미터(활성 49B)의 Mixture-of-Experts 구조로, 현재까지 공개된 오픈웨이트 모델 중 최대 규모다. 가격은 GPT-5.4와 Gemini 3.1 Pro 대비 절반 이하로, 비용 효율성이 핵심 차별점이다.