LLM X/Twitter
xAI, API에 Grok 4.3 출시—에이전틱 도구 호출 벤치마크 1위
xAI가 최신 모델 Grok 4.3을 API에 공개했다. 에이전틱 도구 호출·명령어 이행 리더보드에서 1위를 차지했으며, 기업용 법률·금융 도메인에서도 최고 성능을 기록했다. 100만 토큰 컨텍스트, 입력 $1.25/M·출력 $2.50/M 가격으로 제공된다.
1분 소요 33 조회
2026년 5월 첫 주 오픈 웨이트 모델 대전: Mistral Medium 3.5(128B, 채팅·추론·코딩 통합)와 Poolside Laguna XS.2(SWE-bench 68.2%, 싱글 GPU), Gemma 4 Multi-Token Prediction 드래프터, xAI Grok 4.3 에이전틱 도구 호출 벤치마크 1위.
xAI가 최신 모델 Grok 4.3을 API에 공개했다. 에이전틱 도구 호출·명령어 이행 리더보드에서 1위를 차지했으며, 기업용 법률·금융 도메인에서도 최고 성능을 기록했다. 100만 토큰 컨텍스트, 입력 $1.25/M·출력 $2.50/M 가격으로 제공된다.
Google이 Gemma 4 모델군을 위한 Multi-Token Prediction(MTP) 드래프터를 공개했다. 추측적 디코딩 아키텍처를 통해 출력 품질 저하 없이 추론 속도를 최대 3배 높인다.
Poolside AI가 4월 28일 첫 오픈 웨이트 모델 Laguna XS.2를 Apache 2.0으로 공개했다. 33B/3B 활성 MoE 구조로 단일 GPU에서 구동 가능하며, SWE-bench Verified 68.2%로 에이전틱 코딩 특화 모델에서 최상위권이다.
Mistral이 128B 파라미터 오픈 웨이트 모델 Mistral Medium 3.5를 4월 29일 공개했다. 기존 Medium, Magistral, Devstral 2를 하나로 통합했으며, SWE-bench Verified 77.6%를 기록했다.