ChatGPT 기본 모델, GPT-5.5 Instant로 교체—환각 오류 52.5% 감소, 더 간결한 응답
OpenAI가 GPT-5.5 Instant를 ChatGPT의 새 기본 모델로 출시했다. 의학·법률·금융 등 고위험 영역에서 환각 오류를 52.5% 줄이고 더 간결하면서 개인화된 응답을 제공한다. Gmail·과거 대화 맥락을 활용하는 개인화 기능이 Plus·Pro 사용자부터 순차 적용된다.
카테고리
Insights의 LLM 기사
OpenAI가 GPT-5.5 Instant를 ChatGPT의 새 기본 모델로 출시했다. 의학·법률·금융 등 고위험 영역에서 환각 오류를 52.5% 줄이고 더 간결하면서 개인화된 응답을 제공한다. Gmail·과거 대화 맥락을 활용하는 개인화 기능이 Plus·Pro 사용자부터 순차 적용된다.
에이전트 벤치마크 FoodTruck Bench에서 DeepSeek V4 Pro가 GPT-5.2와 사실상 동등한 성능을 기록했다. GPT-5.2 테스트 대비 10주 만에, 비용은 약 17배 저렴하다.
OpenAI가 GPT-5.5 Instant를 ChatGPT의 새 기본 모델로 배포했다. 의료·법률·금융 등 고위험 쿼리에서 환각이 52.5% 감소했고, Gmail 기반 개인화와 메모리 출처 표시 기능도 추가됐다.
Sakana AI가 음성 AI의 레이턴시와 지식 품질을 동시에 해결하는 KAME(거북이) 아키텍처를 공개했다. 프론트엔드 S2S 모델과 백엔드 LLM을 탠덤으로 연결해 2.1초 파이프라인 지연 없이 MT-Bench 6.43점을 달성했다.
Poolside AI가 4월 28일 첫 오픈 웨이트 모델 Laguna XS.2를 Apache 2.0으로 공개했다. 33B/3B 활성 MoE 구조로 단일 GPU에서 구동 가능하며, SWE-bench Verified 68.2%로 에이전틱 코딩 특화 모델에서 최상위권이다.
Mistral이 128B 파라미터 오픈 웨이트 모델 Mistral Medium 3.5를 4월 29일 공개했다. 기존 Medium, Magistral, Devstral 2를 하나로 통합했으며, SWE-bench Verified 77.6%를 기록했다.
OpenAI가 ChatGPT 기본 모델을 GPT-5.5 Instant으로 교체했다. 의료·법률·금융 등 고위험 분야에서 환각 오류가 52.5% 줄었고, 응답 길이도 30.2% 단축됐다.
Anthropic이 5월 5일 월스트리트 초청 브리핑에서 Claude Opus 4.7를 공개하고 피치북·신용메모·KYC 등 금융 핵심 워크플로 에이전트 10종을 출시했다. Microsoft 365 통합과 Moody's 6억 기업 데이터 파트너십도 발표됐다.
llama.cpp에 멀티토큰 예측(MTP) 지원이 베타로 진입했다. 현재 Qwen3.5 MTP를 지원하며, 텐서 병렬 처리와 함께 vLLM과의 성능 격차를 좁힐 것으로 기대된다.
DeepClaude는 Claude Code의 에이전트 루프를 그대로 유지하면서 AI 모델만 DeepSeek V4 Pro로 교체하는 오픈소스 도구다. 출력 토큰 기준 $15/M에서 $0.87/M으로 17배 저렴해진다.
전 DeepMind 연구원 데이비드 실버가 인간 데이터 없이 강화학습만으로 범용 지식을 학습하는 AI를 개발하는 Ineffable Intelligence를 설립, 51억 달러 밸류에이션으로 11억 달러를 조달했다.
카르파시가 Sequoia Ascent 2026 대담의 주요 내용을 공유했다. LLM은 기존 업무를 빠르게 처리하는 것을 넘어 이전에는 불가능했던 완전히 새로운 종류의 앱과 경제를 가능하게 한다는 주장이다.