필즈상 수학자 "GPT-5.5 Pro, 박사급 수학 증명 해냈다"
필즈상 수상 수학자 Timothy Gowers가 ChatGPT 5.5 Pro로 미해결 수학 문제에 도전해 약 1시간 만에 박사급 증명을 이끌어냈다. 수학 연구의 위기가 임박했다고 경고했다.
카테고리
Insights의 LLM 기사
필즈상 수상 수학자 Timothy Gowers가 ChatGPT 5.5 Pro로 미해결 수학 문제에 도전해 약 1시간 만에 박사급 증명을 이끌어냈다. 수학 연구의 위기가 임박했다고 경고했다.
DELEGATE-52 연구에 따르면 Gemini 3.1 Pro, Claude 4.6 Opus, GPT 5.4 등 최첨단 LLM도 긴 위임 워크플로우에서 문서 내용의 평균 25%를 조용히 손상시킨다.
OpenAI가 GPT-5.5의 가격을 2배 인상했지만 모델의 응답 간결성 덕분에 실제 사용자 비용 증가는 49~92% 수준에 그쳤다는 OpenRouter의 분석이 나왔다.
마이크로소프트가 5월 5일 Copilot Cowork 모바일 앱(iOS·Android)을 발표하고 Agent 365와 통합했다. 유료 구독자 2,000만 명 돌파, Azure AI 연매출 370억 달러 초과 달성이 함께 공개됐다.
xAI가 최신 모델 Grok 4.3을 API에 공개했다. 에이전틱 도구 호출·명령어 이행 리더보드에서 1위를 차지했으며, 기업용 법률·금융 도메인에서도 최고 성능을 기록했다. 100만 토큰 컨텍스트, 입력 $1.25/M·출력 $2.50/M 가격으로 제공된다.
OpenAI가 2026년 5월 5일 GPT-5.5 Instant를 ChatGPT의 기본 모델로 교체했다. GPT-5.3 Instant 대비 환각이 52.5% 감소하고 응답이 30% 더 간결해졌으며, 과거 대화와 파일을 활용한 개인화 기능도 강화됐다.
Anthropic이 SpaceX의 Colossus 1 데이터센터와 컴퓨팅 파트너십을 체결, 300MW 이상과 22만 개 이상의 NVIDIA GPU를 확보했다. Claude Code 5시간 사용 한도가 2배로 늘어나고 피크 시간대 제한도 폐지된다.
OpenAI가 5월 7일 사이버보안 전문가 대상 특화 모델 GPT-5.5-Cyber의 제한 공개를 시작했다. Anthropic Mythos 접근 제한을 비판했던 OpenAI도 결국 같은 방식을 채택했다.
중국 AI 스타트업 Moonshot AI가 Meituan 주도로 $2B를 조달해 기업가치 $20B을 달성했다. 6개월 누적 조달액 $3.9B으로 중국 LLM 스타트업 사상 최대 투자 기록이다.
보안 연구업체 Cyera가 Ollama에서 인증 없이 메모리를 유출시킬 수 있는 심각한 취약점 '블리딩 라마(Bleeding Llama)'를 발견했다. 로컬 LLM을 서버로 운영하는 사용자는 즉시 패치가 필요하다.
llama.cpp의 새 MTP 지원 PR을 활용해 Qwen 3.6 27B의 추론 속도를 2.5배 높이는 방법이 공유됐다. 48GB 메모리에서 262,000 토큰 컨텍스트로 로컬 에이전틱 코딩이 가능해졌다.
Google이 Gemma 4 모델군을 위한 Multi-Token Prediction(MTP) 드래프터를 공개했다. 추측적 디코딩 아키텍처를 통해 출력 품질 저하 없이 추론 속도를 최대 3배 높인다.