Perplexity, Pro·Max 구독자 대상 GPT-5.4 및 GPT-5.4 Thinking 제공 시작
Perplexity가 2026년 3월 5일 X를 통해 Pro·Max 구독자에게 GPT-5.4와 GPT-5.4 Thinking 제공을 시작했다고 발표했다. 유료 티어 중심 모델 접근 전략이 다시 강화됐다.
원문: Perplexity Adds GPT-5.4 and GPT-5.4 Thinking for Pro and Max Subscribers 원문 보기 →
발표 내용
Perplexity는 2026년 3월 5일(UTC) X 게시물에서 GPT-5.4와 GPT-5.4 Thinking을 Pro 및 Max 구독자에게 제공한다고 밝혔다. 핵심 메시지는 단순하다. 대기 명단이 아니라, 유료 구독자에게 즉시 사용할 수 있는 형태로 배포가 시작됐다는 점이다.
공개 미러 기반 지표 기준으로 해당 게시물은 단시간에 1,500회 이상 좋아요와 8만 회 이상의 조회를 기록했다. 이는 고성능 모델을 검색형 AI 워크플로에 통합하려는 수요가 빠르게 반응하고 있음을 보여준다.
의미와 파급
Perplexity의 경쟁력은 웹 검색·출처 탐색·응답 생성을 하나의 인터페이스에서 처리하는 점에 있다. 여기에 GPT-5.4 계열을 추가함으로써, 프리미엄 플랜에서의 모델 선택 폭과 성능 기대치를 함께 끌어올리려는 전략이 분명해졌다.
실무 관점에서는 단순한 모델 탑재보다 "기존 리서치 루틴에서 실제 생산성이 개선되는지"가 중요하다. 조직 사용자라면 요약 정확도, 긴 문맥 유지, 복잡한 질의에서의 일관성 같은 항목을 기준으로 기존 모델 대비 A/B 검증을 진행할 필요가 있다.
확인해야 할 점
이번 게시물 자체에는 상세 벤치마크 방법론이나 세부 제한사항이 포함되지 않았다. 따라서 대규모 도입 전에는 팀별 업무 시나리오에서 응답 품질, 속도, 비용 구조를 별도로 검증하는 접근이 안전하다.
관련 기사
104GB Qwen을 48GB Mac에서 12 tok/s로, slotstream의 SSD 승부
메모리에 들어가지 않는 125B MoE 모델을 SSD에서 필요한 expert만 불러 48GB Mac에서 약 12 tok/s로 돌린 구현이 화제다. 실제 측정값과 저사양 추정치를 구분해 공개하면서 로컬 추론의 병목을 RAM 용량에서 저장장치 대역폭으로 옮겼다.
Qwen3.8-Max-0902, CodeArena 1,691점으로 1위…100만 토큰 유지
Qwen3.8-Max의 9월 2일 체크포인트가 프런트엔드 CodeArena에서 1,691점으로 선두에 올랐다. 기반 규모를 바꾼 신모델이 아니라 코딩과 장기 에이전트 작업을 겨냥한 후훈련 갱신이며, 100만 토큰 문맥과 API 호환성을 그대로 유지한다.
OpenAI Astra, 제로데이 2건 찾아 사상 첫 ‘치명적’ 사이버보안 역량 기준 통과
Astra가 OpenAI 모델 최초로 사이버보안 ‘Critical’ 기준을 넘고, 최신 V8 취약점 평가에서 제로데이 2건을 찾아냈다. ExploitBench에서는 100%를 기록해 공개 범위와 안전장치가 출시의 핵심 변수가 됐다. 가장 강한 기능은 소수 시험자에게 먼저 제공된다.