Z.ai, GLM-5 공개: 744B 파라미터 오픈소스 최강 모델
Z.ai가 GLM-5를 공개했다. 744B 파라미터(40B 활성)로 확장되고 28.5T 토큰으로 사전학습된 이 모델은 복잡한 시스템 엔지니어링과 장기 에이전트 작업을 목표로 한다.
카테고리
Insights의 LLM 기사
Z.ai가 GLM-5를 공개했다. 744B 파라미터(40B 활성)로 확장되고 28.5T 토큰으로 사전학습된 이 모델은 복잡한 시스템 엔지니어링과 장기 에이전트 작업을 목표로 한다.
중국의 GLM-5 모델이 Intelligence Index에서 50점을 기록하며 오픈 소스 대형 언어 모델 중 최고 성능을 달성했습니다.
Perplexity가 Claude, GPT-5.2, Gemini 등 여러 최신 AI 모델을 병렬로 실행해 통합된 답변을 생성하는 Model Council을 출시했다. 교차 검증을 통해 추론 품질을 크게 개선하고 환각 오류를 줄인다.
OpenAI가 무료 및 Go 티어 ChatGPT에서 광고 테스트를 시작했다. 광고는 명확히 표시되고 챗봇 답변과 시각적으로 분리된다. Anthropic는 대조적으로 Claude에 광고를 넣지 않겠다고 밝혔다.
OpenAI와 Anthropic이 2월 5일 자사의 최신 AI 코딩 모델을 거의 동시에 발표하며 치열한 경쟁을 벌였다. Anthropic이 발표 시각을 15분 앞당기며 선수를 쳤고, OpenAI는 자체 개발에 참여한 GPT-5.3-Codex를 공개했다.
llama.cpp에 Alibaba의 Qwen3.5 모델 시리즈 지원이 추가되었습니다. Dense와 MoE(Mixture-of-Experts) 변형을 모두 지원하며, 사용자들은 최신 언어 모델을 로컬에서 실행할 수 있게 되었습니다. 흥미롭게도 이 구현은 Claude Opus 4.6의 도움으로 생성되었습니다.
중국 AI 기업 Zhipu AI가 745B 파라미터 규모의 5세대 대형 언어 모델 GLM-5를 2026년 2월 출시했다. 전체 훈련이 화웨이 Ascend 칩으로 이뤄져 미국 하드웨어 독립을 달성한 첫 프론티어 모델이다.
DeepSeek가 mHC(Manifold-Constrained Hyper-Connections) 아키텍처를 발표하며 트랜스포머의 훈련 불안정성 문제를 해결했다. 6-7% 연산 오버헤드만으로 안정적인 대규모 모델 훈련이 가능해졌다.
Reddit LocalLLaMA 커뮤니티에서 Qwen3-Coder-Next가 코딩뿐만 아니라 일상 대화, 문제 해결, 심층 사고 등 범용 작업에서도 Gemini 수준의 경험을 제공하는 최초의 로컬 LLM으로 평가받고 있습니다. 프라이버시를 지키면서도 상용 모델 수준의 성능을 원하는 사용자들에게 새로운 대안이 되고 있습니다.
한 개발자가 중국 Moonshot AI의 Kimi K2.5와 Anthropic의 Claude Opus 4.5를 실제 코딩 작업으로 비교했다. 복잡한 작업에서는 Opus가 우위를 보였지만, Kimi K2.5는 중급 난이도 작업에서 비용 대비 충분한 성능을 입증했다.
중국 AI 스타트업 Zhipu AI의 차세대 언어 모델 GLM 5가 출시를 앞두고 있다. vLLM과 Hugging Face Transformers 라이브러리에 GLM 5 지원이 추가되면서, 새로운 Mixture-of-Experts 아키텍처를 탑재한 모델의 등장이 가시화되고 있다.
Meta가 최초의 오픈 웨이트 네이티브 멀티모달 모델인 Llama 4 Scout와 Maverick을 공개했습니다. MoE 아키텍처를 채택했으며 GPT-4.5를 능가하는 성능을 자랑합니다.