Reddit 화제: Qwen3.5 오픈 웨이트 공개, 397B-A17B 모델 카드 세부 공개
r/LocalLLaMA의 Qwen3.5 릴리스 글은 점수 123, 댓글 13으로 빠르게 확산되며 오픈 웨이트 대형 모델 수요를 다시 확인시켰습니다. 링크된 모델 카드에는 397B total, 17B activated, 262,144 native context 등 구체 스펙이 공개됐습니다.
태그
#moe 태그가 달린 기사
r/LocalLLaMA의 Qwen3.5 릴리스 글은 점수 123, 댓글 13으로 빠르게 확산되며 오픈 웨이트 대형 모델 수요를 다시 확인시켰습니다. 링크된 모델 카드에는 397B total, 17B activated, 262,144 native context 등 구체 스펙이 공개됐습니다.
Z.ai가 GLM-5를 공개했다. 744B 파라미터(40B 활성)로 확장되고 28.5T 토큰으로 사전학습된 이 모델은 복잡한 시스템 엔지니어링과 장기 에이전트 작업을 목표로 한다.
Unsloth가 맞춤형 Triton 커널을 통해 Mixture of Experts 모델 훈련을 12배 가속하고 VRAM 사용량을 35% 이상 줄이는 획기적인 최적화를 공개했다. 이제 20B 파라미터 모델도 15GB VRAM 미만에서 fine-tuning이 가능하다.
Unsloth가 커스텀 Triton 커널과 수학 최적화를 통해 Mixture of Experts (MoE) 모델 학습을 12배 가속화하고 VRAM 사용량을 35% 이상 줄였습니다. RTX 3090 같은 소비자용 GPU에서도 대형 모델 fine-tuning이 가능합니다.
중국 AI 스타트업 Zhipu AI의 차세대 언어 모델 GLM 5가 출시를 앞두고 있다. vLLM과 Hugging Face Transformers 라이브러리에 GLM 5 지원이 추가되면서, 새로운 Mixture-of-Experts 아키텍처를 탑재한 모델의 등장이 가시화되고 있다.
Meta가 최초의 오픈 웨이트 네이티브 멀티모달 모델인 Llama 4 Scout와 Maverick을 공개했습니다. MoE 아키텍처를 채택했으며 GPT-4.5를 능가하는 성능을 자랑합니다.