LLM X/Twitter
Grok V9-Medium 1.5T 학습 완료, 2~3주 뒤 공개 예고
xAI의 다음 Grok 기반 모델이 현재 운영 모델보다 3배 큰 1.5T 규모로 학습을 마쳤다. Cursor 데이터가 추가됐고 공개 전 fine-tuning과 RL 단계가 남았다.
1분 소요 41 조회
태그
#model-training 태그가 달린 기사
xAI의 다음 Grok 기반 모델이 현재 운영 모델보다 3배 큰 1.5T 규모로 학습을 마쳤다. Cursor 데이터가 추가됐고 공개 전 fine-tuning과 RL 단계가 남았다.
Mistral은 기업이 public-data baseline에만 의존하지 않고 자체 proprietary knowledge로 frontier-grade model을 만들 수 있는 Forge를 공개했다. 회사는 pre-training, post-training, reinforcement learning, dense·MoE architecture, 그리고 agent-first customization까지 지원한다고 설명한다.
r/singularity에서는 Cursor가 실제 사용자 상호작용으로 Composer를 학습시키고 최대 5시간마다 새 checkpoint를 배포한다는 설명이 화제가 됐고, reward hacking을 줄이기 위한 보정 방식도 함께 논의됐다.
Unsloth Studio가 Hacker News 프론트페이지에 오르며 local-first AI 작업환경 수요를 드러냈다. 문서는 chat, installation, data recipes, model export를 한 흐름으로 묶어 local LLM tooling의 다음 단계를 보여준다.