Gemini 3.1 Pro 출시: 복잡한 추론 작업을 겨냥한 Google의 새 모델
Hacker News에서 높은 관심을 받은 Gemini 3.1 Pro 출시 소식. Google은 개발자·기업·일반 사용자 채널 전반에 Preview를 확장하며, ARC-AGI-2 점수 77.1%를 강조했다.
태그
#llm 태그가 달린 기사
Hacker News에서 높은 관심을 받은 Gemini 3.1 Pro 출시 소식. Google은 개발자·기업·일반 사용자 채널 전반에 Preview를 확장하며, ARC-AGI-2 점수 77.1%를 강조했다.
Hacker News에서 높은 반응을 얻은 Step 3.5 Flash는 196B total parameter와 약 11B active parameter를 내세운 MoE foundation model로 소개됐으며, 256K context와 coding/agent benchmark 수치를 함께 공개했다.
OpenAI는 2026년 2월 12일 GPT-5.3 Codex Spark를 발표하며 코드 생성·수정 워크로드에서 성능과 비용의 균형을 강조했습니다. 회사 발표 기준으로 지연 시간과 토큰 비용을 낮추면서 SWE-bench Verified 등 주요 지표를 제시했습니다.
r/LocalLLaMA의 Qwen3.5 릴리스 글은 점수 123, 댓글 13으로 빠르게 확산되며 오픈 웨이트 대형 모델 수요를 다시 확인시켰습니다. 링크된 모델 카드에는 397B total, 17B activated, 262,144 native context 등 구체 스펙이 공개됐습니다.
r/LocalLLaMA에서 높은 반응을 얻은 MiniMax-M2.5 게시글은 모델의 Hugging Face 공개를 중심으로 확산됐다. 모델 카드에는 에이전트형 코딩/검색 성능, 비용, 배포 속도 관련 수치가 제시돼 있다.
Show HN에 올라온 Off Grid는 Android/iOS에서 채팅, 이미지 생성, 비전, 음성 인식을 클라우드 없이 온디바이스로 실행하는 오픈소스 앱이다.
Hacker News에서 주목받은 글이 Anthropic과 OpenAI의 fast mode를 비교하며, LLM 추론 성능에서 배치 크기와 하드웨어 전략이 어떻게 다른 결과를 만드는지 설명했다.
Hacker News에서 화제가 된 GPT-5.3-Codex-Spark를 정리했다. OpenAI 발표 기준으로 1000 tokens/sec+ 추론, 지연 최적화 파이프라인, 패치 중심 코딩 UX가 핵심이다.
Anthropic이 Claude Opus 4.6을 공개하며 코딩, 장문 맥락 이해, 지식 업무에서 업계 최고 성능을 달성했습니다.
한 연구자가 15개의 LLM 코딩 성능을 단 하나의 변화로 극적으로 개선했다. 모델이 아닌 편집 도구 설계를 바꿔 Grok Code Fast의 성공률이 6.7%에서 68.3%로 10배 향상됐다.
중국의 GLM-5 모델이 Intelligence Index에서 50점을 기록하며 오픈 소스 대형 언어 모델 중 최고 성능을 달성했습니다.
중국 AI 기업 Zhipu AI가 745B 파라미터 규모의 5세대 대형 언어 모델 GLM-5를 2026년 2월 출시했다. 전체 훈련이 화웨이 Ascend 칩으로 이뤄져 미국 하드웨어 독립을 달성한 첫 프론티어 모델이다.