LocalLLaMA, Microsoft Phi-4-Reasoning-Vision-15B 공개에 높은 관심
2026년 3월 4일 LocalLLaMA 고득점 글에서 Microsoft의 open-weight multimodal 모델 Phi-4-Reasoning-Vision-15B가 공유됐고, 로컬 배포 관점의 토론이 이어졌다.
카테고리
Insights의 LLM 기사
2026년 3월 4일 LocalLLaMA 고득점 글에서 Microsoft의 open-weight multimodal 모델 Phi-4-Reasoning-Vision-15B가 공유됐고, 로컬 배포 관점의 토론이 이어졌다.
2026년 3월 4일 HN에서 Q Labs의 Slowrun 벤치마크가 주목을 받았다. 100M FineWeb tokens를 고정한 채 compute를 활용해 data efficiency를 끌어올리는 접근이 핵심이다.
NVIDIA AI Developer는 SGLang 협업으로 GB300 NVL72에서 DeepSeek R1 추론 성능이 H200 대비 최대 25배 빨라졌다고 밝혔다. 또한 GB200 NVL72에서도 수개월 내 8배 개선을 달성했다고 설명했다.
OpenAI Developers는 Codex 앱이 Windows에서 정식 사용 가능해졌다고 밝혔다. 게시물은 네이티브 에이전트 샌드박스와 PowerShell 기반 개발 환경 지원을 핵심 변화로 제시했다.
LocalLLaMA의 고득점 글은 Qwen3.5-27B Q4 계열을 KLD와 용량으로 비교해, “가장 정확한 파일”과 “가성비가 좋은 파일”을 분리해 제시했다.
Hacker News에서 주목받은 Unsloth의 Qwen3.5 가이드는 모델 크기별 VRAM 요구량, bf16 LoRA 권장 설정, MoE/vision 학습 주의사항을 한 문서로 정리했다.
OpenAI는 2026년 3월 3일 GPT-5.3 Instant System Card를 공개했다. 문서는 disallowed content 평가, dynamic multi-turn safety 평가 방식, 그리고 HealthBench 결과를 함께 제시하며 모델 업데이트의 안전 트레이드오프를 설명한다.
OpenAI가 2026년 3월 3일 X를 통해 GPT-5.3 Instant를 ChatGPT 전체 사용자에게 순차 배포한다고 밝혔다. 같은 날 공개된 제품 글은 정확성·대화 흐름·웹 검색 응답 품질 개선과 함께 API 모델 제공 계획을 제시했다.
r/LocalLLaMA 게시글은 “매 편집 후 검증” 루프만으로 Qwen3.5-35B-A3B 점수가 22.2%에서 37.8%로 상승했다고 보고하며, Claude Opus 4.6 기준 40%와의 격차 축소를 강조했다.
OpenAI가 2026년 3월 3일 GPT-5.3 Instant를 공개하며 불필요한 거절 응답 감소, 웹 기반 답변 품질 향상, 환각률 감소 지표를 함께 제시했다.
OpenAI는 2026년 3월 3일 GPT-5.3 Instant를 공개했다. 회사는 이 모델이 GPT-4.1과 유사한 지연 시간·가격대를 유지하면서 지시 준수와 환각률에서 개선됐다고 밝혔다.
Transformers.js와 WebGPU를 이용해 Qwen 3.5 0.8B 모델을 서버 없이 브라우저에서 완전히 실행하는 데모가 공개되어 r/LocalLLaMA에서 440점을 획득했습니다. 설치나 API 키 없이도 강력한 소형 LLM을 체험할 수 있습니다.