Show HN: Off Grid, 모바일에서 텍스트·비전·이미지·음성 AI를 완전 오프라인으로 통합
Show HN에 올라온 Off Grid는 Android/iOS에서 채팅, 이미지 생성, 비전, 음성 인식을 클라우드 없이 온디바이스로 실행하는 오픈소스 앱이다.
카테고리
Insights의 LLM 기사
Show HN에 올라온 Off Grid는 Android/iOS에서 채팅, 이미지 생성, 비전, 음성 인식을 클라우드 없이 온디바이스로 실행하는 오픈소스 앱이다.
OpenAI는 100만 건 이상 ChatGPT 대화 데이터 분석을 통해, 2024년 9월 대비 2026년 1월에 인간 기준선을 넘는 고난도 reasoning 상호작용 비중이 약 4배 증가했다고 밝혔다. 관리 컨설팅 케이스 인터뷰·미니 크로스워드 등 개방형 과제에서도 상승폭이 확인됐다.
r/singularity에서 확산된 Ars Technica 보도를 통해, Google이 Gemini 대상 대규모 model extraction 시도를 공개하며 distillation과 지식 도용의 경계가 다시 쟁점이 됐다.
Hacker News에서 주목받은 글이 Anthropic과 OpenAI의 fast mode를 비교하며, LLM 추론 성능에서 배치 크기와 하드웨어 전략이 어떻게 다른 결과를 만드는지 설명했다.
NIST 산하 CAISI는 2026년 1월 30일 언어모델 자동 벤치마크 평가 가이드 초안 NIST AI 800-2를 공개하고 3월 31일까지 공개 의견을 받는다. 문서는 평가 목표 정의, 실행, 결과 분석·보고의 실무 절차를 제시한다.
OpenAI는 2026년 1월 29일 공지를 통해 2월 13일부터 ChatGPT에서 GPT-4o와 구형 모델 선택을 종료한다고 밝혔다. GPT-4o는 GPT-5로, GPT-4.5는 GPT-5 thinking으로, o4-mini는 o5-mini로 대체된다.
Reddit r/LocalLLaMA에서 높은 반응을 받은 게시물 "KaniTTS2 — open-source 400M TTS model with voice cloning, runs in 3GB VRAM. Pretrain code included."를 기술 관점에서 요약했다. 점수 456, 댓글 84를 기록한 커뮤니티 신호를 바탕으로 실무 적용 시 확인할 체크포인트를 정리한다.
Reddit r/singularity에서 높은 반응을 받은 게시물 "OpenAI Says Internal Model May Have Solved 6 Frontier Research Problems."를 기술 관점에서 요약했다. 점수 536, 댓글 100를 기록한 커뮤니티 신호를 바탕으로 실무 적용 시 확인할 체크포인트를 정리한다.
Anthropic는 2026년 1월 28일 ServiceNow가 AI Agent 개발 기본 모델로 Claude를 채택했다고 발표했다. ServiceNow는 특정 업무에서 95% 생산성 향상과 연간 수천 시간 절감 효과를 제시했다.
r/LocalLLaMA에서 Heretic 1.2 발표가 주목받았다. 게시글 기준으로 4-bit 로딩으로 VRAM 최대 70% 절감, MPOA 지원, VL 처리 확장, 자동 재개 기능이 핵심 업데이트다.
Hacker News에서 화제가 된 GPT-5.3-Codex-Spark를 정리했다. OpenAI 발표 기준으로 1000 tokens/sec+ 추론, 지연 최적화 파이프라인, 패치 중심 코딩 UX가 핵심이다.
r/LocalLLaMA 인기 글은 llama.cpp PR #19375 병합 소식을 공유하며 Qwen3Next 추론 성능 향상을 집중 조명했다. PR 설명과 커뮤니티 벤치마크 모두에서 불필요한 copy 감소에 따른 t/s 개선이 보고됐다.