LLM News Jun 26, 2026 1 min read
Google Research는 Gemini-2.5와 Qwen3-32B 실험에서 reasoning이 단순 사실 질문의 회상을 돕는 두 메커니즘을 분리했다. 추가 토큰은 계산 시간을 주고, 관련 사실은 정답 회상을 prime하지만 hallucination이 끼면 정확도가 떨어졌다.
Google Research는 Gemini-2.5와 Qwen3-32B 실험에서 reasoning이 단순 사실 질문의 회상을 돕는 두 메커니즘을 분리했다. 추가 토큰은 계산 시간을 주고, 관련 사실은 정답 회상을 prime하지만 hallucination이 끼면 정확도가 떨어졌다.
OpenAI가 GPT-5.5 Instant를 ChatGPT의 새 기본 모델로 배포했다. 의료·법률·금융 등 고위험 쿼리에서 환각이 52.5% 감소했고, Gmail 기반 개인화와 메모리 출처 표시 기능도 추가됐다.
r/LocalLLaMA에서 Whisper가 무음 구간에 텍스트를 생성하는 문제와 함께, Silero VAD·prompt history 차단·blocklist를 결합한 운영 대응법이 공유됐다.
r/singularity에서 H-Neurons 논문이 빠르게 확산됐다. 논문 초록은 전체 뉴런의 0.1% 미만으로 환각 발생을 예측할 수 있으며, 개입 실험에서 인과적 연관성을 보였다고 주장한다.
Perplexity가 Claude, GPT-5.2, Gemini 등 여러 최신 AI 모델을 병렬로 실행해 통합된 답변을 생성하는 Model Council을 출시했다. 교차 검증을 통해 추론 품질을 크게 개선하고 환각 오류를 줄인다.