LLM Apr 19, 2026 1 min read LLM judge, stakes 한 줄에 unsafe 판정이 30%까지 눈에 띄게 흔들렸다 새 arXiv preprint는 평가 결과의 consequences를 암시하는 한 줄만으로 LLM judge가 더 관대해졌다고 보고했다. 자동 safety·quality benchmark의 취약점이 드러났다. #llm-evals#ai-safety#benchmarks 22