LLM Hacker News Jun 14, 2026 1 min read
HNで刺さったのは、大きなcontext windowの広告値が実際の作業品質をそのまま保証しないという実務感覚だった。
HNで刺さったのは、大きなcontext windowの広告値が実際の作業品質をそのまま保証しないという実務感覚だった。
r/MachineLearningで再注目されたarXiv 2603.01919は、GPT-5やGemini-2.5へのアクセスをうたうshadow APIを監査し、大きな性能乖離、不安定なsafety挙動、頻繁なmodel identity failureを報告した。