LLM Hacker News Jul 22, 2026 1 min read
Fireworksは約1,030件のagentic taskでKimi K3とFable 5をroutingし、93% accuracyを得たと説明した。HNで注目されたのは、single model運用が費用面で非効率になりつつあるという主張だ。
Fireworksは約1,030件のagentic taskでKimi K3とFable 5をroutingし、93% accuracyを得たと説明した。HNで注目されたのは、single model運用が費用面で非効率になりつつあるという主張だ。
enterprise AIの詰まりどころは、model accessから運用管理へ移っている。NVIDIAは社内Enterprise Inference Hubが100超のmodel endpointと毎週trillions of tokensを処理すると示した。
モデル選択は、静的leaderboardではなく実行時routingの問題になりつつある。OpenRouterはBenchmarks APIでArtificial AnalysisやDesign Arenaを含むlive scoreを取得でき、GLM-5.2がcodingとdesignで上位だと示した。