LLM Jul 18, 2026 1 min read
OpenAIは、AIの費用対効果をトークン単価ではなく成功タスクあたりのコストで測るべきだと示した。GPT-5.6 SolはDeepSWE v1.1で72.7%を記録し、Claude Fable 5の69.9%を上回り、推定APIコストは36.2%低いとされる。
OpenAIは、AIの費用対効果をトークン単価ではなく成功タスクあたりのコストで測るべきだと示した。GPT-5.6 SolはDeepSWE v1.1で72.7%を記録し、Claude Fable 5の69.9%を上回り、推定APIコストは36.2%低いとされる。
Trump大統領は、AI企業の成功から米国民が利益を得る仕組みを企業側と話し合ったと述べた。OpenAIが有力候補として報じられ、AIの成長益を公的に分配する議論が政策課題になっている。
重要なのは、AIによるlabor riskが抽象的な予測からuser responseに基づく測定へ移っている点だ。Anthropicは81,000件の回答を分析し、高exposure職種ではjob displacementへの言及が約3倍多いと示した。
話題になったHNスレッドでは、Claude Codeユーザー1人あたり月$5,000という数字はAnthropicの実コストではなく、retail API換算の利用額を示している可能性が高いと論じられた。