OpenAIはGPT-5.6 Lunaを80%、Terraを20%値下げし、Sol APIにはStandard比で最大2.5倍速いFast modeを追加した。モデル競争の焦点が、性能だけでなく運用単価にも広がっている。
#api
RSSフィードOpenAIは2026年7月28日、GPT TranscribeとGPT Live TranscribeをGAにした。completed file向けとlive audio向けを分け、keyword hintと複数language hintを新しい推奨経路に置く。
OpenAIはGPT-5.6系の3モデルを7月9日に公開する流れを示し、preview accessもglobalに広げる。投稿は368万回以上閲覧され、単一flagshipではなく階層化されたmodel lineupが焦点になる。
7月2日以降、過去60日間にfine-tuned modelでinferenceを実行していない組織は、新しいfine-tuning jobを作成できない。2027年1月6日には既存のアクティブ顧客も新規作成が止まる一方、既存モデルのinferenceはbase modelのdeprecatedまで続く。
OpenAIは2026年5月7日、APIを通じてリアルタイム音声AIモデル3種を公開した。GPT-5クラスの推論を備えたGPT-Realtime-2、70言語以上のリアルタイム翻訳モデル、ストリーミング文字起こしモデルが含まれる。
AnthropicのClaude PlatformがAWSで正式に利用可能になった。AWS IAM認証、CloudTrail監査ログ、単一のAWS請求書への統合をサポートし、既存のAWSコミットメントから費用を差し引くことができる。
GoogleがGemini APIのファイル検索ツールをアップデートし、画像・音声・動画を含むマルチモーダルコンテンツ対応のRAGシステム構築が可能になった。
OpenAIがGPT-5クラスの推論能力を備えたリアルタイム音声モデル「GPT-Realtime-2」をAPIで公開した。リアルタイム翻訳モデル「GPT-Realtime-Translate」とストリーミング文字起こしモデル「GPT-Realtime-Whisper」も同時リリースされた。
xAIがGrok 4.3をAPIでリリースした。エージェンティックなツール呼び出しと指示追従のリーダーボードで首位を獲得し、法律・金融などの企業ドメインでも1位を記録。100万トークンのコンテキストウィンドウを備え、入力$1.25/M・出力$2.50/Mで提供される。
同一の管理画面タスクをビジョンエージェントとAPIエージェントで比較したところ、ビジョン方式は約45倍高コストで、詳細なウォークスルーなしにはタスク完了も不可能だった。
xAIが自社APIを通じてVoice Cloningを正式リリース。短い音声録音から2分以内にカスタムボイスを作成できるほか、28言語・80種以上の事前構築済み音声ライブラリからも選択できる。
HNはGPT-5.5を祝賀ムードより先に検算モードで迎えた。最初に問われたのは、どれだけ賢いかより、価格とコンテキスト帯、そしてコーディング時の振る舞いが本当に改善したのかだった。