Anthropic社内市場実験、Claudeエージェント69体が186件成立した背景と次に見るべき論点
Original: Anthropic's Project Deal shows Claude agents can negotiate real office trades View original →
Anthropicが今回示したのは、Claudeが上手に会話できるという話ではない。AIエージェントが人の代理で値付けし、相手を探し、条件を詰め、実際の取引をまとめられるかを、社内の市場で試した点に意味がある。Project Dealと名付けた1週間の実験では、サンフランシスコのオフィス内でClaudeベースのエージェントに売買と価格交渉を任せた。実際の受け渡し対象となったランでは、69体のエージェントが500件超の出品から186件の取引を成立させ、総額は4,000ドルを少し上回った。
“We created a marketplace for employees in our San Francisco office”
この一文はAnthropicのソース投稿からの抜粋だ。リンク先のProject Dealの解説ページには実験条件がより詳しく載っている。参加者は売りたい物と欲しい物をClaudeに伝え、各エージェントには100ドルの予算が与えられた。市場そのものはSlack上で動き、開始後は人が途中承認を入れない。入札、再提示、合意までをエージェントが自然言語で処理した。
面白いのは、Anthropicがこの市場を1回だけ回したわけではないことだ。市場は4本並行で動き、2本はClaude Opus 4.5、残り2本は参加者の半数にClaude Haiku 4.5を割り当てた。会社の追記と解説ページは同じ結論を示している。性能の高いモデルほど実際に有利だった。ここでの差は抽象的なベンチマーク点ではなく、価格交渉の強さや成約の質として現れる。
一方で、きれいな成功談だけでは終わらない。ページには、最初から安く吹っかけるエージェント、好かれようとしすぎるエージェント、ユーザーの嗜好と市場インセンティブの間で揺れるエージェントも出てくる。つまり、代理取引は技術的には成立したが、競争が強い環境に移るとどんな最適化が走るかはまだ読めない。人間向けECが注意の奪い合いへ傾いたように、将来はAIエージェントの注意や行動そのものが最適化対象になる可能性がある。
AnthropicAIのアカウントは、Claudeの製品更新、安全性ポリシー、研究ノートを横断して発信することが多いが、今回はその中でも研究色が強い投稿だ。次に見るべき点は、この市場実験がより敵対的な条件でも成立するのか、失敗例や悪用パターンがどこまで公開されるのかだ。一次ソースは投稿と原文ページにある。
Related Articles
Sonnet級モデルが、より高価なOpus系に近いagent作業を日常プランへ持ち込む。Free/Proの標準モデルとなり、APIでは8月31日まで入力100万tokenあたり$2、出力100万tokenあたり$10で提供される。
高性能モデルの競争軸が、最高点だけでなく費用対効果へ移っている。Claude Opus 5はFable 5に近いcoding・知識作業性能を掲げ、API価格は入力$5/M・出力$25/M tokensに据え置かれた。
AnthropicAIは2026年3月24日、Claudeをfrontendや長時間software engineeringでより安定して使うためのmulti-agent harness記事を取り上げた。元記事ではinitializer agent、incremental coding session、progress log、structured feature list、browser-based testingを組み合わせ、context-window driftやpremature completionを抑える方法を説明している。