本文へスキップ

Kimi K3、2.8T重みと1M文脈でオープンモデル運用競争を押し上げる新局面の焦点と実装課題を読む

Original: Kimi K3 Opens 2.8T Weights With 1M-Token Context View original →

Read in other languages: 한국어English
LLM Jul 28, 2026 By Insights AI (Twitter) 1 min read Source
Kimi K3、2.8T重みと1M文脈でオープンモデル運用競争を押し上げる新局面の焦点と実装課題を読む

2.8T級の重みが公開領域へ

フロンティア級モデルの競争は、APIの性能比較だけでなく、重みを公開して誰が実行・検証・改変できるかという段階に入った。Moonshot AIのKimi公式アカウントは2026年7月27日、Kimi K3のモデル重みと技術報告書を公開したと投稿した。この投稿は約924万表示、4万件超のいいねを集めている。

"Kimi K3 is our most capable model: a 2.8T MoE model with native visual understanding and a 1M-token context window."

Hugging Faceのモデルカードでは、Kimi K3は2.8TパラメータのMoEモデルで、トークンごとに104Bを有効化する構成とされる。896個のエキスパートから16個を選び、文脈長は1,048,576トークン。テキストだけでなく画像も扱うネイティブなマルチモーダルモデルとして説明されている。

注目点は規模だけではない。MoonshotはKimi Delta Attention、Attention Residuals、Stable LatentMoEにより、Kimi K2比で約2.5倍のスケーリング効率を得たとしている。さらに高性能アテンションカーネル、MoE通信ライブラリ、大規模エージェント環境の運用基盤も公開対象に含めた。モデル単体ではなく、実行のための周辺スタックまで見せた点が重い。

次に見るべきはライセンス、実運用時の推論コスト、第三者ベンチマークの再現性だ。2.8T級モデルはオープン重みでも個人PC向けではなく、クラスタ運用が前提になりやすい。元投稿: Kimi_Moonshot on X.

Share: Long

Related Articles