【速報解説】Kimi K3 ── 2.8兆パラメータで世界最大、フロントエンド評価でFable 5を超えた
2026年7月16日(昨日)、中国の Moonshot AI が「Kimi K3」を公開しました。
発表された数値がインパクト大です。2.8兆パラメータ。一7/15に Mira Murati の Thinking Machines が 975B(約1兆)で「米国最大オープンウェイト」を名乗ったその翌日、中国勢が約3倍の規模で応えた形になります。さらに Arena.ai の WebDev(フロントエンドコーディング)評価では スコア1,679で世界1位を獲得し、Claude Fable 5(1,631)と GPT-5.6 Sol(1,618)を超えました。
ただし総合評価では全体4位であり、「最強」ではありません。その正直な読み方も含めて整理します。
① Kimi K3 の全体像

開発元:Moonshot AI(北京、2023年創業)
リリース日:2026年7月16日(API・Kimiアプリ)
オープンウェイト公開予定:2026年7月27日(Modified MIT ライセンス)
規模:総パラメータ 2.8兆(2.8T)。世界最大のオープンウェイトモデル。前世代の Kimi K2 が1Tで Inkling が 975B、DeepSeek V4 Pro が約1.6T であることと比べると、その規模感がわかります。
アーキテクチャ:MoE(Mixture of Experts)、1Mトークンコンテキスト、ネイティブビジョン(画像入力対応)
② Moonshot AI とは:DeepSeek ショックからの反転攻勢

Moonshot AI は 2023年創業の中国 AI スタートアップです。
2025年初頭まで、Kimi は中国の AI チャットボット月間アクティブユーザーランキングで3位につけていました。しかし 2025年1月の DeepSeek R1 リリースで市場が激変し、Moonshot はランキングを7位まで落としました。
この危機に対する戦略的回答が「オープンウェイト路線への転換」です。
Kimi K2(2025年7月):1T MoE をオープンソース公開
K2.5(2026年1月):アーキテクチャ改良版
Kimi K3(2026年7月):2.8T で集大成
VentureBeat は「DeepSeekが引き起こした中国 AI の地殻変動の中で、Moonshot が関連性を取り戻すための集大成」と表現しています。
③ スペック:確認済みの数値

学習については、Tom's Hardware が「輸出規制対象外の NVIDIA シリコンと、名前を明かさない代替 GPU ベンダー」と報告しており、Huawei Ascend チップが一部使われている可能性があります。Moonshot AI は学習ハードウェアの詳細を公式には開示していません。
④ ベンチマーク:何が1位で何が4位か

VentureBeat、Simon Willison、Capital & Compute など複数の独立ソースで確認できた数値です。
フロントエンドコーディング(Arena.ai WebDev)
Kimi K3:1,679(#1)
Claude Fable 5:1,631(#2)
GPT-5.6 Sol:1,618(#3) → ブラインド開発者テストで Fable 5・GPT-5.6 を超えて1位
総合知能指数(Artificial Analysis Intelligence Index)
Kimi K3:スコア57・全体4位(187モデル中)
Claude Opus 4.8 と同水準
Fable 5・GPT-5.6 Sol の後塵を拝する
GDPval-AA v2(44職種・9業界の実業務タスク)
Kimi K3:1,687(全体3位)
Claude Fable 5 Max:1,815(1位)
GPT-5.6 Sol Max:1,747.8(2位)
Claude Opus 4.8 を上回る
長期知識作業評価(Artificial Analysis 非公開評価)
Kimi K3:Elo 1547
前世代 K2.6 から +732pt
「Fable 5 のみに後れを取る」
タスクあたりコスト
Kimi K3:$0.94/タスク
GPT-5.6 Sol:$1.04/タスク(約1.1倍)
Claude Opus 4.8:$1.80/タスク(約1.9倍)
→ フロントエンドで1位を取りつつ、総合能力では「Fable 5・GPT-5.6 Sol に次ぐ4位」という正直な位置づけです。Capital & Compute の表現を借りれば「1つのリーダーボードで勝った同じモデルが、より広い評価では3位になる」という構造です。
⑤ 価格の戦略的意味

$3/$15 という価格帯を他のモデルと比べます。
モデル 入力 出力 Claude Fable 5 $10 $50 GPT-5.6 Sol $5 $30 Kimi K3 $3 $15 Grok 4.5 $2 $6 GLM 5.2 $1.40 $4.40
Fable 5 の3分の1のコストでフロントエンドコーディング1位を達成しています。ただし GLM 5.2 や Grok 4.5 よりは高価であり、「安い」というより「Frontier 相当の能力を、クローズドより安く」という位置づけです。
7月27日にオープンウェイトが公開されれば、セルフホスティングによるさらに低コストな運用も理論上は可能ですが、2.8T MoE を自前で動かすには膨大な GPU VRAM が必要です。
⑥ デモ:MacOS クローン生成

デッキで紹介されている最初の実演が「MacOS クローン」の生成です。
Safari ブラウザ・アイコンドック・FaceTime・Siri ボタンを含む macOS 風 UI を、単一のプロンプトからHTML/CSS で生成。ダークモード対応の正確な配色と、複数のインタラクティブコンポーネントが一発で出力されています。
Arena.ai WebDev で Claude Fable 5 を上回った結果と整合する実演です。
⑦ 3D 生成:比較評価

デッキでは Kimi K3・Claude Opus 4.8・Fable 5 の3モデルを同一プロンプトで比較しています。
Kimi K3 は照明・素材・構造物・建築要素の組み合わせで質の高い3D 出力を見せており、Opus 4.8 は物理的な一貫性に課題が見られ、Fable 5 は別カテゴリのマルチタスク展開という評価になっています。ただしこれはデッキ作者の独自比較であり、公式ベンチマークではありません。
⑧ Three.js ゲーム・SVG 生成


Three.js を使った FPS ゲーム生成と、SVG 生成の2つの実演も紹介されています。前者では壁・カラーパレット・ライティング・NPC の挙動を含む完成度の高いゲームが出力されています。
GLM 5.2 が Design Arena 1位だったことを今週 Grok 4.5・GPT-5.6 のデッキで確認しましたが、Kimi K3 はそれを更新して1位になった形です。
⑨ 製品エコシステム

Kimi K3 は単体モデルではなく、複数のアクセス層を持っています。
API / Kimi Coder Harness:開発者向け。ツール呼び出し・JSON モード・構造化出力・コンテキストキャッシングをサポート。OpenAI 互換エンドポイント。
K3 Swarm:マルチエージェント協調機能。複数の K3 インスタンスが協調して複雑なタスクを並列処理する設計。
2.6 Fast:前世代 K2.6 をベースにした高速・低コスト版。予算を抑えたい用途向け。
Kimi Chatbot:一般ユーザー向け kimi.com。月額プランで利用可能(コンテキスト長は下位プランで256K程度、上位で1M全解放)。
⑩ 今週の競合比較:中国勢 vs 米国勢

今週(7/14〜17)のオープンウェイト市場を整理すると、非常に濃密な1週間でした。
リリース日 モデル 開発元 パラメータ 特徴 7/15 Inkling Thinking Machines(米) 975B 米国最大、「最強でない」と正直に 7/16 Kimi K3 Moonshot AI(中) 2.8T WebDev #1 、総合4位 (学習中) Watermelon Thinking Machines(米) 未定 次世代として予告
VentureBeat は「フロンティア AI ベンチマークで米国システムと競合する最初の中国オープンウェイトリリース」と表現しています。「能力ではなく価格でだけ競う」という従来の位置づけを超えて、フロントエンドコーディングという特定のカテゴリでクローズド最強を超えた、という点が今回の評価の核心です。
まとめ
✔ Kimi K3 は2026年7月16日リリース(昨日)。2.8T MoE・1Mコンテキスト・ネイティブビジョン
✔ Arena.ai WebDev(フロントエンド)で1,679を記録し 世界1位(Fable 5を58pt差で上回る)
✔ 総合(AA Intelligence Index)はスコア57で全体4位。GDPval-AA v2 では3位
✔ タスクあたりコスト $0.94(GPT-5.6 Sol の $1.04 より安く、Opus 4.8 の $1.80 の約半分)
✔ 価格 $3/$15 per 1M tokens。Fable 5 の3分の1、GPT-5.6 Sol の6割
✔ オープンウェイト(Modified MIT)は7月27日公開予定
✔ Inkling(975B)の翌日に 2.8T で登場──今週は「中国 vs 米国オープンウェイト戦争の1週間」
「フロントエンドで世界1位」という事実は本物です。ただしそれは特定のリーダーボード上の話であり、総合的な能力では Fable 5・GPT-5.6 Sol の後塵を拝します。Capital & Compute の言葉が的確です──「そのリーダーボードで勝ったモデルが、より広い評価では3位になる。どちらの事実も本物だ」。
#KimiK3 #MoonshotAI #Kimi #生成AI #AI #LLM #オープンウェイト #中国AI #フロントエンドAI #AIエージェント #海外AIニュース #AIニュース #速報 #Inkling比較 #WebDev1位 #MoE #マルチモーダル #テクノロジー #DeepSeek比較 #note #AIクラッチ
