AIXC - AI Experience Center

Moonshot AI、2.8兆パラメータの「Kimi K3」がフロントエンドコードArenaでClaude Fable 5を上回り1位に

Moonshot AI、2.8兆パラメータの「Kimi K3」がフロントエンドコードArenaでClaude Fable 5を上回り1位に
LLM Anthropic
2026.07.17

本記事はAIを活用して自動収集・要約しています。サムネイルおよび画像もAIツールを使用して生成しています。

世界最大級のオープンウェイトモデル「Kimi K3」

北京拠点のMoonshot AIは、2.8兆パラメータの大規模言語モデル(LLM)「Kimi K3」を発表しました。同社は技術ブログで、これを「世界初のオープンな3Tクラスのシステム」であり「現時点で最大のオープンウェイトAIモデル」と位置づけています。総合性能ではAnthropicの「Claude Fable 5」やOpenAIの「GPT-5.6 Sol」に及ばないとしつつ、コーディングおよびエージェント系ベンチマークでは「Claude Opus 4.8」や「GPT-5.5」を含む他の全モデルを上回ったと説明しています。

主な仕様は次のとおりです。

  • コンテキストウィンドウは100万トークン、ネイティブの画像認識に対応
  • Mixture of Experts構成で、トークンごとに896のエキスパートのうち16(全体の約1.8%)のみを起動
  • 完全なモデルの重み(weights)は7月27日に公開予定

フロントエンドコードArenaで1位を獲得

ブラインド形式の開発者評価「Frontend Code Arena」で、Kimi K3は1,679ポイントを獲得し、Claude Fable 5を上回って1位となりました。前バージョン「Kimi-k2.6」の18位から17ランクの上昇で、7分野中6分野(ブランド&マーケティング、リファレンスベースデザイン、データ&分析など)で首位を占めたとされています。

一方でAPI価格は上昇しています。

  • キャッシュヒット時の入力:100万トークンあたり0.30ドル
  • キャッシュミス時の入力:100万トークンあたり3ドル
  • 出力:100万トークンあたり15ドル

1年前に登場した「Kimi K2」の入力価格は100万トークンあたり0.60ドルだったため、キャッシュ未使用時の入力コストは約5倍に上昇した計算になります。

アーキテクチャと学習効率

Moonshotは、K2比で約2.5倍のスケーリング効率の改善を実現したと主張しています。これは「Kimi Delta Attention」(ハイブリッド型の線形アテンション)と、層間の情報伝達方式を変える「Attention Residuals」という2つのアーキテクチャ上の変更によるものとしています。量子化を意識した学習(QAT)を教師ありファインチューニングの段階から導入し、重みにMXFP4、活性化にMXFP8を採用。幅広いハードウェアとの互換性を狙ったとしています。バンク・オブ・アメリカのAlex Liu氏らはCNBC向けのノートで、計算資源の制約下でも大規模な事前学習とアーキテクチャの工夫によって中国のフラッグシップモデルが大きな性能向上を実現しうる、と指摘しました。

使用ハードウェアと残る論点

カーネル最適化のベンチマークはNvidia「H200」と、社名を明かさない「別ベンダーのGPGPU」で実施されました。K3が独自に構築したTriton風コンパイラ「MiniTriton」は、対中輸出向けに性能を制限したAdaベースのカード「L20」上のTritonと比較されています。同社は64基以上のアクセラレータで構成する「スーパーノード」での運用を推奨しています。なお米議会は1月、中国企業が規制対象アクセラレータに遠隔アクセスできる「オフショアのクラウドレンタルの抜け穴」を塞ぐ法案を可決しています。

事例として、K3は48時間の自律実行でオープンソースのEDAツールとNangate 45nmライブラリを用い、自身のアーキテクチャに基づく小型モデル向けの推論チップ(シミュレーション)を設計。100MHz・4mm²内でタイミングを収束させ、146万個の標準セルとINT4のMAC配列を実装し、シミュレーション上で毎秒8,700トークン超のデコード性能を維持したとしています。

ただし現時点で公表されているK3の数値はすべてMoonshotによる主張、またはAPI経由のアクセスに基づくもので、7月27日に重みが公開されるまで検証はできません。Anthropicは2月、Moonshotが自社モデルの学習に340万件のClaudeとのやり取りを蒸留(distillation)の形で利用したと非難しており、K3はその指摘で名指しされたモデルと数ポイント差にまで迫っています。


出典:Tom's Hardware「China's 2.8-trillion-parameter Kimi K3 beats Claude Fable 5 in Frontend Code Arena benchmark」(2026年7月17日)https://www.tomshardware.com/tech-industry/artificial-intelligence/moonshot-releases-2-8-trillion-parameter-kimi-k3

おすすめコンテンツ

Meta、ターミナル型コーディングエージェント「Muse Code」と新モデル「Muse Spark 1.2」を発表

AIエージェントLLM
2026.08.05

Microsoft、社内のCopilot利用にAIトークン予算を導入──GPT-5.6 Solを既定モデルに設定

GitHub CopilotLLM
2026.08.06

Meta、コンシューマー端末で動くオープンウェイトモデル「Muse Glimmer」を公開——ザッカーバーグ氏の「パーソナルインテリジェンス」構想を体現

AIエージェントLLM
2026.08.10

OpenAI、未解決の数学問題10件を解いた次世代モデル「Astra」を発表

LLM
2026.08.01

Anthropic、新モデル「Claude Opus 5」を発表——最先端性能を半額のコストで実現

AnthropicLLM
2026.07.24

アリババ、「最も強力」なAIモデル『Qwen3.8-Max』発表で株価上昇——米中のAI覇権争いが激化

LLMAnthropic
2026.08.03

Anthropic、AIクラウドスタートアップVolta社と100億ドル規模のコンピュート契約を締結

Anthropic
2026.08.04

Anthropic、Tino Cuéllar氏を初代Chief Global Affairs Officerに起用

Anthropic
2026.08.04

Mistral AI、コンテンツ安全性を判定するオープンウェイトモデル「Shieldstral」を発表

AIセキュリティLLM
2026.08.04

OpenAI、ChatGPTの「GPT-5.6 Sol」を改善——無料ユーザー向けに「GPT-5.6 Luna」の提供を拡大

LLM
2026.08.06

Meta、ターミナル型コーディングエージェント「Muse Code」と新モデル「Muse Spark 1.2」を発表

AIエージェントLLM
2026.08.05

Microsoft、社内のCopilot利用にAIトークン予算を導入──GPT-5.6 Solを既定モデルに設定

GitHub CopilotLLM
2026.08.06

Meta、コンシューマー端末で動くオープンウェイトモデル「Muse Glimmer」を公開——ザッカーバーグ氏の「パーソナルインテリジェンス」構想を体現

AIエージェントLLM
2026.08.10

OpenAI、未解決の数学問題10件を解いた次世代モデル「Astra」を発表

LLM
2026.08.01

Anthropic、新モデル「Claude Opus 5」を発表——最先端性能を半額のコストで実現

AnthropicLLM
2026.07.24

アリババ、「最も強力」なAIモデル『Qwen3.8-Max』発表で株価上昇——米中のAI覇権争いが激化

LLMAnthropic
2026.08.03

業界・規模問わず実績5,000社以上、
まずはお気軽にご相談ください

技術活用に役立つ情報や
サービス資料を公開しています

資料請求

相談しやすいスペシャリストが
お悩みに対応します

お問い合わせ

お電話でもお問い合わせできます
(平日9:30〜18:30)

0120-991-668