7月27日ウェイト公開 · Hugging Face 1.56TB · MoonEP / FlashKDA / AgentEnv · カスタムライセンス · API $0.30〜$15/M
要約:2026年7月27日夜、Moonshot AI(月之暗面)は2.8兆パラメータのMixture-of-Expertsモデル Kimi K3 の完全ウェイトと技術レポートを公開しました。100万トークンのコンテキストウィンドウとネイティブなビジョン理解を備えます。あわせて3つのインフラ技術——MoonEP、FlashKDA、AgentEnv——もオープンソース化されています。1.56TBのダウンロードは公開から30分でHugging Faceトレンド1位に。Moonshotは一貫して「オープンウェイト」と呼び、「オープンソース」とは言いません。この区別こそ、スペックやベンチマークの前に押さえるべき第一歩です。
オープンソース vs オープンウェイト:見出しは「オープンソース」、Moonshot公式はオープンウェイト——学習データと完全な学習コードは非公開です
自前ホストはコンシューマー向けではない:1.56TB・896エキスパート。Moonshotは64基以上の加速器スーパーノードを推奨しています
新しい商用ゲート:カスタムライセンスにMaaS収益2,000万ドル閾値とMAU1億の表示義務——K2のModified MIT時代とは異なります
能力≠コスパ最適解:Intelligence Indexでタスクあたり約$0.95——Claude Fable 5より安いが、GLM-5.2(約$0.47)より高い
地政学と蒸留疑惑:米国の産業蒸留指摘がウェイト公開の数日前——技術的価値とコンプライアンスリスクは切り分けて判断してください
Open Source Initiativeの定義では、真のオープンソースには公開された学習データ、学習コード、再現可能なパイプラインが必要です——学習済みウェイトだけでは足りません。Kimi K3はウェイト、技術レポート、学習周辺のインフラツールを提供しますが、学習データと完全な学習コードは含まれません。
ライセンスは完全カスタム文書で、2つの商用閾値があります:
MaaS収益ゲート:直近12か月のModel-as-a-Service収益が2,000万ドルを超える場合、Moonshotとの別途契約が必要です
表示義務ゲート:MAU1億超、または月商2,000万ドル超の製品は「Kimi K3」を目立つ形で表示する必要があります
| 項目 | 値 |
|---|---|
| 総パラメータ数 | 2.8兆 |
| アクティブパラメータ | 約1,040億 |
| アーキテクチャ | Mixture-of-Experts(MoE) |
| エキスパート | 896ルーティング、トークンあたり16活性化+共有エキスパート |
| アテンション | Kimi Delta Attention(KDA)+ Gated MLA |
| コンテキスト | 1,000,000トークン |
| マルチモーダル | ネイティブビジョン(ViT-V2、27層) |
| ウェイト形式 | MXFP4ウェイト、MXFP8活性化 |
| ダウンロードサイズ | 約1.56TB(Hugging Face) |
| ライセンス | カスタム——Moonshotは「オープンウェイト」と表記 |
| API提供開始 | 2026年7月16日 |
| 完全ウェイト公開 | 2026年7月27日 |
KDAはスカラー忘却ゲートをチャネル単位のゲーティングに置き換えます——各特徴次元が独自の減衰率を持ちます。chunkwise DPLRで線形時間の再帰を実現し、K3はKDAとGated MLAグローバル層を交互に配置して1Mコンテキストを支えつつKVキャッシュを小さく保ちます。
AttnResは均一な残差蓄積を、先行層への入力依存型集約に置き換えます——コスト2%未満の増加で学習効率が約25%向上。疑似クエリベクトルはゼロ初期化で早期学習を安定化させます。
Muonはアテンションヘッド単位で動作。MoEは896エキスパートからトークンあたり16を活性化(約1.8%スパース)し、Quantile BalancingとMoonEPで負荷分散します。
| 技術 | 役割 | 主要指標 |
|---|---|---|
| MoonEP | 超大規模MoE通信 | 過負荷エキスパートを複製。ランクあたり冗長エキスパート上限を証明 |
| FlashKDA | CUTLASS KDAカーネル(先行公開) | H20でprefillがflash-linear-attention比1.72〜2.22倍高速 |
| AgentEnv | Firecracker microVM+KVCache.aiサンドボックス | チェックポイント約133ms、再開約49ms、最大6.5倍メモリオーバーコミット(ベンダー報告) |
SWE-bench Verified(Vals AI、2026年7月):Claude Opus 5 97%、GPT-5.6 Sol 96.2%、Claude Fable 5 95%、Kimi K3 93.4%。
Artificial Analysis Intelligence Index(最大推論):Fable 5 60、GPT-5.6 Sol 59、K3 約57(総合3位、オープンウェイト1位)、GLM-5.2 51。タスク単価は約$0.95——Fable 5(約$2.40)より約60%安いが、GLM-5.2(約$0.47)より高い。オープンウェイト層の能力上限であり、コスパ最適解ではありません。K3はArena.aiのFrontend Code Arenaで1位です。
| 経路 | 向いている用途 | 障壁・コスト |
|---|---|---|
公式API(kimi-k3) | 個人・迅速な検証 | キャッシュ入力$0.30/M、ミス$3/M、出力$15/M |
| OpenRouter等 | マルチモデルルーティング | 約7プロバイダ、ほぼ公式価格 |
| 完全ウェイト自前ホスト | 超大規模呼び出し・研究機関 | 1.56TB+64基以上の加速器スーパーノード |
OpenAI互換SDKでhttps://api.moonshot.ai/v1、モデルID kimi-k3を呼び出し。長コンテキストとキャッシュヒットをテストします
ワークロードをK3の強み(フロントエンドコード、長文ドキュメント)とギャップにマッピング。SWE-benchとAA Indexを参照してください
法務にHugging FaceのLICENSEを確認させ、MaaSとMAUゲートをレビューします
自前ホストの場合:1.56TBストレージと64基以上の加速器を予算化。MoonEP / FlashKDA統合を評価します
実macOS GUIセッションでKimi Code / OpenClawマルチモデルAgentを検証します(下記VNCMac参照)
公開はWAIC 2026期間中、AnthropicのFableモデルへの産業蒸留疑惑が米国で報じられた直後に行われました。中国商務部は7月28日に反論。3日後、AlibabaはQwen3.8-Max-Preview(2.4T)を発表し、オープンウェイト競争は「3Tクラブ」へと突入しました。
OSI基準ではいいえ。オープンウェイトです。ウェイト・レポート・一部インフラは公開、学習データと完全な学習コードは非公開です。
大多数のケースでは可能です。MaaS収益2,000万ドル超、またはMAU1億超・月商2,000万ドル超で追加条項が適用されます。
64基以上の加速器スーパーノード。それ以外はAPIまたはOpenRouterをご利用ください。
SWE-benchではトップクローズドモデル(93.4% vs 95〜97%)に及びませんが、市場最強のオープンウェイトモデルです。
約3倍のパラメータ、AttnRes+Per-Head Muon、拡大したコンテキストとマルチモーダル。新MaaSライセンスゲートが追加されました。
K3は史上最大のオープンウェイト見出しを1.56TBのダウンロードに変えました——しかしオープンウェイトはオープンソースではなく、大多数のチームは引き続きAPI経由でK3を使うことになります。メインマシンがWindowsやLinuxで、Kimi Code、OpenClawルーティング、iOSビルド基準のために実macOS GUIが必要なら、Mac購入は高コストで、SSHでは権限ダイアログを押せません。VNCMacリモートMacを時間課金で借り、VNCでAgentを検証し、プロジェクト終了後に停止できます。Macレンタルプラン、または7月17日のKimi K3徹底評価もご覧ください。
出典:Moonshot AIブログ、Hugging Face、Vals AI、Artificial Analysis、VentureBeat、Simon Willison。本番判断前に公式データでご確認ください。