Gemma 4 ガイド

Kimi K3 vs Qwen 3.8:確定していることと未確定のこと(2026 年 7 月)

約 8 分
kimi k3qwen 3.8model comparisonmoonshot aialibaba
Kimi K3 vs Qwen 3.8:確定していることと未確定のこと(2026 年 7 月)

Kimi K3 vs Qwen 3.8:確定していることと未確定のこと

Moonshot AI の Kimi K3 ローンチ 3 日後、Alibaba の Qwen チームは Qwen3.8-Max-Preview を preview しました — 2.4 兆パラメータモデルで、frontier 性能に匹敵し「Fable 5 に次ぐ」と説明されています。タイミングは偶然ではありません:Qwen 3.8 は Kimi K3 が作ったニュースサイクルに直接入り込み、Alibaba 自身の framing も K3 の momentum への直接回答として位置づけています。

実際に 2 つを比較しようとする人にとっての catch:執筆時点で Qwen 3.8 には独立検証済みベンチマークが 1 つも公開されていません。 Alibaba の「Fable 5 に次ぐ」claim は company positioning であり、leaderboard 結果ではありません。本稿では各モデルで確定している内容、まだ claim のままの部分、今日どちらかを選ばなければならない場合の意味を整理します。

confirmed vs unconfirmed データパネルとパラメータ数バーを並べた Kimi K3 と Qwen 3.8 の比較イラスト

先に結論

  • Kimi K3 には今、real で test 可能な track record がある:公開 pricing、独立運営 #1 leaderboard 結果(LMArena Frontend Code Arena)、Artificial Analysis による third-party benchmark データ。
  • Qwen 3.8 は preview で、独立検証はほぼゼロ:公開 context window なし、per-token API pricing なし、third-party benchmark score ゼロ。Alibaba の性能 claim は未確認の marketing 文言。
  • 今日 evaluate して deploy できるモデルが必要なら、Kimi K3 だけが public 情報が十分にある。
  • space を monitor しているだけなら、Alibaba が real 数字を出したら Qwen 3.8 は watch 対象 — ただし今は test するものがない。
  • どちらも downloadable open weights はまだない。 K3 は 2026 年 7 月 27 日予定。Qwen 3.8 は「soon」約束、日付なし。

なぜこの比較が trending か — そして多くの記事が wrong な理由

「Qwen 3.8 vs Kimi K3」は今週最も急上昇している AI 検索語の 1 つ。2 つの largest open-weight モデルが 3 日差で登場したから当然。ただし Qwen 3.8 はまだ preview で public benchmark がないため、2 つの head-to-head score を示す記事は、未検証 vendor marketing を fact として引用するか、まだ存在しない数字を invent している。本稿ではそうしない。各社が実際に確認した内容を primary coverage に sourced し、gap は paper over せず visible のまま残す。

リリースタイミングと positioning

Kimi K3 Qwen 3.8 (Qwen3.8-Max-Preview)
Vendor Moonshot AI Alibaba (Qwen team)
発表 2026 年 7 月 16 日 2026 年 7 月 19 日
ステータス API、アプリ、OpenRouter 経由で generally available Preview のみ、Token Plan / Qoder / QoderWork 経由
Positioning Open-weight frontier generalist、agent 最適化 Multimodal flagship、Kimi K3 momentum を追う positioning
Vendor 自身の framing 「これまでに公開された最大 open-weight モデル」 「frontier モデルに匹敵、Fable 5 のみに劣る」(未検証)

Qwen 3.8 のリリースは Kimi K3 への direct response と読める:Alibaba は Qwen3.7-Max(2026 年 5 月)まで Max-tier flagship を closed・API-only に保ち、Qwen 3.8 はそのラインで open-weight 化すると言った初のモデル — Moonshot が K3 で news cycle を支配した数日後と同じ move。

各モデルで実際に確定していること

Kimi K3 Qwen 3.8
総パラメータ 2.8 trillion 2.4 trillion(headline 数字、独立未検証)
Active parameters / MoE config 896 expert 中 1 token あたり 16 活性 未開示
Context window 1,048,576 tokens (~1M) 未公開
Multimodal input ネイティブ image understanding 画像、動画、ドキュメント(Alibaba 初の >1T multimodal モデル)
API pricing $3.00 / MTok input、$15.00 / MTok output、$0.30 / MTok cached 未公開 — Token Plan 経由 preview は「標準価格の 10%」、standalone rate なし
Independent benchmark data あり — Artificial Analysis Intelligence Index (57)、LMArena Frontend Code Arena (#1、独立 crowd-voted) 公開なし
Open weights 約束済み、2026 年 7 月 27 日予定 「soon」約束、日付なし、Hugging Face repo なし
License Modified MIT-style(予定) 未確認

その table の gap が今の whole story。Kimi K3 には spend model に入れられる price と third party が run した leaderboard 結果がある。Qwen 3.8 には parameter count と 1 文の marketing copy。

Qwen 3.8 から得られる 1 つの real signal:Moonshot への示唆

benchmark がなくても、Qwen 3.8 ローンチは別理由で informative:competitor が Kimi K3 をどれだけ seriously 見ているかの data point。Qwen 3.8 発表時に引用された Bloomberg 報道によると、Moonshot AI は 2026 年 6 月に annual recurring revenue $300M 超、IPO 準備中。Alibaba が K3 ローンチ 3 日後に 2.4T open-weight flagship を preview — Max-tier を closed に保つ past pattern から break — は competitive reaction で coincidence ではない。今日 model を選ぶより market を read するなら、either company の benchmark claim より reliable な signal。

Kimi K3 の独立検証 track record

Qwen 3.8 に comparable data がまだないため、Moonshot 以外が Kimi K3 で実際に check した内容:

  • LMArena Frontend Code Arena — crowd-voted、独立運営 leaderboard。vendor benchmark ではない。K3 はローンチから数時間で #18 から #1 へ、Claude Fable 5 を抜き、7 frontend domain 中 6 つで 1 位。
  • Artificial Analysis — 独立 evaluator — Intelligence Index (v4.1) で K3 に 57、Claude Opus 4.8 (56) 上、Claude Fable 5 (60) 下。別途 private long-horizon knowledge-work Elo 1,547、Kimi K2.6 比 +732 点
  • Cost-efficiency:Artificial Analysis は K3 cost-per-task 約 $0.94、同一 private evaluation で GPT-5.6 Sol $1.04 やや下。

これは Qwen 3.8 が real 数字を出した後 K3 が「better」と guarantee するものではない — evaluatable と not-yet-evaluatable の差。

短期 complication:Kimi K3 は今 capacity constrained

今週どちらを actually try するか決めるなら知っておくべき:Moonshot は 2026 年 7 月 19 日に新 Kimi K3 subscription を pause。demand がローンチ 48 時間で GPU capacity limit 近くまで。existing subscriber と API customer は unaffected。Moonshot は batch で新 signup を reopen — 詳細は Kimi K3 が sold out になった理由。今週 specifically consumer app で新 account の hands-on access を取ろうとするなら、Qwen 3.8 preview program が smaller で newer なため、今 Qwen 3.8 にない real practical obstacle。

今どちらを使うべきか

Kimi K3 を使うなら:

  • 今日 real pricing と independently-verified benchmark data で actually evaluate できる model が必要。
  • workload が agentic coding、frontend generation、long-horizon tool use — K3 の independently-verified 結果が strongest な category。
  • 現在の subscription pause 内で work できる(または wait out)、または still-open API と OpenRouter 経由。

Qwen 3.8 は watch、まだ commit しないなら:

  • 別 vendor から second open-weight option で redundancy — ただし Alibaba が pricing、context window、benchmark data を publish するまで real evaluation plan は組めない。
  • Alibaba scale の multimodal document/video handling が specifically valuable で、open-weight release と real 数字を wait できる。

今日 2 モデル間の hard head-to-head benchmark 数字を claim する記事は trust しない — Qwen 3.8 が publish していなければ、unverified vendor claim を fact にするか fabricating。

後で check back すべきこと

  • Qwen 3.8 benchmark score — Artificial Analysis または comparable independent evaluator から。
  • Qwen 3.8 公式 per-token API pricing — promotional Token Plan preview rate 以外。
  • Qwen 3.8 context window と active-parameter/MoE configuration。
  • 両モデルの open-weight release — K3 は 2026 年 7 月 27 日予定。Qwen 3.8 は confirmed date なし。

Alibaba が real 数字を publish したら estimate で backfill せず update する。

FAQ

Qwen 3.8 は Kimi K3 より優れている?
執筆時点では unknown。Alibaba は Qwen 3.8 が「Fable 5 に次ぐ」と claim するが、support する independent または self-reported benchmark score を publish していない。Kimi K3 には independently-verified 結果(LMArena Frontend Code Arena、Artificial Analysis)があり、Qwen 3.8 には現時点でない。

Qwen 3.8 は Kimi K3 より大きい?
No — Qwen 3.8 は 2.4 trillion total parameters、Kimi K3 は 2.8 trillion。headline parameter count では K3 が larger。

Qwen 3.8 は open source?
Alibaba は open weights「soon」と述べたが、執筆時点で Hugging Face repo、confirmed release date、confirmed license なし。Kimi K3 も similar pending だが specific committed date あり:2026 年 7 月 27 日。

Qwen 3.8 の利用コストは?
Alibaba は Qwen 3.8 の standalone per-token API pricing を publish していない。Preview は Token Plan、Qoder、QoderWork で「標準価格の 10%」だが promotional preview rate であり published production price ではない。

Alibaba はなぜ Kimi K3 の直後に Qwen 3.8 を出した?
タイミング — K3 ローンチ 3 日後 — と explicit「Fable 5 に次ぐ」framing、Max-tier closed 伝統からの break が、Kimi K3 launch momentum と Moonshot AI reported growth(2026 年 6 月約 $300M ARR)および IPO 準備への direct competitive response と読める。

今 Qwen 3.8 を使える?
Preview のみ。Alibaba Token Plan、Qoder、QoderWork 経由。general API access や open-weight download はまだない。

関連ガイド

関連記事

Gemma 4 の記事群をそのまま辿り、今の判断にいちばん近い次の記事へ進んでください。

次に何を読めばいいか迷っていますか?

ガイド一覧に戻って、モデル比較、ローカル導入、ハードウェア計画の3方向から続けて見ていけます。