Gemma 4 指南

Kimi K3 vs Qwen 3.8:已确认与未确认(2026 年 7 月)

约 8 分钟
kimi k3qwen 3.8model comparisonmoonshot aialibaba
Kimi K3 vs Qwen 3.8:已确认与未确认(2026 年 7 月)

Kimi K3 vs Qwen 3.8:已确认与未确认

Moonshot AI 的 Kimi K3 发布三天后,阿里巴巴 Qwen 团队 preview 了 Qwen3.8-Max-Preview——一个 2.4 万亿参数模型,被描述为达到 frontier 性能且「仅次于 Fable 5」。时机并非巧合:Qwen 3.8 直接进入了 Kimi K3 创造的新闻周期,阿里巴巴自身的 framing 也将其定位为对 K3 势头的直接回应。

对任何想实际对比两者的人来说,catch 在于:截至本文撰写时,Qwen 3.8 尚未发布任何独立验证的 benchmark。 阿里巴巴「仅次于 Fable 5」的说法是公司 positioning,而非 leaderboard 结果。本指南逐一列出每个模型已确认的内容、仍只是 claim 的部分,以及若今天必须二选一时意味着什么。

Kimi K3 与 Qwen 3.8 并排对比插图,含已确认/未确认数据面板与参数规模条形图

快速结论

  • Kimi K3 现在有真实、可测试的 track record:已公布定价、独立运行的 #1 leaderboard 结果(LMArena Frontend Code Arena),以及 Artificial Analysis 的第三方 benchmark 数据。
  • Qwen 3.8 是 preview,几乎没有任何独立验证:未公布 context window、未公布 per-token API 定价、零第三方 benchmark 分数。阿里巴巴的性能 claim 是未确认的营销用语。
  • 若你需要今天就能评估和部署的模型,Kimi K3 是两者中唯一拥有足够公开信息可操作的。
  • 若你只是在观察这个领域,Qwen 3.8 值得在阿里巴巴发布真实数字后关注——但目前尚无可测试内容。
  • 两者都尚无可下载的 open weights。 K3 预计 2026 年 7 月 27 日;Qwen 3.8 承诺「soon」,无具体日期。

为何这个对比在 trending——以及为何多数版本是错的

「Qwen 3.8 vs Kimi K3」是本周增长最快的 AI 搜索词之一,这合理:史上最大 open-weight 模型之二相隔三天发布。但由于 Qwen 3.8 仍是 preview 且无公开 benchmark,任何声称展示两者 head-to-head 分数的文章,要么将未验证的 vendor 营销当作事实,要么编造尚不存在的数字。我们不会这样做。以下是各公司实际确认的内容,来源为一手报道,缺口保持可见而非被掩盖。

发布时机与 positioning

Kimi K3 Qwen 3.8 (Qwen3.8-Max-Preview)
Vendor Moonshot AI Alibaba (Qwen team)
宣布日期 2026 年 7 月 16 日 2026 年 7 月 19 日
状态 通过 API、App 和 OpenRouter 普遍可用 仅 preview,通过 Token Plan / Qoder / QoderWork
Positioning Open-weight frontier generalist,agent 优化 Multimodal flagship,定位为追赶 Kimi K3 势头
Vendor 自身 framing 「迄今发布的最大 open-weight 模型」 「匹配 frontier 模型,仅落后于 Fable 5」(未验证)

Qwen 3.8 的发布读起来像对 Kimi K3 的直接回应:阿里巴巴在 Qwen3.7-Max(2026 年 5 月发布)之前一直将 Max-tier flagship 保持 closed 且仅 API;Qwen 3.8 是该系列中阿里巴巴首次表示将 open-weight 的——与 Moonshot 对 K3 的做法相同,在 K3 主导新闻周期数日后。

各模型实际已确认的内容

Kimi K3 Qwen 3.8
总参数 2.8 trillion 2.4 trillion(headline 数字;未独立验证)
Active parameters / MoE config 每个 token 激活 896 个 expert 中的 16 个 未披露
Context window 1,048,576 tokens (~1M) 未公布
Multimodal input 原生 image understanding 图像、视频和文档(阿里巴巴首个 >1T 参数 multimodal 模型)
API pricing $3.00 / MTok input,$15.00 / MTok output,$0.30 / MTok cached 未公布 — preview 通过 Token Plan 以「标准定价 10%」提供,无 standalone 费率
Independent benchmark data 有 — Artificial Analysis Intelligence Index (57),LMArena Frontend Code Arena (#1,独立 crowd-voted) 无已发布
Open weights 已承诺,预计 2026 年 7 月 27 日 承诺「soon」,无日期,尚无 Hugging Face repo
License Modified MIT-style(计划) 未确认

该表中的 gap 就是当前的全部故事。Kimi K3 有可以放入 spend model 的价格和第三方运行的 leaderboard 结果。Qwen 3.8 有一个参数数字和一句营销 copy。

Qwen 3.8 唯一真实信号:它对 Moonshot 意味着什么

即使没有 benchmark,Qwen 3.8 的发布也因另一原因具有信息量:它是 competitors 对 Kimi K3 重视程度的数据点。据 Qwen 3.8 宣布时引用的 Bloomberg 报道,Moonshot AI 在 2026 年 6 月 reportedly 年 recurring revenue 超过 3 亿美元,并正在准备 IPO。阿里巴巴在 K3 发布三天后 preview 2.4T open-weight flagship——打破过去将 Max-tier 模型保持 closed 的模式——是 competitive reaction,不是巧合。若你在读 market 而非今天选模型,这比任一公司的 benchmark claim 是更可靠的 signal。

Kimi K3 的独立验证 track record

由于 Qwen 3.8 尚无 comparable 数据,以下是 Moonshot 以外各方实际在 Kimi K3 上验证的内容:

  • LMArena Frontend Code Arena — crowd-voted、独立运行的 leaderboard,非 vendor benchmark。K3 在发布数小时内从 #18 升至 #1,超越 Claude Fable 5,在 7 个 frontend domain 中 6 个第一。
  • Artificial Analysis — 独立 evaluator — 在 Intelligence Index (v4.1) 上给 K3 打分 57,高于 Claude Opus 4.8 (56),低于 Claude Fable 5 (60);另测得 K3 的 private long-horizon knowledge-work Elo 为 1,547,较 Kimi K2.6 跃升 +732 点
  • Cost-efficiency:Artificial Analysis 将 K3 的 cost-per-task 约为 $0.94,在同一 private evaluation 上略低于 GPT-5.6 Sol 的 $1.04

这些都不能保证 K3 在 Qwen 3.8 有真实数字后一定「更好」——但区别在于可评估 vs 尚不可评估。

近期 complication:Kimi K3 目前 capacity 受限

若你本周在决定实际试用哪一个,值得知道:Moonshot 于 2026 年 7 月 19 日暂停新 Kimi K3 订阅,因 demand 在发布 48 小时内将 GPU capacity 推近极限。现有 subscriber 和 API 客户不受影响,Moonshot 正在分批 reopen 新 signup — 完整细节见 为何 Kimi K3 售罄。若你本周 specifically 想通过 consumer app 为新账号 hands-on 访问,这是 Qwen 3.8 目前没有的 real practical obstacle,仅仅因为 Qwen 3.8 的 preview program 更小、更新。

现在该用哪一个

使用 Kimi K3 如果:

  • 你需要今天就能用真实定价和独立验证 benchmark 数据实际评估的模型。
  • 你的 workload 是 agentic coding、frontend generation 或 long-horizon tool use — K3 独立验证结果最强的类别。
  • 你可以适应(或等待)当前 subscription pause,或通过仍开放的 API 和 OpenRouter 访问。

关注 Qwen 3.8,但尚不要 commit,如果:

  • 你想要来自不同 vendor 的第二个 open-weight 选项作 redundancy — 但在阿里巴巴公布 pricing、context window 和 benchmark 数据前,无法建立 real evaluation plan。
  • 阿里巴巴规模的 multimodal document/video 处理对你 specifically 有价值,且你愿意等待 open-weight 发布和真实数字。

不要信任任何今天声称这两个模型 hard head-to-head benchmark 数字的文章 — 若 Qwen 3.8 尚未公布,该内容要么将未验证 vendor claim 当作事实,要么编造数字。

后续关注

  • Qwen 3.8 benchmark 分数,来自 Artificial Analysis 或 comparable 独立 evaluator。
  • Qwen 3.8 官方 per-token API 定价,在 promotional Token Plan preview 费率之外。
  • Qwen 3.8 的 context window 和 active-parameter/MoE 配置。
  • 两个模型的 open-weight 发布 — K3 预计 2026 年 7 月 27 日;Qwen 3.8 尚无确认日期。

阿里巴巴发布真实数字后我们会更新本对比,而非现在 backfill 估计。

FAQ

Qwen 3.8 比 Kimi K3 更好吗? 截至本文撰写时未知。阿里巴巴 claim Qwen 3.8「仅次于 Fable 5」,但未发布任何独立或自报 benchmark 分数支持该说法。Kimi K3 有独立验证结果(LMArena Frontend Code Arena、Artificial Analysis),Qwen 3.8 目前没有。

Qwen 3.8 比 Kimi K3 更大吗? 否 — Qwen 3.8 报道为 2.4 trillion 总参数,Kimi K3 为 2.8 trillion。按 headline 参数 count,K3 仍是两者中更大的。

Qwen 3.8 是 open source 吗? 阿里巴巴表示 open weights「soon」到来,但截至本文撰写时无 Hugging Face repo、无确认发布日期、无确认 license。Kimi K3 处于类似 pending 状态,但有具体 committed 日期:2026 年 7 月 27 日。

使用 Qwen 3.8 要花多少钱? 阿里巴巴未公布 Qwen 3.8 的 standalone per-token API 定价。Preview 可通过阿里巴巴 Token Plan、Qoder 和 QoderWork 以「标准定价 10%」访问,但那是 promotional preview 费率,非已公布的生产价格。

阿里巴巴为何在 Kimi K3 之后立即发布 Qwen 3.8? 时机 — K3 发布三天后 — 加上阿里巴巴 explicit「仅次于 Fable 5」framing 以及打破 Max-tier 模型 closed 传统,读起来是对 Kimi K3 发布 momentum 和 Moonshot AI reported growth(2026 年 6 月约 $300M ARR)及 IPO 准备的 direct competitive response。

现在能用 Qwen 3.8 吗? 仅 preview,通过阿里巴巴 Token Plan、Qoder 或 QoderWork。尚无 general API access 或 open-weight 下载。

相关指南

相关阅读

继续沿着 Gemma 4 内容集群往下读,选一个离你当前决策最近的下一篇。

还没决定下一篇看什么?

回到指南页,按模型对比、本地部署和硬件规划三个方向继续浏览。