Gemma 4 指南
Kimi K3 vs Qwen 3.8:已确认与未确认(2026 年 7 月)

Kimi K3 vs Qwen 3.8:已确认与未确认
Moonshot AI 的 Kimi K3 发布三天后,阿里巴巴 Qwen 团队 preview 了 Qwen3.8-Max-Preview——一个 2.4 万亿参数模型,被描述为达到 frontier 性能且「仅次于 Fable 5」。时机并非巧合:Qwen 3.8 直接进入了 Kimi K3 创造的新闻周期,阿里巴巴自身的 framing 也将其定位为对 K3 势头的直接回应。
对任何想实际对比两者的人来说,catch 在于:截至本文撰写时,Qwen 3.8 尚未发布任何独立验证的 benchmark。 阿里巴巴「仅次于 Fable 5」的说法是公司 positioning,而非 leaderboard 结果。本指南逐一列出每个模型已确认的内容、仍只是 claim 的部分,以及若今天必须二选一时意味着什么。

快速结论
- Kimi K3 现在有真实、可测试的 track record:已公布定价、独立运行的 #1 leaderboard 结果(LMArena Frontend Code Arena),以及 Artificial Analysis 的第三方 benchmark 数据。
- Qwen 3.8 是 preview,几乎没有任何独立验证:未公布 context window、未公布 per-token API 定价、零第三方 benchmark 分数。阿里巴巴的性能 claim 是未确认的营销用语。
- 若你需要今天就能评估和部署的模型,Kimi K3 是两者中唯一拥有足够公开信息可操作的。
- 若你只是在观察这个领域,Qwen 3.8 值得在阿里巴巴发布真实数字后关注——但目前尚无可测试内容。
- 两者都尚无可下载的 open weights。 K3 预计 2026 年 7 月 27 日;Qwen 3.8 承诺「soon」,无具体日期。
为何这个对比在 trending——以及为何多数版本是错的
「Qwen 3.8 vs Kimi K3」是本周增长最快的 AI 搜索词之一,这合理:史上最大 open-weight 模型之二相隔三天发布。但由于 Qwen 3.8 仍是 preview 且无公开 benchmark,任何声称展示两者 head-to-head 分数的文章,要么将未验证的 vendor 营销当作事实,要么编造尚不存在的数字。我们不会这样做。以下是各公司实际确认的内容,来源为一手报道,缺口保持可见而非被掩盖。
发布时机与 positioning
| Kimi K3 | Qwen 3.8 (Qwen3.8-Max-Preview) | |
|---|---|---|
| Vendor | Moonshot AI | Alibaba (Qwen team) |
| 宣布日期 | 2026 年 7 月 16 日 | 2026 年 7 月 19 日 |
| 状态 | 通过 API、App 和 OpenRouter 普遍可用 | 仅 preview,通过 Token Plan / Qoder / QoderWork |
| Positioning | Open-weight frontier generalist,agent 优化 | Multimodal flagship,定位为追赶 Kimi K3 势头 |
| Vendor 自身 framing | 「迄今发布的最大 open-weight 模型」 | 「匹配 frontier 模型,仅落后于 Fable 5」(未验证) |
Qwen 3.8 的发布读起来像对 Kimi K3 的直接回应:阿里巴巴在 Qwen3.7-Max(2026 年 5 月发布)之前一直将 Max-tier flagship 保持 closed 且仅 API;Qwen 3.8 是该系列中阿里巴巴首次表示将 open-weight 的——与 Moonshot 对 K3 的做法相同,在 K3 主导新闻周期数日后。
各模型实际已确认的内容
| Kimi K3 | Qwen 3.8 | |
|---|---|---|
| 总参数 | 2.8 trillion | 2.4 trillion(headline 数字;未独立验证) |
| Active parameters / MoE config | 每个 token 激活 896 个 expert 中的 16 个 | 未披露 |
| Context window | 1,048,576 tokens (~1M) | 未公布 |
| Multimodal input | 原生 image understanding | 图像、视频和文档(阿里巴巴首个 >1T 参数 multimodal 模型) |
| API pricing | $3.00 / MTok input,$15.00 / MTok output,$0.30 / MTok cached | 未公布 — preview 通过 Token Plan 以「标准定价 10%」提供,无 standalone 费率 |
| Independent benchmark data | 有 — Artificial Analysis Intelligence Index (57),LMArena Frontend Code Arena (#1,独立 crowd-voted) | 无已发布 |
| Open weights | 已承诺,预计 2026 年 7 月 27 日 | 承诺「soon」,无日期,尚无 Hugging Face repo |
| License | Modified MIT-style(计划) | 未确认 |
该表中的 gap 就是当前的全部故事。Kimi K3 有可以放入 spend model 的价格和第三方运行的 leaderboard 结果。Qwen 3.8 有一个参数数字和一句营销 copy。
Qwen 3.8 唯一真实信号:它对 Moonshot 意味着什么
即使没有 benchmark,Qwen 3.8 的发布也因另一原因具有信息量:它是 competitors 对 Kimi K3 重视程度的数据点。据 Qwen 3.8 宣布时引用的 Bloomberg 报道,Moonshot AI 在 2026 年 6 月 reportedly 年 recurring revenue 超过 3 亿美元,并正在准备 IPO。阿里巴巴在 K3 发布三天后 preview 2.4T open-weight flagship——打破过去将 Max-tier 模型保持 closed 的模式——是 competitive reaction,不是巧合。若你在读 market 而非今天选模型,这比任一公司的 benchmark claim 是更可靠的 signal。
Kimi K3 的独立验证 track record
由于 Qwen 3.8 尚无 comparable 数据,以下是 Moonshot 以外各方实际在 Kimi K3 上验证的内容:
- LMArena Frontend Code Arena — crowd-voted、独立运行的 leaderboard,非 vendor benchmark。K3 在发布数小时内从 #18 升至 #1,超越 Claude Fable 5,在 7 个 frontend domain 中 6 个第一。
- Artificial Analysis — 独立 evaluator — 在 Intelligence Index (v4.1) 上给 K3 打分 57,高于 Claude Opus 4.8 (56),低于 Claude Fable 5 (60);另测得 K3 的 private long-horizon knowledge-work Elo 为 1,547,较 Kimi K2.6 跃升 +732 点。
- Cost-efficiency:Artificial Analysis 将 K3 的 cost-per-task 约为 $0.94,在同一 private evaluation 上略低于 GPT-5.6 Sol 的 $1.04。
这些都不能保证 K3 在 Qwen 3.8 有真实数字后一定「更好」——但区别在于可评估 vs 尚不可评估。
近期 complication:Kimi K3 目前 capacity 受限
若你本周在决定实际试用哪一个,值得知道:Moonshot 于 2026 年 7 月 19 日暂停新 Kimi K3 订阅,因 demand 在发布 48 小时内将 GPU capacity 推近极限。现有 subscriber 和 API 客户不受影响,Moonshot 正在分批 reopen 新 signup — 完整细节见 为何 Kimi K3 售罄。若你本周 specifically 想通过 consumer app 为新账号 hands-on 访问,这是 Qwen 3.8 目前没有的 real practical obstacle,仅仅因为 Qwen 3.8 的 preview program 更小、更新。
现在该用哪一个
使用 Kimi K3 如果:
- 你需要今天就能用真实定价和独立验证 benchmark 数据实际评估的模型。
- 你的 workload 是 agentic coding、frontend generation 或 long-horizon tool use — K3 独立验证结果最强的类别。
- 你可以适应(或等待)当前 subscription pause,或通过仍开放的 API 和 OpenRouter 访问。
关注 Qwen 3.8,但尚不要 commit,如果:
- 你想要来自不同 vendor 的第二个 open-weight 选项作 redundancy — 但在阿里巴巴公布 pricing、context window 和 benchmark 数据前,无法建立 real evaluation plan。
- 阿里巴巴规模的 multimodal document/video 处理对你 specifically 有价值,且你愿意等待 open-weight 发布和真实数字。
不要信任任何今天声称这两个模型 hard head-to-head benchmark 数字的文章 — 若 Qwen 3.8 尚未公布,该内容要么将未验证 vendor claim 当作事实,要么编造数字。
后续关注
- Qwen 3.8 benchmark 分数,来自 Artificial Analysis 或 comparable 独立 evaluator。
- Qwen 3.8 官方 per-token API 定价,在 promotional Token Plan preview 费率之外。
- Qwen 3.8 的 context window 和 active-parameter/MoE 配置。
- 两个模型的 open-weight 发布 — K3 预计 2026 年 7 月 27 日;Qwen 3.8 尚无确认日期。
阿里巴巴发布真实数字后我们会更新本对比,而非现在 backfill 估计。
FAQ
Qwen 3.8 比 Kimi K3 更好吗? 截至本文撰写时未知。阿里巴巴 claim Qwen 3.8「仅次于 Fable 5」,但未发布任何独立或自报 benchmark 分数支持该说法。Kimi K3 有独立验证结果(LMArena Frontend Code Arena、Artificial Analysis),Qwen 3.8 目前没有。
Qwen 3.8 比 Kimi K3 更大吗? 否 — Qwen 3.8 报道为 2.4 trillion 总参数,Kimi K3 为 2.8 trillion。按 headline 参数 count,K3 仍是两者中更大的。
Qwen 3.8 是 open source 吗? 阿里巴巴表示 open weights「soon」到来,但截至本文撰写时无 Hugging Face repo、无确认发布日期、无确认 license。Kimi K3 处于类似 pending 状态,但有具体 committed 日期:2026 年 7 月 27 日。
使用 Qwen 3.8 要花多少钱? 阿里巴巴未公布 Qwen 3.8 的 standalone per-token API 定价。Preview 可通过阿里巴巴 Token Plan、Qoder 和 QoderWork 以「标准定价 10%」访问,但那是 promotional preview 费率,非已公布的生产价格。
阿里巴巴为何在 Kimi K3 之后立即发布 Qwen 3.8? 时机 — K3 发布三天后 — 加上阿里巴巴 explicit「仅次于 Fable 5」framing 以及打破 Max-tier 模型 closed 传统,读起来是对 Kimi K3 发布 momentum 和 Moonshot AI reported growth(2026 年 6 月约 $300M ARR)及 IPO 准备的 direct competitive response。
现在能用 Qwen 3.8 吗? 仅 preview,通过阿里巴巴 Token Plan、Qoder 或 QoderWork。尚无 general API access 或 open-weight 下载。
相关指南
相关阅读
继续沿着 Gemma 4 内容集群往下读,选一个离你当前决策最近的下一篇。

Kimi K3 vs Claude:Fable 5 与 Opus 4.8 对比
Kimi K3 在价格和多数 benchmark 上超过 Claude Opus 4.8,但 Claude Fable 5 仍在 frontier engineering 上领先。以下是各模型赢在哪里,数据来自 Artificial Analysis 和各 vendor 自有数字。

为何 Kimi K3 售罄?GPU Capacity 暂停详解
Kimi K3 并非 discontinued 或真正「售罄」——Moonshot 在发布 48 小时内 demand 耗尽 GPU capacity 后暂停了新 subscription signup。若你正尝试获取访问,这意味着什么。

Kimi K3 详解:Moonshot AI 的 2.8T Open-Weight 模型
Moonshot AI 的 Kimi K3 于 2026 年 7 月 16 日发布,是一个 2.8 万亿参数的 open-weight 模型,在多项 benchmark 上超过 Claude Opus 4.8。本文说明它到底是什么、还缺什么,以及今天如何试用。
还没决定下一篇看什么?
回到指南页,按模型对比、本地部署和硬件规划三个方向继续浏览。
