Gemma-4-Leitfäden

Kimi K3 vs Qwen 3.8: Was bestätigt ist und was nicht (Juli 2026)

8 Min. Lesezeit
kimi k3qwen 3.8model comparisonmoonshot aialibaba
Kimi K3 vs Qwen 3.8: Was bestätigt ist und was nicht (Juli 2026)

Kimi K3 vs Qwen 3.8: Was bestätigt ist und was nicht

Drei Tage nach dem Launch von Moonshot AIs Kimi K3 stellte Alibabas Qwen-Team Qwen3.8-Max-Preview vor — ein 2,4-Billionen-Parameter-Modell, das Frontier-Leistung erreichen und „nur hinter Fable 5“ liegen soll. Das Timing ist kein Zufall: Qwen 3.8 kam direkt in den News-Zyklus, den Kimi K3 erzeugt hatte, und Alibabas eigene Einordnung positioniert es als direkte Antwort auf K3s Momentum.

Der Haken für alle, die beide wirklich vergleichen wollen: Qwen 3.8 hat zum Zeitpunkt dieses Artikels keinen einzigen unabhängig verifizierten Benchmark veröffentlicht. Alibabas Behauptung „nur hinter Fable 5“ ist Unternehmenspositionierung, kein Leaderboard-Ergebnis. Dieser Leitfaden legt genau dar, was bei jedem Modell bestätigt ist, was noch nur Behauptung ist, und was das bedeutet, wenn Sie heute wählen müssen.

Seiten-an-Seiten-Vergleichsillustration von Kimi K3 und Qwen 3.8 mit bestätigt-vs-unbestätigt-Datenpanel und Parameter-Balken

Kurzantwort

  • Kimi K3 hat jetzt eine echte, testbare Erfolgsbilanz: veröffentlichte Preise, ein unabhängig betriebenes #1-Leaderboard-Ergebnis (LMArena Frontend Code Arena) und Benchmark-Daten von Artificial Analysis.
  • Qwen 3.8 ist eine Preview mit fast nichts Unabhängig Verifiziertem: kein veröffentlichtes Kontextfenster, keine per-Token-API-Preise, null Benchmark-Werte von Dritten. Alibabas Leistungsbehauptungen sind unbestätigte Marketing-Sprache.
  • Wenn Sie ein Modell brauchen, das Sie heute evaluieren und deployen können, ist Kimi K3 das einzige der beiden mit genug öffentlichen Informationen dafür.
  • Wenn Sie den Markt nur beobachten, lohnt sich Qwen 3.8, sobald Alibaba echte Zahlen veröffentlicht — aber es gibt noch nichts zu testen.
  • Beide haben noch keine herunterladbaren Open Weights. K3s werden für den 27. Juli 2026 erwartet; Qwen 3.8s sind „bald“ versprochen, ohne Datum.

Warum dieser Vergleich trendet — und warum die meisten Versionen falsch sind

„Qwen 3.8 vs Kimi K3“ ist einer der am schnellsten steigenden KI-Suchbegriffe dieser Woche — verständlich: Zwei der größten je angekündigten Open-Weight-Modelle erschienen drei Tage auseinander. Weil Qwen 3.8 noch eine Preview ohne öffentliche Benchmarks ist, zitiert jeder Artikel mit Head-to-Head-Scores entweder unverifiziertes Vendor-Marketing als Fakt oder erfindet Zahlen, die noch nicht existieren. Das tun wir nicht. Unten steht, was jedes Unternehmen tatsächlich bestätigt hat — mit Primärquellen — und die Lücken bleiben sichtbar offen.

Release-Zeitpunkt und Positionierung

Kimi K3 Qwen 3.8 (Qwen3.8-Max-Preview)
Anbieter Moonshot AI Alibaba (Qwen team)
Angekündigt 16. Juli 2026 19. Juli 2026
Status Allgemein verfügbar via API, App und OpenRouter Nur Preview, via Token Plan / Qoder / QoderWork
Positionierung Open-Weight-Frontier-Generalist, agent-optimiert Multimodales Flaggschiff, positioniert als K3-Momentum-Jagd
Eigenes Framing „Größtes bisher veröffentlichtes Open-Weight-Modell“ „Entspricht Frontier-Modellen, nur hinter Fable 5“ (unverifiziert)

Qwen 3.8s Release liest sich als direkte Antwort auf Kimi K3: Alibaba hielt seine Max-Tier-Flaggschiffe bis Qwen3.7-Max (Mai 2026) closed und nur API-only, und Qwen 3.8 ist das erste dieser Linie, das laut Alibaba Open-Weight werden soll — derselbe Schritt wie Moonshot mit K3, Tage nach K3s Dominanz im News-Zyklus.

Was bei jedem Modell wirklich bestätigt ist

Kimi K3 Qwen 3.8
Gesamtparameter 2,8 Billionen 2,4 Billionen (Schlagzeilen-Zahl; unabhängig unverifiziert)
Aktive Parameter / MoE-Konfiguration 16 von 896 Experten pro Token aktiv Nicht offengelegt
Kontextfenster 1.048.576 Token (~1M) Nicht veröffentlicht
Multimodale Eingabe Native Bildverständnis Bilder, Video und Dokumente (Alibabas erstes >1T-Parameter-Multimodal-Modell)
API-Preise 3,00 $ / MTok Input, 15,00 $ / MTok Output, 0,30 $ / MTok gecacht Nicht veröffentlicht — Preview-Zugang über Token Plan zu „10 % des Standardpreises“, ohne standalone Rate
Unabhängige Benchmark-Daten Ja — Artificial Analysis Intelligence Index (57), LMArena Frontend Code Arena (#1, unabhängig crowd-gewählt) Keine veröffentlicht
Open Weights Versprochen, erwartet 27. Juli 2026 „Bald“ versprochen, kein Datum, kein Hugging-Face-Repo
Lizenz Modified MIT-Style (geplant) Unbestätigt

Die Lücke in dieser Tabelle ist gerade die ganze Geschichte. Kimi K3 hat einen Preis für Ihr Spend-Modell und ein von Dritten betriebenes Leaderboard-Ergebnis. Qwen 3.8 hat eine Parameterzahl und einen Satz Marketing-Text.

Das eine echte Signal von Qwen 3.8: Was es über Moonshot aussagt

Auch ohne Benchmarks ist Qwen 3.8s Launch aus einem anderen Grund informativ: Es ist ein Datenpunkt dazu, wie ernst Wettbewerber Kimi K3 nehmen. Moonshot AI habe im Juni 2026 angeblich über 300 Mio. $ ARR überschritten und bereite einen IPO vor, berichtete Bloomberg im Kontext von Qwen 3.8s Ankündigung. Dass Alibaba drei Tage nach K3s Launch eine 2,4T Open-Weight-Flagship previewed — und damit bricht von Max-Tier closed — ist eine Wettbewerbsreaktion, kein Zufall. Wenn Sie den Markt lesen statt heute ein Modell wählen, ist das das zuverlässigere Signal als Benchmark-Behauptungen beider Unternehmen.

Kimi K3s unabhängig verifizierte Erfolgsbilanz

Da Qwen 3.8 noch keine vergleichbaren Daten hat, hier, was an Kimi K3 von anderen als Moonshot geprüft wurde:

  • LMArena Frontend Code Arena — crowd-gewähltes, unabhängig betriebenes Leaderboard, kein Vendor-Benchmark. K3 ging innerhalb weniger Stunden von #18 auf #1, vor Claude Fable 5, Erster in 6 von 7 Frontend-Domains.
  • Artificial Analysis — unabhängiger Evaluator — bewertete K3 mit 57 im Intelligence Index (v4.1), vor Claude Opus 4.8 (56), hinter Claude Fable 5 (60); separat private Long-Horizon-Knowledge-Work-Elo 1.547 für K3, ein Sprung von +732 Punkten gegenüber Kimi K2.6.
  • Kosteneffizienz: Artificial Analysis setzte K3s Cost-per-Task auf grob 0,94 $, leicht unter GPT-5.6 Sols 1,04 $ in derselben privaten Evaluation.

Das garantiert nicht, dass K3 „besser“ ist als Qwen 3.8 später — aber es ist der Unterschied zwischen evaluierbar und noch nicht evaluierbar.

Eine kurzfristige Komplikation: Kimi K3 ist gerade kapazitätsbeschränkt

Wissenswert, wenn Sie diese Woche entscheiden, welches Sie testen: Moonshot pausierte am 19. Juli 2026 neue Kimi-K3-Abonnements, nachdem die Nachfrage innerhalb von 48 Stunden nach dem Launch nahe an die Grenzen der GPU-Kapazität stieß. Bestehende Abonnenten und API-Kunden sind unberührt, Moonshot öffnet neue Anmeldungen in Batches — Details in Warum Kimi K3 ausverkauft ist. Wenn Sie diese Woche speziell über die Consumer-App einen neuen Account hands-on testen wollen, ist das ein praktisches Hindernis, das Qwen 3.8 derzeit nicht hat — weil Qwen 3.8s Preview-Programm kleiner und neuer ist.

Welches sollten Sie jetzt nutzen

Kimi K3 nutzen, wenn:

  • Sie ein Modell brauchen, das Sie heute mit echten Preisen und unabhängig verifizierten Benchmarks evaluieren können.
  • Ihr Workload agentisches Coding, Frontend-Generierung oder langfristige Tool-Nutzung ist — Kategorien, wo K3s unabhängig verifizierte Ergebnisse am stärksten sind.
  • Sie innerhalb der aktuellen Abonnement-Pause arbeiten (oder warten) können, oder über die noch offene API und OpenRouter zugreifen.

Qwen 3.8 beobachten, aber noch nicht festlegen, wenn:

  • Sie eine zweite Open-Weight-Option eines anderen Anbieters für Redundanz wollen — aber keinen echten Evaluationsplan bauen können, bis Alibaba Preise, Kontextfenster und Benchmarks veröffentlicht.
  • Multimodale Dokument-/Video-Verarbeitung in Alibabas Größenordnung speziell wertvoll ist und Sie auf Open-Weight-Release und echte Zahlen warten.

Vertrauen Sie keinem Artikel mit harten Head-to-Head-Benchmark-Zahlen zwischen diesen Modellen heute — wenn Qwen 3.8 sie nicht veröffentlicht hat, zitiert der Inhalt unverifizierte Vendor-Claims oder erfindet Zahlen.

Worauf Sie zurückschauen sollten

  • Qwen 3.8 Benchmark-Scores von Artificial Analysis oder vergleichbarem unabhängigen Evaluator.
  • Qwen 3.8s offizielle per-Token-API-Preise außerhalb des promotional Token-Plan-Preview-Tarifs.
  • Qwen 3.8s Kontextfenster und Active-Parameter-/MoE-Konfiguration.
  • Open-Weight-Releases beider Modelle — K3 erwartet 27. Juli 2026; Qwen 3.8 ohne bestätigtes Datum.

Wir aktualisieren diesen Vergleich mit echten Zahlen, sobald Alibaba sie veröffentlicht — statt jetzt Schätzungen nachzutragen.

FAQ

Ist Qwen 3.8 besser als Kimi K3? Unbekannt zum Zeitpunkt dieses Artikels. Alibaba behauptet, Qwen 3.8 liege „nur hinter Fable 5“, hat aber keine unabhängigen oder selbst gemeldeten Benchmark-Scores veröffentlicht. Kimi K3 hat unabhängig verifizierte Ergebnisse (LMArena Frontend Code Arena, Artificial Analysis), die Qwen 3.8 derzeit nicht hat.

Ist Qwen 3.8 größer als Kimi K3? Nein — Qwen 3.8 wird mit 2,4 Billionen Gesamtparametern gemeldet, gegenüber Kimi K3s 2,8 Billionen. K3 bleibt nach der Schlagzeilen-Parameterzahl das größere der beiden.

Ist Qwen 3.8 Open Source? Alibaba sagte, Open Weights kommen „bald“, aber es gibt kein Hugging-Face-Repo, kein bestätigtes Release-Datum und keine bestätigte Lizenz für Qwen 3.8. Kimi K3 ist ähnlich pending, aber mit konkretem Datum: 27. Juli 2026.

Was kostet die Nutzung von Qwen 3.8? Alibaba hat keine standalone per-Token-API-Preise für Qwen 3.8 veröffentlicht. Preview-Zugang über Token Plan, Qoder und QoderWork zu „10 % des Standardpreises“ — ein promotional Preview-Tarif, kein veröffentlichter Produktionspreis.

Warum veröffentlichte Alibaba Qwen 3.8 direkt nach Kimi K3? Das Timing — drei Tage nach K3s Launch — plus explizites „nur hinter Fable 5“-Framing und der Bruch mit closed Max-Tier-Modellen liest sich als direkte Wettbewerbsantwort auf Kimi K3s Launch-Momentum und Moonshot AIs gemeldetes Wachstum (grob 300 Mio. $ ARR Juni 2026) und IPO-Vorbereitungen.

Kann ich Qwen 3.8 jetzt nutzen? Nur in Preview über Alibabas Token Plan, Qoder oder QoderWork. Noch kein allgemeiner API-Zugang oder Open-Weight-Download.

Verwandte Leitfäden

Verwandte Leitfäden

Gehen Sie im Gemma-4-Cluster mit dem nächsten Leitfaden weiter, der zu Ihrer aktuellen Entscheidung passt.

Sie wissen noch nicht, was Sie als Nächstes lesen sollen?

Gehen Sie zurück zum Leitfaden-Hub, um Modellvergleiche, Setup-Anleitungen und Seiten zur Hardware-Planung zu durchsuchen.