Gemma 4 가이드

Kimi K3 vs Qwen 3.8: 확인된 것과 아닌 것 (2026년 7월)

8분 읽기
kimi k3qwen 3.8model comparisonmoonshot aialibaba
Kimi K3 vs Qwen 3.8: 확인된 것과 아닌 것 (2026년 7월)

Kimi K3 vs Qwen 3.8: 확인된 것과 아닌 것

Moonshot AI의 Kimi K3 출시 3일 후, Alibaba Qwen 팀은 Qwen3.8-Max-Preview를 미리 공개했습니다 — 2.4조 파라미터 모델로, 프론티어 성능에 맞추고 "Fable 5에만 뒤진다"고 설명합니다. 타이밍은 우연이 아닙니다: Qwen 3.8은 Kimi K3가 만든 뉴스 사이클에 직접 진입했고, Alibaba 자체 프레이밍도 K3의 모멘텀에 대한 직접적인 답변으로 포지셔닝합니다.

실제로 둘을 비교하려는 사람에게 함정이 있습니다: 이 글을 쓰는 시점 기준 Qwen 3.8에는 단 하나의 독립 검증 벤치마크도 공개되어 있지 않습니다. Alibaba의 "Fable 5에만 뒤진다" 주장은 리더보드 결과가 아니라 회사 포지셔닝입니다. 이 가이드는 각 모델에서 정확히 무엇이 확인됐고, 무엇이 아직 주장에 불과한지, 오늘 하나를 골라야 한다면 그게 무엇을 의미하는지 정리합니다.

확인/미확인 데이터 패널과 파라미터 수 막대가 있는 Kimi K3와 Qwen 3.8 나란히 비교 일러스트

빠른 답변

  • Kimi K3는 지금 당장 검증 가능한 실적이 있습니다: 공개 가격, 독립 운영 #1 리더보드 결과(LMArena Frontend Code Arena), Artificial Analysis의 서드파티 벤치마크 데이터.
  • Qwen 3.8은 아직 거의 아무것도 독립 검증되지 않은 프리뷰입니다: 공개 컨텍스트 윈도우 없음, per-token API 가격 없음, 서드파티 벤치마크 점수 0. Alibaba 성능 주장은 미확인 마케팅 문구.
  • 오늘 평가하고 배포할 수 있는 모델이 필요하다면, Kimi K3만이 그렇게 할 만큼 공개 정보가 충분합니다.
  • 공간만 모니터링 중이라면, Alibaba가 실제 숫자를 공개하면 Qwen 3.8을 지켜볼 가치는 있지만 — 아직 테스트할 것은 없습니다.
  • 둘 다 아직 다운로드 가능한 open weights는 없습니다. K3는 2026년 7월 27일 예상; Qwen 3.8은 "곧" 약속만 있고 날짜 없음.

이 비교가 뜨는 이유 — 그리고 대부분 버전이 틀린 이유

"Qwen 3.8 vs Kimi K3"는 이번 주 가장 빠르게 상승하는 AI 검색어 중 하나이며, 이해는 됩니다: 지금까지 발표된 open-weight 모델 중 가장 큰 두 모델이 3일 간격으로 출시됐으니까요. 하지만 Qwen 3.8은 아직 공개 벤치마크가 없는 프리뷰이므로, 둘 사이 head-to-head 점수를 보여준다는 기사는 미검증 벤더 마케팅을 사실로 인용하거나 아직 존재하지 않는 숫자를 만들어낸 것입니다. 우리는 그렇게 하지 않습니다. 아래는 각 회사가 실제로 확인한 내용을 1차 보도에 근거해 정리했으며, 공백은 덮지 않고 그대로 드러냅니다.

출시 시점 및 포지셔닝

Kimi K3 Qwen 3.8 (Qwen3.8-Max-Preview)
벤더 Moonshot AI Alibaba (Qwen team)
발표 2026년 7월 16일 2026년 7월 19일
상태 API, 앱, OpenRouter 통해 일반 이용 가능 프리뷰만, Token Plan / Qoder / QoderWork 경유
포지셔닝 Open-weight 프론티어 generalist, agent 최적화 멀티모달 플래그십, Kimi K3 모멘텀 추격으로 포지셔닝
벤더 자체 프레이밍 "지금까지 공개된 최대 open-weight 모델" "프론티어 모델에 맞춤, Fable 5에만 뒤짐"(미검증)

Qwen 3.8 출시는 Kimi K3에 대한 직접적 대응으로 읽힙니다: Alibaba는 Qwen3.7-Max(2026년 5월 출시)까지 Max-tier 플래그십을 closed·API-only로 유지했고, Qwen 3.8은 그 라인에서 open-weight로 갈 첫 모델이라고 밝혔습니다 — Moonshot이 K3로 한 것과 같은 움직임이며, K3가 뉴스 사이클을 지배한 며칠 후입니다.

각 모델에서 실제로 확인된 것

Kimi K3 Qwen 3.8
총 파라미터 2.8조 2.4조(헤드라인 수치; 독립 미검증)
Active parameters / MoE config 토큰당 896개 전문가 중 16개 활성 미공개
컨텍스트 윈도우 1,048,576 tokens (~1M) 미공개
멀티모달 입력 네이티브 이미지 이해 이미지, 비디오, 문서(Alibaba 첫 >1T-parameter 멀티모달 모델)
API 가격 입력 $3.00/MTok, 출력 $15.00/MTok, 캐시 $0.30/MTok 미공개 — Token Plan 통해 "표준 가격의 10%" 프리뷰, standalone 요율 미공개
독립 벤치마크 데이터 있음 — Artificial Analysis Intelligence Index(57), LMArena Frontend Code Arena(#1, 독립 크라우드 투표) 공개 없음
Open weights 약속, 2026년 7월 27일 예상 "곧" 약속, 날짜·Hugging Face repo 없음
라이선스 Modified MIT 스타일(예정) 미확인

그 표의 공백이 지금 전체 이야기입니다. Kimi K3는 spend model에 넣을 가격과 서드파티가 운영한 리더보드 결과가 있습니다. Qwen 3.8은 파라미터 수와 마케팅 문장 한 줄이 있습니다.

Qwen 3.8의 유일한 실질 신호: Moonshot에 대해 말해 주는 것

벤치마크 없이도 Qwen 3.8 출시는 다른 이유로 정보가 됩니다: 경쟁사가 Kimi K3를 얼마나 진지하게 보는지에 대한 데이터 포인트입니다. Moonshot AI는 2026년 6월 연간 반복 매출 $3억을 넘겼고 IPO를 준비 중이라 Bloomberg 보도가 Qwen 3.8 발표와 함께 인용됐습니다. Alibaba가 Max-tier 모델을 closed로 유지하던 패턴을 깨고 2.4T open-weight 플래그십을 K3 출시 3일 후 미리 공개한 것은 우연이 아니라 경쟁 반응입니다. 오늘 모델을 고르기보다 시장을 읽으려면, 어느 회사 벤치마크 주장보다 이 신호가 더 신뢰할 만합니다.

Kimi K3의 독립 검증 실적

Qwen 3.8에 아직 비교 가능한 데이터가 없으므로, Moonshot 외 당사자가 Kimi K3에서 실제로 확인한 내용:

  • LMArena Frontend Code Arena — 크라우드 투표, 독립 운영 리더보드, 벤더 벤치마크 아님. K3는 출시 후 몇 시간 만에 #18에서 #1로, Claude Fable 5 앞서 7개 프론트엔드 도메인 중 6개 1위.
  • Artificial Analysis — 독립 평가자 — Intelligence Index(v4.1) 57점, Claude Opus 4.8(56) 앞, Claude Fable 5(60) 뒤; 별도로 K3 private long-horizon knowledge-work Elo 1,547, Kimi K2.6 대비 +732점 점프.
  • 비용 효율: Artificial Analysis는 K3 cost-per-task를 약 $0.94, 동일 private 평가에서 GPT-5.6 Sol $1.04보다 약간 낮게 측정.

이것이 K3가 Qwen 3.8이 실제 숫자를 갖게 되면 "더 낫다"는 보장은 아닙니다 — 하지만 evaluatable과 not-yet-evaluatable의 차이입니다.

단기 복잡 요인: Kimi K3는 지금 용량 제약 중

이번 주 실제로 어느 쪽을 시험할지 결정한다면 알아둘 것: Moonshot은 2026년 7월 19일 출시 48시간 만에 수요가 GPU 용량 한계에 근접하자 새 Kimi K3 구독을 일시 중단했습니다. 기존 구독자와 API 고객은 영향 없고, Moonshot은 배치로 신규 가입 재개 중 — 자세히는 Kimi K3가 품절된 이유. 이번 주 소비자 앱으로 새 계정 hands-on 접근을 원한다면 Qwen 3.8이 현재 갖지 않은 실질 장애물입니다 — Qwen 3.8 프리뷰 프로그램이 더 작고 새롭기 때문입니다.

지금 어느 것을 써야 하나

Kimi K3를 사용:

  • 오늘 실제 가격과 독립 검증 벤치마크로 평가할 수 있는 모델이 필요할 때.
  • 워크로드가 agentic 코딩, 프론트엔드 생성, 장기 tool use — K3 독립 검증 결과가 가장 강한 카테고리.
  • 현재 구독 일시 중단 범위 내에서 작업하거나, 여전히 열린 API·OpenRouter로 접근할 수 있을 때.

Qwen 3.8은 지켜보되 아직 확정하지 마세요:

  • 다른 벤더의 두 번째 open-weight 옵션으로 redundancy를 원하지만 — Alibaba가 가격, 컨텍스트, 벤치마크를 공개할 때까지 real evaluation plan은 세울 수 없음.
  • Alibaba 규모의 멀티모달 문서/비디오 처리가 특별히 가치 있고 open-weight 출시와 real numbers를 기다릴 의향이 있을 때.

오늘 이 두 모델 간 hard head-to-head 벤치마크 숫자를 주장하는 기사는 믿지 마세요 — Qwen 3.8이 공개하지 않았다면, 미검증 벤더 주장을 사실로 인용하거나 숫자를 조작한 것입니다.

다시 확인할 것

  • Qwen 3.8 벤치마크 점수 — Artificial Analysis 또는 동급 독립 평가자.
  • Token Plan 프리뷰 요율 밖 Qwen 3.8 공식 per-token API 가격.
  • Qwen 3.8 컨텍스트 윈도우 및 active-parameter/MoE 구성.
  • 양쪽 open-weight 출시 — K3는 2026년 7월 27일 예상; Qwen 3.8은 확정 날짜 없음.

Alibaba가 공개하는 real numbers로 이 비교를 업데이트할 것이며, 지금 추정치로 backfill하지 않습니다.

FAQ

Qwen 3.8이 Kimi K3보다 나은가요? 이 글 작성 시점 기준 미지. Alibaba는 Qwen 3.8이 "Fable 5에만 뒤진다"고 주장하지만 독립 또는 자체 보고 벤치마크 점수를 공개하지 않았습니다. Kimi K3는 Qwen 3.8이 현재 갖지 않은 독립 검증 결과(LMArena Frontend Code Arena, Artificial Analysis)가 있습니다.

Qwen 3.8이 Kimi K3보다 큰가요? 아니요 — Qwen 3.8은 총 2.4조 파라미터로 보고되며 Kimi K3 2.8조 대비 작습니다. 헤드라인 파라미터 수 기준 K3가 더 큽니다.

Qwen 3.8은 오픈소스인가요? Alibaba는 open weights가 "곧" 온다고 했지만, Hugging Face repo, 확정 출시일, Qwen 3.8 라이선스 확인 없음. Kimi K3도 비슷한 pending 상태이지만 2026년 7월 27일이라는 구체적 약속 날짜가 있습니다.

Qwen 3.8 사용 비용은? Alibaba는 Qwen 3.8 standalone per-token API 가격을 공개하지 않았습니다. Token Plan, Qoder, QoderWork 통해 "표준 가격의 10%"로 프리뷰 접근 가능하지만, 프로모션 프리뷰 요율이지 공개 production 가격이 아닙니다.

Alibaba가 Kimi K3 직후 Qwen 3.8을 출시한 이유는? 타이밍 — K3 출시 3일 후 — 과 "Fable 5에만 뒤진다" 프레이밍, Max-tier closed 유지 패턴 이탈은 Kimi K3 출시 모멘텀과 Moonshot AI 성장(2026년 6월 기준 ARR 약 $3억) 및 IPO 준비에 대한 직접적 경쟁 대응으로 읽힙니다.

지금 Qwen 3.8을 쓸 수 있나요? Alibaba Token Plan, Qoder, QoderWork를 통한 프리뷰만 가능. 일반 API 접근이나 open-weight 다운로드는 아직 없음.

관련 가이드

관련 가이드

지금 고민 중인 결정과 가장 잘 맞는 다음 가이드를 따라 Gemma 4 클러스터를 계속 탐색해 보세요.

Kimi K3 vs Claude: Fable 5와 Opus 4.8 비교

Kimi K3 vs Claude: Fable 5와 Opus 4.8 비교

Kimi K3는 가격과 대부분의 벤치마크에서 Claude Opus 4.8을 이기지만, Claude Fable 5는 여전히 프론티어 엔지니어링에서 앞섭니다. Artificial Analysis와 각 벤더 숫자를 출처로 각 모델이 이기는 지점을 정리합니다.

다음에 무엇을 읽을지 아직 고민 중인가요?

가이드 허브로 돌아가 모델 비교, 설정 워크스루, 하드웨어 계획 페이지를 둘러보세요.