Alibaba, Qwen 3.8-Max'i 2026 Ağustos başında resmi olarak piyasaya sürdü. Model, sıra dışı bir kombinasyon sunuyor: Jeton başına yalnızca 95 milyar parametreyi etkinleştiren 2,4 trilyon parametreli bir Uzmanlar Karışımı (MoE) mimarisi, 1 milyon jetonluk bağlam boyunca sabit 2$/6$ fiyatlandırma ve ağırlıkların bir hafta içinde Hugging Face ile ModelScope'ta herkese açık olacağı sözü. Bu son nokta önemli: Daha önce hiçbir Qwen-Max sınıfı modelin açık ağırlıkları yayınlanmamıştı.
Resmi duyuru, modeli bugüne kadarki en yetenekli Qwen olarak tanımlıyor. Satıcının kıyaslama tablosu güçlü sonuçların yanında bazı belirgin kayıpları da gösteriyor. Bu rehberde Qwen 3.8-Max'in mimarisini, fiyatını, Kimi K3, Fable 5 ve GPT-5.6 Sol karşısındaki konumunu ve API üzerinden nasıl test edileceğini inceleyeceğiz.
API entegrasyonu için model hem OpenAI uyumlu hem de Anthropic uyumlu uç noktalar sunuyor. Bu nedenle Apidog gibi protokol farklarını yönetebilen bir istemciyle aynı API anahtarını kullanarak iki formatı da doğrulamak mümkündür.
Qwen 3.8-Max'e bir bakış
| Özellik | Qwen 3.8-Max |
|---|---|
| Geliştirici | Alibaba (Qwen ekibi) |
| Piyasaya sürülme | Ağustos 2026 başı; Model Studio genel erişim: 3 Ağustos |
| Mimari | Qwen 3.5 temeli üzerine inşa edilmiş MoE |
| Toplam parametre | 2,4T |
| Aktif parametre | 95B; yaklaşık %4 aktivasyon |
| Bağlam penceresi | 1.000.000 jeton |
| Maksimum çıktı | 65.536 jeton |
| Modaliteler | Metin ve görüntü girişi, metin çıktısı |
| Akıl yürütme kontrolü |
reasoning_effort: çok yüksek, orta, düşük |
| API model kimliği | qwen3.8-max |
| Fiyatlandırma | 1 milyon giriş jetonu için 2$, 1 milyon çıktı jetonu için 6$ |
| Açık ağırlıklar | Gelecek hafta için söz verildi; 2026 Ağustos başında henüz indirilemez |
| API protokolleri | OpenAI uyumlu ve Anthropic uyumlu |
Tablodaki bilgiler Alibaba'nın yayın materyallerine ve Model Studio fiyatlandırma sayfasına dayanır.
Qwen 3.8-Max nedir?
Qwen 3.8-Max, Alibaba'nın Qwen ailesindeki yeni amiral gemisi modeldir. Qwen 3.5 mimari temeli üzerinde inşa edilmiştir ve Qwen3.7-Max'in üzerinde konumlanır.
Satıcının verilerine göre önceki sürüme göre belirgin sıçramalar bulunuyor:
- Terminal Bench 2.1:
74,5 → 86,6 - PaperBench:
64,8 → 93,0
Eski modelden geçiş kararı veriyorsanız, farkları Qwen 3.8 ile Qwen 3.7 Max karşılaştırmasında inceleyebilirsiniz.
Modelin temel teknik özelliği parametre dağılımıdır. Toplam parametre sayısı 2,4T olsa da her ileri geçişte yalnızca 95B parametre etkinleşir. Yaklaşık %4'lük bu aktivasyon oranı, büyük model kapasitesini daha düşük çıkarım maliyetiyle birleştirmeyi amaçlar.
Karşılaştırma için Kimi K3:
- Toplam parametre: 2,8T
- Aktif parametre: 104B
Bu nedenle Qwen 3.8-Max, hem toplam hem aktif parametre sayısında Kimi K3'ten daha küçüktür.
API tarafında model metin ve görüntü girdilerini kabul eder. Alibaba ayrıca 200 sayfadan uzun PDF'leri anlama ve bellek grafikleri üzerinden 100 saatlik video anlama örnekleri gösteriyor. Ancak yayınlanan API yapılandırmaları giriş modaliteleri olarak metin ve görüntüyü listeliyor; video ve uzun belge örneklerini ayrı API giriş türleri olarak değil, gösterilen yetenekler olarak değerlendirmek gerekir.
Akıl yürütme davranışını şu parametreyle kontrol edebilirsiniz:
{
"reasoning_effort": "high"
}
Desteklenen seviyeler:
- Çok yüksek: varsayılan
- Orta
- Düşük
Ayrıca enable_thinking ve varsayılan olarak korunan preserve_thinking seçenekleri bulunur.
Dikkat: Düşünme ve düşünmeme modları aynı orandan fiyatlanır; ancak düşünme jetonları çıktı jetonu olarak sayılır. Bu nedenle varsayılan çok yüksek akıl yürütme düzeyinde gerçek maliyet, yalnızca nihai yanıt uzunluğuna bakılarak hesaplanandan yüksek olabilir.
İlk açık ağırlıklı Max sınıfı Qwen
Bu sürümün en büyük stratejik değişikliği açık ağırlık vaadidir. Alibaba daha önce birçok Qwen modelini açık kaynaklı hale getirdi, ancak Max katmanında bunu yapmadı.
Qwen 3.8-Max için şirket, ağırlıkların Hugging Face ve ModelScope'a “gelecek hafta” geleceğini belirtiyor. Bu, yaklaşık 10 Ağustos tarihine işaret ediyor.
Dikkate alınması gereken iki nokta var:
Ağırlıklar henüz indirilebilir değil.
2026 Ağustos başı itibarıyla bu yalnızca bir duyuru. Kimi K3 ağırlıkları da lansmandan 11 gün sonra yayınlandı; dolayısıyla kısa bir gecikme olasılığı göz ardı edilmemeli.2,4T'lik bir modeli self-host etmek çok düğümlü bir altyapı işidir.
Agresif nicemleme kullanılsa bile bu model bir iş istasyonunda rahatça çalıştırılabilecek ölçekte değildir. Çoğu ekip için açık ağırlıkların pratik anlamı, yerel dağıtım değil üçüncü taraf sağlayıcılardan daha ucuz barındırılan erişim olacaktır.
Liste fiyatını ödemeden modeli denemek istiyorsanız, Qwen Chat ve Model Studio ücretsiz kotası mevcut seçeneklerdir. Ayrıntılar için Qwen 3.8'i ücretsiz kullanma rehberine bakın.
Kıyaslamalar ne söylüyor?
Alibaba, Qwen 3.8-Max'i Claude Opus 4.8, Fable 5, GPT-5.6 Sol ve Qwen3.7-Max ile karşılaştıran bir kıyaslama tablosu yayınladı.
Bu sonuçları değerlendirirken iki sınırlamayı unutmayın:
- Sonuçlar satıcı tarafından yürütülmüş değerlendirmelerdir.
- Kodlama sıralarının çoğu tüm modeller için Claude Code donanımı kullanılarak çalıştırılmıştır.
- QwenSWEBench, QwenQoderBench, CoWorkBench ve RecreationBench gibi bazı ölçümler Alibaba'nın kendi dahili çalışmalarına dayanır.
- Yazım sırasında Artificial Analysis benzeri kaynaklardan bağımsız doğrulama verisi bulunmamaktadır.
Öne çıktığı alanlar
PaperBench: 93,0
GPT-5.6 Sol90,5, Fable 588,8ve Opus 4.880,3sonuçlarının önünde.IFBench: 82,8
GPT-5.6 Sol'un72,7puanının üzerinde.Terminal Bench 2.1: 86,6
Opus 4.8 ve Fable 5'in84,6puanını geçiyor; yalnızca Sol'un88,8sonucunun gerisinde.Çok modluluk
MathVision95,2, LogicVista91,9, OSWorld-Verified86,1ve güçlü OCR sonuçları, modelin belge ve görsel anlama tarafındaki güçlü yönlerine işaret ediyor.
Geride kaldığı alanlar
SWE-bench Pro: 67,7
Fable 5'in80,0sonucunun belirgin biçimde gerisinde; Opus 4.8'in69,2sonucundan da düşük. Ancak Sol'un64,6puanını geçiyor.HLE: 43,6
Satırdaki en düşük amiral gemisi sonucu. Fable 553,3, Sol47,2ve Opus 4.845,7puan aldı.
Kısa değerlendirme şu şekilde yapılabilir: Alibaba'nın kendi verilerine göre Qwen 3.8-Max, bazı ajan tabanlı görevlerde Opus 4.8'i geçiyor; temel kodlama ölçümlerinin çoğunda Fable 5'in gerisinde kalıyor; belge zekâsı ve çok modlu görevlerde ise güçlü sonuçlar veriyor.
GPQA Diamond'da 92,6 puanla Fable 5 ile eşit, GPT-5.6 Sol'un 94,1 sonucunun hemen gerisinde. Bu da bilimsel akıl yürütme performansının rekabetçi olduğunu gösteriyor.
Donanım ayrıntıları ve bağımsız doğrulama durumu dahil daha ayrıntılı inceleme için Qwen 3.8 kıyaslama analizine bakın.
Alibaba ayrıca şu tanıtım çalışmalarını yayınladı:
- Genel bir depoda 16 günlük otonom kodlama oturumu: 265 commit ve 127 pull request
- Orijinal makalenin AIME24 sonucunu geçen makale çoğaltma çalışması
- 24 saat içinde 526 insan ekibinden 458'ini geride bırakan Tianchi yarışması girişi
Bunlar kontrollü bağımsız değerlendirmeler değil, satıcı demolarıdır. Kodlama kullanımına odaklanıyorsanız, kodlama için Qwen 3.8 rehberi donanım kurulumlarını da ele alır.
Kimi K3, Fable 5 ve GPT-5.6 Sol karşısındaki konumu
Kimi K3'e karşı
Bu karşılaştırma doğal: İki Çin laboratuvarı, haftalar arayla yayınlanan iki dev MoE model ve açık ağırlık odağı.
| Özellik | Qwen 3.8-Max | Kimi K3 |
|---|---|---|
| Toplam parametre | 2,4T | 2,8T |
| Aktif parametre | 95B | 104B |
| Modalite | Metin + görüntü | Yalnızca metin |
| Giriş fiyatı | 2$/1M jeton | 3$/1M jeton |
| Çıktı fiyatı | 6$/1M jeton | 15$/1M jeton |
| Açık ağırlıklar | Söz verildi | Yayınlandı |
K3, 0,30$ önbellek isabeti fiyatıyla farklı bir maliyet yapısı sunuyor. Qwen ise sabit 2$/6$ fiyatıyla öne çıkıyor.
Henüz doğrudan ve bağımsız bir karşılaştırmalı değerlendirme yok. Modelleri satır satır incelemek için Qwen 3.8 ile Kimi K3 karşılaştırmasına bakın. Moonshot modeline yeni başlıyorsanız Kimi K3 nedir? yazısıyla başlayabilirsiniz.
Fable 5'e karşı
Fable 5, kodlama kıyaslamalarında referans olmaya devam ediyor. Alibaba'nın verilerinde Qwen 3.8-Max bu alanlarda Fable 5'i geçemiyor:
- SWE-bench Pro:
67,7vs80,0 - HLE:
43,6vs53,3
Qwen'in karşı teklifiyse şu unsurlar:
- Daha düşük liste fiyatı
- 1 milyon jeton bağlam
- Yolda olan açık ağırlıklar
- Güçlü çok modlu ve belge odaklı sonuçlar
GPT-5.6 Sol'e karşı
| Kıyaslama | Qwen 3.8-Max | GPT-5.6 Sol |
|---|---|---|
| Terminal Bench | 86,6 | 88,8 |
| GPQA | 92,6 | 94,1 |
| HLE | 43,6 | 47,2 |
| PaperBench | 93,0 | 90,5 |
| IFBench | 82,8 | 72,7 |
Sol; Terminal Bench, GPQA ve HLE'de önde. Qwen 3.8-Max ise PaperBench ve IFBench'te daha yüksek sonuçlar gösteriyor.
Fiyat tarafında Qwen'in 2$/6$ oranı, GPT-5.6 Terra'nın 2$/12$ fiyatını özellikle çıktı maliyetinde aşağı çekiyor. Sol düzeyi erişim ise daha pahalı kalıyor.
Ek referans olarak Claude Opus 5'in liste fiyatı 5$/25$. Satıcı tablolarından bağımsız olarak, Alibaba'nın amiral gemisini yüksek hacimli iş yükleri için agresif fiyatlandırdığı açık.
Fiyatlandırma: 1 milyon jeton boyunca sabit 2$/6$
Fiyatlandırma modeli basit:
- 1 milyon giriş jetonu: 2$
- 1 milyon çıktı jetonu: 6$
- Bağlam aralığı: 0 ile 1 milyon jeton arasında sabit fiyat
- Düşünme modu: aynı oran üzerinden fiyatlanır
Bu yapı uzun bağlam iş yükleri için dikkat çekicidir. Birçok modelde istem büyüdükçe fiyat katmanı artar; Qwen 3.8-Max'te bu artış yoktur.
Qwen3.7-Max, 2,5$/7,5$ liste fiyatıyla sunulmuştu. Ancak eski modelin mevcut %50 indirimi onu 1,25$/3,75$ seviyesine getiriyor ve maliyete duyarlı ekipler için hâlâ anlamlı bir seçenek yapıyor.
Önbellekleme maliyetleri:
- Önbellek isabeti: giriş ücretinin
%10u - Açık önbellek oluşturma: giriş maliyetinin
%125i
Deneme için ayrıca yalnızca Singapur bölgesinde geçerli, 90 gün süreli 1M jetonluk ücretsiz kota bulunuyor.
Görev bazlı maliyet örnekleri ve düşünme jetonlarının etkisi için Qwen 3.8 fiyatlandırma rehberini inceleyin.
Qwen 3.8-Max'e nasıl erişilir?
Qwen 3.8-Max'e erişmek için beş yol bulunuyor.
1. Qwen Chat
Tüketici uygulamasını kullanabilirsiniz. API anahtarı gerekmez ve modeli ilk kez denemek için en hızlı yoldur.
2. Alibaba Cloud Model Studio API'si
home.qwencloud.com üzerinden API anahtarınızı oluşturun ve ortam değişkeni olarak ayarlayın:
export DASHSCOPE_API_KEY="api-anahtariniz"
Model kimliği:
qwen3.8-max
Aktif OpenAI uyumlu temel URL'ler:
https://dashscope.aliyuncs.com/compatible-mode/v1
https://dashscope-intl.aliyuncs.com/compatible-mode/v1
https://dashscope-us.aliyuncs.com/compatible-mode/v1
Bunlar sırasıyla Pekin, Singapur ve ABD-Virginia bölgelerine karşılık gelir.
Model, OpenAI uyumlu sohbet tamamlama ve yanıt uç noktaları üzerinden çağrılabilir. Modelin kullanılabilirliği için Model Studio modeller sayfasını kontrol edin.
3. Anthropic uyumlu uç nokta
Anthropic Mesajlar protokolü için şu uç nokta sunuluyor:
https://dashscope-intl.aliyuncs.com/apps/anthropic
Bu yaklaşım, Claude için yazılmış araçları Qwen'e yönlendirmeyi kolaylaştırır. Örneğin ortam değişkenlerinizi şu şekilde yapılandırabilirsiniz:
export ANTHROPIC_BASE_URL="https://dashscope-intl.aliyuncs.com/apps/anthropic"
export ANTHROPIC_MODEL="qwen3.8-max"
4. Kodlama araçları
Alibaba, şu ajan ve kodlama araçları için resmi yapılandırmalar yayınladı:
- Claude Code
- Codex
- Qoder
- Qwen Code
- OpenClaw
Claude Code için temel yaklaşım, ANTHROPIC_BASE_URL ile Anthropic uyumlu DashScope uç noktasını belirtmek ve ANTHROPIC_MODEL=qwen3.8-max ayarını kullanmaktır.
Alibaba'nın kodlama kıyaslamalarının çoğunu Claude Code donanımında çalıştırması da önemlidir. Yayımlanan yapılandırma, satıcının kendi kıyaslama sonuçlarının arkasındaki kurulumdur.
5. Açık ağırlıklar
Hugging Face ve ModelScope için gelecek hafta açık ağırlık sözü verildi. Ancak 2026 Ağustos başı itibarıyla ağırlıklar henüz indirilebilir durumda değil.
API, Anthropic protokolü ve kodlama araçları için daha ayrıntılı kurulum adımları ile Python/cURL örnekleri Qwen 3.8 API rehberinde bulunuyor.
Çift protokol API'sini test etme
Aynı modelin OpenAI uyumlu ve Anthropic uyumlu iki protokolde çalışması, entegrasyon testini önemli hâle getirir.
Test ederken şu kontrolleri yapın:
- Aynı istemi her iki uç noktaya gönderin.
- Yanıt metnini, araç çağrılarını ve hata biçimlerini karşılaştırın.
- Bölge farklarını görmek için Pekin, Singapur ve ABD-Virginia temel URL'leri arasında geçiş yapın.
- SSE akışını inceleyerek nihai yanıttan önce
reasoning_contentdeltalarının gelip gelmediğini doğrulayın. - Düşünme jetonlarının çıktı maliyetine etkisini gerçek istek kayıtları üzerinden ölçün.
Apidog içinde bölgesel temel URL'leri ortam olarak tanımlayabilir, istek gövdesini değiştirmeden ortamlar arasında geçiş yapabilir ve iki protokolün yanıtlarını yan yana test edebilirsiniz.
Aynı çalışma alanında qwen3.8-max, qwen3.7-max ve kimi-k3 için aynı istemleri kullanarak A/B testi de yapabilirsiniz. Uç noktaları bağlamak için Apidog'u ücretsiz indirin.
Qwen 3.8-Max ürün yelpazesinde nerede duruyor?
Qwen 3.8-Max, ürün ailesinde Qwen3.7-Max ve Plus katmanı modellerin üzerinde konumlanıyor.
Pratik seçim rehberi:
- Qwen 3.8-Max: Çok modlu görevler, belge anlama ve yüksek ajan kapasitesi gereken iş yükleri
-
Qwen3.7-Max: Kampanya dönemindeki
%50indirim nedeniyle maliyete duyarlı amiral gemisi kullanımı - Plus modelleri: Rutin, yüksek hacimli ve düşük maliyetli görevler
Model katmanlarını iş yüklerine göre seçmek için en iyi Qwen modelleri rehberine bakın.
Sıkça Sorulan Sorular
Qwen 3.8 açık kaynak mı?
Henüz değil. Alibaba, 2026 Ağustos başındaki lansman itibarıyla ağırlıkların “gelecek hafta” Hugging Face ve ModelScope'a geleceğini açıkladı. Bu gerçekleşirse Qwen 3.8-Max, ilk açık ağırlıklı Max sınıfı Qwen olacak.
Yazım sırasında ağırlıklar indirilebilir değil. O zamana kadar modele API veya Qwen Chat üzerinden erişebilirsiniz. Ücretsiz kullanım seçenekleri için Qwen 3.8'i ücretsiz kullanma kılavuzuna bakın.
Qwen 3.8-Max ne kadar?
Fiyatlandırma:
- 1 milyon giriş jetonu: 2$
- 1 milyon çıktı jetonu: 6$
- Bağlam penceresi: 1 milyon jetona kadar sabit fiyat
- Önbellek isabeti: giriş fiyatının %10'u
Düşünme jetonları çıktı olarak ücretlendirilir. Varsayılan akıl yürütme düzeyi çok yüksek olduğundan, yoğun akıl yürütme iş yüklerinde etiket fiyatının üzerinde bütçe planlamalısınız.
Qwen 3.8-Max, Kimi K3'ten daha mı iyi?
Henüz doğrudan ve bağımsız bir karşılaştırmalı değerlendirme yok.
Teknik olarak Qwen 3.8-Max:
- Daha küçük:
2,4T/95B aktifvs2,8T/104B aktif - Çok modlu: K3 yalnızca metin tabanlı
- Çıktıda daha ucuz:
6$vs15$
Kimi K3'ün bugünkü avantajı, açık ağırlıklarının zaten herkese açık olmasıdır.
Qwen 3.8-Max'i Claude Code'da kullanabilir miyim?
Evet. Alibaba'nın resmi yapılandırmasına göre ANTHROPIC_BASE_URL değerini Anthropic uyumlu DashScope uç noktasına yönlendirin ve modeli şu şekilde ayarlayın:
export ANTHROPIC_MODEL="qwen3.8-max"
Codex, Qoder, Qwen Code ve OpenClaw için de resmi yapılandırmalar yayınlanmıştır.
Sırada ne var?
Qwen 3.8-Max bir basın önizlemesi değil; üç API bölgesinde genel erişim, yayınlanmış fiyatlandırma, satıcı tarafından yürütülen ayrıntılı kıyaslamalar ve açık ağırlık vaadiyle gelen gerçek bir amiral gemisi sürümüdür.
Mevcut verilerden çıkarılabilecek pratik sonuç:
- Fable 5'i temel kodlamada geride bırakmıyor.
- Bazı ajan tabanlı ölçümlerde Opus 4.8'i geçiyor.
- Belge zekâsı ve çok modlu görevlerde güçlü görünüyor.
- Bunu
2$/6$fiyatlandırma ile sunuyor.
Doğru yaklaşım, modeli yalnızca satıcı kıyaslamalarına göre değerlendirmek değil, kendi iş yükünüzde test etmektir:
- Ücretsiz kotayı etkinleştirin.
- OpenAI ve Anthropic uyumlu uç noktaları bağlayın.
- Gerçek üretim istemlerinizi kullanın.
- Yanıt kalitesini, gecikmeyi ve düşünme jetonu maliyetini kaydedin.
-
qwen3.8-maxsonuçlarını mevcut modelinizle karşılaştırın.
Başlangıç için API kurulum rehberini kullanın. Açık ağırlıkların planlanan takvime uyup uymadığını görmek için 10 Ağustos civarında Hugging Face ve ModelScope'u yeniden kontrol edin.

Top comments (0)