Alibaba เปิดตัว Qwen 3.8-Max ในช่วงต้นเดือนสิงหาคม 2026 และมีหลายแหล่งอ้างว่า “ใช้ฟรีตลอดไป” ซึ่งไม่ตรงกับเงื่อนไขจริง บทความนี้สรุปข้อมูลจากหน้าเว็บของ Alibaba ณ วันที่ 3 สิงหาคม 2026 เพื่อให้คุณเลือกเส้นทางใช้งานที่เหมาะกับการทดลองและพัฒนาได้จริง
มี 4 เส้นทางหลัก: สองเส้นทางใช้งานได้ทันที, หนึ่งเส้นทางเป็นกำหนดการปล่อยในอนาคต และอีกหนึ่งเส้นทางคือการใช้โมเดล Qwen รุ่นก่อนหน้า หากต้องการดูรายละเอียดโมเดลก่อน เช่น พารามิเตอร์รวม 2.4 ล้านล้าน, พารามิเตอร์ที่ใช้งานจริง 95B และบริบท 1M โทเค็น โปรดดู ภาพรวม Qwen 3.8
ภาพรวมเส้นทางใช้งาน
| เส้นทาง | ฟรีหรือไม่? | ใช้งานได้วันนี้หรือไม่? | ข้อจำกัด |
|---|---|---|---|
| Qwen Chat | ใช่ | ใช่ | แอปสำหรับผู้ใช้ทั่วไป, ไม่มี API |
| โควตา API ของ Model Studio | 1 ล้านโทเค็น | ใช่ | เฉพาะภูมิภาคสิงคโปร์, 90 วัน |
| น้ำหนักโมเดลแบบเปิด (โฮสต์เอง) | น้ำหนักฟรี | ยังไม่ใช่ | ระบุว่าจะมา “สัปดาห์หน้า”; ฮาร์ดแวร์ไม่ฟรี |
| โมเดล Qwen รุ่นเก่า | ใช่ | ใช่ | ไม่ใช่ Qwen 3.8 |
เส้นทางที่ 1: Qwen Chat สำหรับทดลองโมเดลโดยไม่ต้องตั้งค่า
วิธีเริ่มต้นที่เร็วที่สุดคือ Qwen Chat: ลงชื่อเข้าใช้ เลือกโมเดล และสนทนากับ Qwen 3.8-Max ได้โดยไม่ต้องใช้บัตรเครดิตหรือคอนโซลคลาวด์ ประกาศเปิดตัวอย่างเป็นทางการ ระบุช่องทางนี้เป็นวิธีเริ่มใช้งานโมเดลสำหรับผู้ใช้ทั่วไป
สิ่งที่คุณได้รับ:
- ใช้งานโมเดลเรือธงผ่านอินเทอร์เฟซแชทโดยไม่มีค่าใช้จ่าย
- ทดสอบความสามารถด้านรูปภาพและเอกสารตามเดโมในงานเปิดตัว
- เหมาะกับการตรวจสอบคุณภาพคำตอบเบื้องต้น
สิ่งที่คุณไม่ได้รับ:
- ไม่มี API และ API key
- เชื่อมต่อกับแอป, CI หรือชุดทดสอบอัตโนมัติไม่ได้
- พฤติกรรมของแชทอาจต่างจาก API ดิบ เพราะมี system prompt และการตั้งค่าของแพลตฟอร์มเอง
สรุป: ใช้ได้จริงและฟรี เหมาะกับการสำรวจความสามารถของโมเดล แต่ไม่ใช่เส้นทางหลักสำหรับนักพัฒนา
เส้นทางที่ 2: โควตา API ฟรีใน Model Studio
สำหรับนักพัฒนา Alibaba Cloud Model Studio ให้โควตาฟรีสำหรับ qwen3.8-max จำนวน 1 ล้านโทเค็น เมื่อเปิดใช้งานใหม่
จาก หน้าการกำหนดราคา มีเงื่อนไขสำคัญที่ต้องตรวจสอบก่อนเริ่มใช้งาน
1. ใช้ได้เฉพาะภูมิภาคสิงคโปร์
โควตาฟรีใช้ได้เฉพาะภูมิภาคสิงคโปร์ (International) ดังนั้นให้ตั้งค่า base URL ดังนี้
https://dashscope-intl.aliyuncs.com/compatible-mode/v1
หากใช้ปลายทางปักกิ่งหรือสหรัฐอเมริกา-เวอร์จิเนีย คุณจะถูกคิดค่าบริการตั้งแต่โทเค็นแรก ดังนั้นหากระบบของคุณต้องใช้ US endpoint เพื่อลด latency โควตาฟรีนี้จะไม่ตอบโจทย์
2. โควตาหมดอายุใน 90 วัน
โควตาใช้ได้ 90 วันนับจากวันที่เปิดใช้งาน และโทเค็นที่ไม่ได้ใช้จะไม่ทบยอดไปหลังวันหมดอายุ
แนวทางปฏิบัติ:
- เปิดใช้งานเมื่อพร้อมเริ่มทดสอบจริง
- วางแผน benchmark และ integration test ให้อยู่ในกรอบ 90 วัน
- ตั้งการแจ้งเตือนก่อนวันหมดอายุและก่อนโควตาใกล้หมด
3. หลังโควตาหมด จะคิดค่าบริการตามโทเค็น
สำหรับบริบท 1M เต็ม อัตราที่ระบุคือ:
- อินพุต: $2 ต่อ 1 ล้านโทเค็น
- เอาต์พุต: $6 ต่อ 1 ล้านโทเค็น
การเปลี่ยนไปคิดค่าบริการเกิดขึ้นอัตโนมัติเมื่อโควตาหมดหรือหมดอายุ ควรตั้งค่า billing alert ก่อนเริ่มเรียกใช้ API ดูตัวอย่างการประเมินค่าใช้จ่ายได้ใน คู่มือการกำหนดราคา Qwen 3.8
ขั้นตอนเริ่มใช้ API
- สร้างบัญชี Alibaba Cloud Model Studio
- เปิดใช้งานบริการ Model Studio
- สร้าง API key
- เก็บ key ในตัวแปรแวดล้อมชื่อ
DASHSCOPE_API_KEY - เลือกโมเดล
qwen3.8-maxจาก แคตตาล็อกโมเดล - ใช้ endpoint แบบ OpenAI-compatible หรือ Anthropic-compatible
ตัวอย่างการตั้งค่า environment variable:
export DASHSCOPE_API_KEY="your-api-key"
สำหรับโครงสร้าง request, การสตรีม และ reasoning output โปรดดู คำแนะนำการใช้งาน Qwen 3.8 API
กับดักที่กินโควตา: reasoning_effort เปิดเป็น xhigh
Qwen 3.8-Max มีค่าเริ่มต้นของ reasoning_effort เป็น xhigh และโทเค็นที่ใช้ในการคิดถูกนับเป็นเอาต์พุต
ผลที่ตามมา:
- คำขอที่ซับซ้อนหนึ่งครั้งอาจสร้าง reasoning token หลายพันโทเค็น
- โควตา 1M อาจหมดเร็วกว่าที่คาด แม้คำตอบสุดท้ายจะสั้น
- การทดสอบแบบวนซ้ำโดยไม่ควบคุม reasoning จะทำให้ต้นทุนเพิ่มหลังโควตาหมด
สำหรับงานทั่วไปที่ไม่ต้องการการให้เหตุผลเชิงลึก ให้ลดค่าลงเป็น low หรือ medium
{
"model": "qwen3.8-max",
"reasoning_effort": "low",
"messages": [
{
"role": "user",
"content": "สรุปโค้ดนี้เป็น 3 ข้อ"
}
]
}
ทำให้โควตา 1 ล้านโทเค็นใช้งานได้นานขึ้น
ใช้แนวทางต่อไปนี้เพื่อลดการเรียก API ที่ไม่จำเป็น
ตรวจสอบ request ก่อนวนแก้โค้ด
สร้างและทดสอบ request ใน Apidog ปรับพารามิเตอร์ และดูผลลัพธ์แบบสตรีมก่อนนำไปใส่ในแอปจริง วิธีนี้ช่วยลดการเผาโควตาจากการ debug ผ่านโค้ดซ้ำ ๆใช้ mock response ระหว่างพัฒนาส่วนอื่น
หลังจากทราบโครงสร้าง response แล้ว ให้บันทึกตัวอย่าง response และใช้ mock server ส่งข้อมูลให้ frontend หรือ agent ของคุณ การพัฒนากับ mock server ไม่ใช้โทเค็นจริงติดตาม token usage ทุก request
ตรวจสอบข้อมูล usage ที่อยู่ใน response เพื่อวัด input, output และ reasoning token ต่อคำขอ อย่ารอจนโควตาหมดระหว่าง sprint
สามารถ ดาวน์โหลด Apidog ได้ฟรี และสร้าง environment แยกสำหรับสิงคโปร์ ปักกิ่ง และสหรัฐอเมริกา เพื่อสลับ base URL ได้อย่างชัดเจน
สรุป: เป็นเส้นทางที่ดีที่สุดสำหรับนักพัฒนาในตอนนี้ แต่ต้องใช้ Singapore endpoint และจัดการกรอบเวลา 90 วันอย่างรอบคอบ
เส้นทางที่ 3: น้ำหนักโมเดลแบบเปิด แต่ยังดาวน์โหลดไม่ได้
ประเด็นสำคัญของการเปิดตัวคือ Qwen 3.8-Max เป็นโมเดลระดับ Qwen-Max รุ่นแรกที่ Alibaba ระบุว่าจะปล่อยน้ำหนักโมเดลแบบเปิดบน Hugging Face และ ModelScope “สัปดาห์หน้า” หรือประมาณวันที่ 10 สิงหาคม 2026
อย่างไรก็ตาม ณ วันที่ 3 สิงหาคม 2026:
- ยังไม่มีน้ำหนักโมเดลให้ดาวน์โหลด
- ยังไม่มีสิ่งให้ quantize
- ยังไม่มีสิ่งให้รันด้วยตนเอง
หากพบบทความที่อ้างว่าสามารถ “รัน Qwen 3.8 ภายในเครื่องได้แล้ววันนี้” ก่อนวันที่น้ำหนักโมเดลพร้อมใช้งาน ควรตรวจสอบว่าโมเดลที่ใช้คือรุ่นใด
ความเป็นจริงของการโฮสต์ด้วยตนเอง
แม้น้ำหนักโมเดลจะเปิดให้ดาวน์โหลด คำว่า “ฟรี” ยังหมายถึงเฉพาะน้ำหนักโมเดล ไม่ได้รวมต้นทุนฮาร์ดแวร์และการให้บริการ
Qwen 3.8-Max มีพารามิเตอร์รวม 2.4 ล้านล้านตัว โดยมีตัวอย่างใกล้เคียงคือ Kimi K3 ที่มีพารามิเตอร์ 2.8 ล้านล้านและมีน้ำหนักราว 594 GB แม้ใช้การควอนไทซ์แบบ MXFP4
สิ่งที่ต้องเตรียมสำหรับการรันระดับนี้:
- พื้นที่จัดเก็บหลายร้อย GB
- ระบบ GPU หลายตัว
- ในทางปฏิบัติอาจต้องใช้หลายโหนด
- ระบบ serving, monitoring และเครือข่ายที่เหมาะสม
GPU สำหรับผู้บริโภคหรือเวิร์กสเตชันเครื่องเดียวไม่ใช่เป้าหมายที่สมจริงสำหรับโมเดลขนาดนี้ ดูภาพรวมข้อกำหนดของโมเดลระดับใกล้เคียงได้จากบทความ รัน Kimi K3 ภายในเครื่อง
ประโยชน์ที่เป็นไปได้ของน้ำหนักโมเดลแบบเปิดคือผู้ให้บริการภายนอกสามารถโฮสต์โมเดลได้ และการแข่งขันอาจทำให้ราคา API ต่ำกว่าราคาจากผู้ให้บริการโดยตรง สำหรับนักพัฒนาส่วนใหญ่ นี่น่าจะหมายถึง API ที่ราคาถูกลง มากกว่าการรันโมเดลบนแล็ปท็อป
สรุป: ยังไม่พร้อมใช้งานในวันที่อ้างอิง ควรติดตามอีกครั้งช่วงกลางเดือนสิงหาคม และเตรียมงบสำหรับ hosting มากกว่าซื้อฮาร์ดแวร์เอง
เส้นทางที่ 4: ใช้โมเดล Qwen รุ่นเก่าที่ฟรีจริง
หากเป้าหมายของคุณคือใช้ “โมเดล Qwen ที่มีความสามารถโดยไม่มีค่าใช้จ่าย” และไม่จำเป็นต้องเป็น Qwen 3.8-Max โดยเฉพาะ โมเดลรุ่นก่อนหน้ามีตัวเลือกที่ใช้งานได้จริงกว่า
โมเดล Qwen แบบ open weight ที่เล็กกว่าสามารถทำงานบนฮาร์ดแวร์ที่เข้าถึงได้มากกว่า และรุ่นเก่าบางรุ่นมีช่องทางใช้งานฟรีที่ไม่ผูกกับระยะเวลา 90 วัน ดูตัวเลือกได้ใน คู่มือใช้งาน Qwen 3.7 ฟรี
ข้อแลกเปลี่ยนคือคุณจะไม่ได้ข้อได้เปรียบด้าน benchmark ของ Qwen 3.8-Max แต่สำหรับงานเช่น:
- โปรเจกต์เสริม
- ตัวจัดประเภทข้อมูล
- การทดลอง prompt
- การเรียนรู้โครงสร้าง Qwen API
- การสร้างต้นแบบก่อนตัดสินใจใช้บริการแบบเสียเงิน
โมเดลรุ่นก่อนหน้ามักเพียงพอแล้ว
สิ่งที่ไม่มีจริง ณ วันที่ 3 สิงหาคม 2026
เพื่อหลีกเลี่ยงข้อมูลคลาดเคลื่อน นี่คือสิ่งที่ยังไม่มีในเวลานั้น:
- ไม่มี API free tier แบบไม่จำกัด — มีเพียงโควตา 1M โทเค็น และมีวันหมดอายุ
- ไม่มี free tier นอกสิงคโปร์ — ปลายทางปักกิ่งและสหรัฐอเมริกา-เวอร์จิเนียคิดค่าบริการตั้งแต่โทเค็นแรก
- ยังไม่มีน้ำหนัก Qwen 3.8 ให้ดาวน์โหลด — คำว่า “สัปดาห์หน้า” ยังไม่ใช่ลิงก์ดาวน์โหลด
- ไม่มี Qwen 3.8-Max ฟรีอย่างเป็นทางการจากผู้รวบรวมภายนอก — หากพบข้อเสนอ “ฟรี” ก่อนน้ำหนักโมเดลถูกปล่อย ควรตรวจสอบโมเดลที่อยู่เบื้องหลังให้ชัดเจน
คำถามที่พบบ่อย
Qwen 3.8 API ฟรีจริงหรือ?
ฟรีบางส่วน คุณได้รับ 1 ล้านโทเค็นผ่าน Alibaba Cloud Model Studio ใช้ได้ 90 วันและเฉพาะภูมิภาคสิงคโปร์ หลังจากนั้นราคาอยู่ที่ $2 ต่อ 1 ล้านโทเค็นอินพุต และ $6 ต่อ 1 ล้านโทเค็นเอาต์พุต
ฉันดาวน์โหลดและรัน Qwen 3.8 บนเครื่องตอนนี้ได้หรือไม่?
ไม่ได้ ณ วันที่เขียนบทความ น้ำหนักโมเดลถูกระบุว่าจะปล่อยบน Hugging Face และ ModelScope ราววันที่ 10 สิงหาคม 2026 เมื่อเปิดให้ใช้งานแล้ว คุณยังต้องเตรียมพื้นที่จัดเก็บหลายร้อย GB และระบบ multi-GPU เพราะนี่คือโมเดลขนาด 2.4 ล้านล้านพารามิเตอร์
Qwen 3.8 ต่างจากตัวเลือกฟรีของ Kimi K3 อย่างไร?
น้ำหนักโมเดล Kimi K3 พร้อมดาวน์โหลดแล้ว จึงมีเส้นทางโฮสต์ด้วยตนเองในปัจจุบัน ส่วน Qwen 3.8 ยังอยู่ระหว่างรอการปล่อยน้ำหนักโมเดล ทั้งสองโมเดลมีขนาดใหญ่เกินกว่าฮาร์ดแวร์สำหรับผู้บริโภคทั่วไป ดูตัวเลือกเพิ่มเติมได้ใน คู่มือใช้งาน Kimi K3 ฟรี
โควตาฟรีครอบคลุม reasoning token หรือไม่?
ครอบคลุม แต่ reasoning token จะใช้โควตาเหมือน output token ปกติ เนื่องจากค่าเริ่มต้นของ reasoning_effort คือ xhigh ควรลดระดับสำหรับงานทั่วไป มิฉะนั้นโควตาอาจหมดไปกับกระบวนการคิดที่ไม่ได้จำเป็นต่อผลลัพธ์
สรุป
การเข้าถึง Qwen 3.8 แบบฟรีมีอยู่จริง แต่มีขอบเขตชัดเจน:
- ใช้ Qwen Chat สำหรับการทดลองแบบผู้ใช้ทั่วไป
- ใช้ Model Studio สำหรับ API ฟรี 1M โทเค็นในสิงคโปร์ภายใน 90 วัน
- รอน้ำหนักโมเดลแบบเปิด หากต้องการตัวเลือก hosting จากภายนอก
- ใช้ Qwen รุ่นเก่าหากต้องการโมเดลที่เข้าถึงได้ง่ายและยืดหยุ่นกว่า
หากคุณเลือกเส้นทาง API ให้เก็บโควตาสำหรับการประเมินที่สำคัญ แทนการใช้ไปกับการ debug ซ้ำ ๆ สร้าง request ต้นแบบใน Apidog ใช้ mock response ระหว่างพัฒนา และเรียก endpoint จริงเมื่อพร้อมทดสอบผลลัพธ์ของ Qwen 3.8-Max ในสแตกของคุณ

Top comments (0)