หากคุณสมัครแผน GLM Coding อยู่แล้ว GLM-5.3-Flash น่าสนใจเพราะมีรายงานว่าใช้โควตาได้ มากกว่า GLM-5.3 ถึง 3 เท่า ภายใต้แผนเดียวกัน แลกกับคะแนน Artificial Analysis Intelligence Index ที่ 57 แทน 60
สำหรับงานโค้ดทั่วไป การแลกเปลี่ยนนี้คุ้มค่า: ใช้ Flash เป็นค่าเริ่มต้นเพื่อปริมาณงานสูงขึ้น แล้วสลับไป GLM-5.3 เฉพาะงานที่ซับซ้อนกว่า คู่มือนี้อธิบายการตั้งค่า GLM-5.3-Flash กับ Claude Code และ Cline รวมถึงจุดที่มักตั้งค่าผิด
สิ่งที่ต้องมี
- GLM Coding Plan จาก z.ai — แผนเริ่มต้นประมาณ 18 ดอลลาร์ต่อเดือน
- API key จากแดชบอร์ด Z.ai
- Claude Code หรือ Cline ที่ติดตั้งแล้ว
ตรวจสอบโควตาและเงื่อนไขแผนล่าสุดบน z.ai ก่อนใช้งานจริง เพราะรายละเอียดแผนอาจเปลี่ยนได้ ตัวเลข 3 เท่ามาจากเอกสารของ Z.ai
Claude Code
Z.ai มี Anthropic-compatible endpoint จึงใช้กับ Claude Code ได้ผ่านตัวแปรสภาพแวดล้อม
ตั้งค่าอย่างรวดเร็ว
ใช้ตัวช่วยของ Z.ai:
npx @z_ai/coding-helper
ป้อน API key และทำตามขั้นตอนที่เครื่องมือแสดง
ตั้งค่าด้วยตนเอง
เพิ่มค่าเหล่านี้ใน shell profile:
export ANTHROPIC_BASE_URL="https://api.z.ai/api/anthropic"
export ANTHROPIC_AUTH_TOKEN="your-z-ai-key"
จากนั้นเปิด Claude Code ตามปกติ
ข้อควรระวัง:
-
ANTHROPIC_API_KEYไม่ใช่ANTHROPIC_AUTH_TOKENหากมี Anthropic key เก่าถูก export อยู่ ให้ยกเลิกก่อน การตั้งค่าทั้งคู่พร้อมกันอาจทำให้เกิดข้อผิดพลาดการตรวจสอบสิทธิ์ - ตัวแปรต้องอยู่ใน environment เดียวกับที่เปิด Claude Code หากตั้งไว้ใน
.zshrcแต่เปิดเครื่องมือจาก IDE ที่ไม่ได้โหลด shell profile เครื่องมือจะไม่เห็นค่าเหล่านี้ ตรวจสอบด้วย:
echo $ANTHROPIC_BASE_URL
เลือกโมเดล
ตั้งค่าโมเดลเป็น glm-5.3-flash:
{
"model": "glm-5.3-flash"
}
สำหรับงานที่มีบริบทยาว ให้เพิ่ม timeout:
export API_TIMEOUT_MS=3000000
ค่านี้อ้างอิงจากการตั้งค่า GLM-5.2 และควรปรับตามการใช้งานจริง หากย้ายมาจากเวอร์ชันเดิม ดู คู่มือ GLM-5.2 สำหรับ Claude Code และ Cline
Cline
Cline เชื่อมต่อผ่าน OpenAI-compatible provider:
- เปิดการตั้งค่า Cline และเลือก OpenAI Compatible
- ตั้งค่า Base URL เป็น
https://api.z.ai/api/coding/paas/v4 - วาง Z.ai API key
- เลือก Custom Model และใส่
glm-5.3-flash
Coding Plan ใช้ endpoint
https://api.z.ai/api/coding/paas/v4ไม่ใช่ standard API endpointhttps://api.z.ai/api/paas/v4การใช้ endpoint มาตรฐานกับ Coding Plan key เป็นสาเหตุทั่วไปของข้อผิดพลาด authorization
สำหรับการเรียก API โดยตรง ดู คู่มือ GLM-5.3-Flash API และตรวจสอบเส้นทางล่าสุดกับเอกสาร Z.ai เสมอ
ตั้งค่า Context Window
Cline อาจตรวจจับ context window ของ custom model ไม่ถูกต้อง หากทำงานกับโค้ดเบสขนาดใหญ่และพบว่าบริบทถูกตัดเร็ว ให้ตั้งค่า context window เป็น 1,000,000 ด้วยตนเอง
อาการนี้เคยเกิดกับ GLM-5.2: Cline ทิ้งบริบทไฟล์ก่อนเวลา แม้โมเดลจะรองรับบริบทนั้นได้
ทำไมใช้ Flash สำหรับ Agentic Coding
| เกณฑ์มาตรฐาน | GLM-5.3-Flash | GLM-5.2 |
|---|---|---|
| Terminal-Bench 2.1 | 84.3 | ไม่สามารถเปรียบเทียบได้โดยตรง |
| DeepSWE | 63.4 | 46.2 |
| AutomationBench | 48.8 | 26.2 |
ตัวเลข Terminal-Bench ประเมินเทียบกับ Claude Code 2.1.207 และควรถือเป็นข้อมูลจากผู้ขายจนกว่าจะมีการทำซ้ำโดยอิสระ
Artificial Analysis ให้ Intelligence Index แก่ GLM-5.3-Flash ที่ 57 เทียบกับ 60 สำหรับ GLM-5.3
จุดเด่นสำคัญคือ รองรับ image input แบบเนทีฟ: คุณสามารถส่งสกรีนช็อตพร้อมโค้ดในคำขอเดียว เหมาะสำหรับงานฟรอนต์เอนด์ เช่น ให้โมเดลวิเคราะห์เลย์เอาต์ที่ผิดจากภาพจริง ดูรายละเอียดในคู่มือ Vision API
ความเร็วและโควตา
- GLM-5.3-Flash: ประมาณ 49 tokens/s
- GLM-5.3: ประมาณ 86 tokens/s
- เวลา token แรก: 1.52 วินาที เทียบกับ 1.57 วินาที
Flash เริ่มตอบได้เร็วใกล้เคียงกัน แต่จะช้ากว่าเมื่อสร้างผลลัพธ์ยาวมาก เช่น การเขียนไฟล์ใหม่หลายร้อยบรรทัด ข้อแลกเปลี่ยนคือโควตาเพิ่ม 3 เท่า แต่ความเร็วในการสร้างผลลัพธ์ลดลงเกือบครึ่ง
กลยุทธ์ใช้งานที่แนะนำ
ใช้ทั้งสองโมเดลตามประเภทงาน:
- GLM-5.3-Flash: อ่านโค้ด, สำรวจโค้ดเบส, รันคำสั่ง, แก้ไขเล็กน้อย, งานวนซ้ำ และงานที่ใช้รูปภาพ
- GLM-5.3: ปัญหาเชิงโครงสร้าง, refactor ขนาดใหญ่ และงานที่ Flash เคยทำไม่สำเร็จ
เพียงเปลี่ยน model ID ในการตั้งค่าเครื่องมือ คุณก็ยกระดับไปใช้ GLM-5.3 ได้ภายในไม่กี่วินาที วิธีนี้ช่วยเก็บงานส่วนใหญ่ไว้บนโมเดลโควตา 3 เท่า และใช้โควตา GLM-5.3 เมื่อจำเป็นจริง ๆ
Z.ai ยังระบุว่าการใช้งานนอกช่วงพีคอาจใช้คะแนนเพียงครึ่งหนึ่ง จึงควรจัดงาน agent แบบ batch หรือ background ไว้นอกช่วงดังกล่าว
แก้ไขปัญหาที่พบบ่อย
ทุกคำขอได้ 401 หรือ 403
สาเหตุที่พบบ่อย:
- Base URL ไม่ตรงกับประเภท key
- มี
ANTHROPIC_API_KEYเก่าบังANTHROPIC_AUTH_TOKEN
ทดสอบ endpoint โดยตรงก่อนแก้การตั้งค่าเครื่องมือ
ไม่พบโมเดล
ตรวจสอบ model ID ให้ตรง:
glm-5.3-flash
บน OpenRouter ชื่ออาจเป็น z-ai/glm-5.3-flash แต่ใช้แทน native model ID ของ Z.ai ไม่ได้
Context ถูกตัดเร็วเกินไป
ตั้งค่า context window ใน Cline เป็น 1,000,000 ด้วยตนเอง
คำขอขนาดใหญ่หมดเวลา
เพิ่มค่า API_TIMEOUT_MS เพราะคำขอที่มีบริบทยาวอาจเกินค่า timeout เริ่มต้นของไคลเอนต์ได้
โควตาหมดเร็ว
reasoning_effort มีค่าเริ่มต้นเป็น max และ reasoning tokens ถูกนับรวมในโควตา หากเครื่องมือรองรับ ให้ลดเป็น low สำหรับงานประจำวัน
Tool calling ล้มเหลว
ตรวจสอบว่าเครื่องมือและ endpoint ใช้รูปแบบ tool calling ที่เข้ากันได้ ส่วนนี้ไวต่อเวอร์ชันมากที่สุดและอาจเปลี่ยนหลังการอัปเดตทั้งฝั่งเครื่องมือและ API
เครื่องมืออื่นที่รองรับ
รูปแบบการเชื่อมต่อเดียวกันใช้กับเครื่องมือส่วนใหญ่:
| ประเภทเครื่องมือ | Endpoint | การยืนยันตัวตน |
|---|---|---|
| Anthropic-compatible เช่น Claude Code และ agent framework บางตัว | https://api.z.ai/api/anthropic |
ANTHROPIC_AUTH_TOKEN |
| OpenAI-compatible เช่น Cline, Roo, Kilo, OpenCode, Codex และ Cursor custom model | https://api.z.ai/api/coding/paas/v4 |
API key มาตรฐาน |
ใช้ glm-5.3-flash เป็น custom model ID
ดูตัวอย่างการตั้งค่ารุ่นก่อนหน้าได้ที่ GLM-5.1 กับ Claude Code และ Claude Code กับ Cursor และ GLM-4.7
ตรวจสอบการเชื่อมต่อ
ทดสอบ endpoint โดยตรงก่อนเชื่อถือการตั้งค่าในเครื่องมือ:
curl https://api.z.ai/api/coding/paas/v4/chat/completions \
-H "[REDACTED CREDENTIAL] $ZAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [{"role": "user", "content": "reply with OK"}]
}'
หากคำขอส่งคืนผลลัพธ์ แต่เครื่องมือยังทำงานไม่ได้ ปัญหาอยู่ที่การกำหนดค่า ไม่ใช่ข้อมูลรับรอง
สำหรับการบันทึกและเปรียบเทียบคำขอ ใช้ Apidog เพื่อเก็บ coding endpoint และ standard endpoint แยกกัน โดยเก็บ key ไว้ใน environment variables เมื่อเกิด authorization error คุณจะตรวจสอบได้ทันทีว่าปัญหาอยู่ที่ endpoint หรือเครื่องมือ
คำถามที่พบบ่อย
ต้องมี Coding Plan หรือใช้ API credits ได้ไหม?
ใช้ได้ทั้งคู่ Coding Plan มักคุ้มกว่าสำหรับนักพัฒนาที่เขียนโค้ดทุกวัน ส่วน API billing เหมาะกับแอปพลิเคชัน ดูการเปรียบเทียบในโพสต์ราคา GLM-5.3-Flash
Flash มีโควตา 3 เท่าของ GLM-5.3 จริงหรือไม่?
เป็นตัวเลขที่ Z.ai ระบุไว้ ตรวจสอบอีกครั้งที่ z.ai/subscribe ก่อนวางแผนใช้งาน
ทำไม Cline ตัดบริบทของฉัน?
ตั้งค่า context window เป็น 1,000,000 ด้วยตนเอง เพราะ Cline อาจตรวจจับค่าของ custom model ไม่ถูกต้อง
ควรใช้ Base URL ใด?
ใช้ https://api.z.ai/api/anthropic สำหรับ Claude Code, https://api.z.ai/api/coding/paas/v4 สำหรับ OpenAI-compatible tools บน Coding Plan และ https://api.z.ai/api/paas/v4 สำหรับการเรียก API โดยตรง
ส่งสกรีนช็อตเข้า Claude Code ด้วย Flash ได้ไหม?
โมเดลรองรับ image input แบบเนทีฟ แต่การรองรับใน Claude Code ขึ้นอยู่กับเวอร์ชันเครื่องมือของคุณ จึงควรทดสอบก่อนนำไปใช้ใน workflow จริง
Top comments (0)