DEV Community

Cover image for วิธีใช้ GLM-5.3-Flash ใน Claude Code และ Cline
Thanawat Wongchai
Thanawat Wongchai

Posted on Originally published at apidog.com

วิธีใช้ GLM-5.3-Flash ใน Claude Code และ Cline

หากคุณสมัครแผน GLM Coding อยู่แล้ว GLM-5.3-Flash น่าสนใจเพราะมีรายงานว่าใช้โควตาได้ มากกว่า GLM-5.3 ถึง 3 เท่า ภายใต้แผนเดียวกัน แลกกับคะแนน Artificial Analysis Intelligence Index ที่ 57 แทน 60

ลองใช้ Apidog วันนี้

สำหรับงานโค้ดทั่วไป การแลกเปลี่ยนนี้คุ้มค่า: ใช้ Flash เป็นค่าเริ่มต้นเพื่อปริมาณงานสูงขึ้น แล้วสลับไป GLM-5.3 เฉพาะงานที่ซับซ้อนกว่า คู่มือนี้อธิบายการตั้งค่า GLM-5.3-Flash กับ Claude Code และ Cline รวมถึงจุดที่มักตั้งค่าผิด

สิ่งที่ต้องมี

  • GLM Coding Plan จาก z.ai — แผนเริ่มต้นประมาณ 18 ดอลลาร์ต่อเดือน
  • API key จากแดชบอร์ด Z.ai
  • Claude Code หรือ Cline ที่ติดตั้งแล้ว

ตรวจสอบโควตาและเงื่อนไขแผนล่าสุดบน z.ai ก่อนใช้งานจริง เพราะรายละเอียดแผนอาจเปลี่ยนได้ ตัวเลข 3 เท่ามาจากเอกสารของ Z.ai

Claude Code

Z.ai มี Anthropic-compatible endpoint จึงใช้กับ Claude Code ได้ผ่านตัวแปรสภาพแวดล้อม

ตั้งค่าอย่างรวดเร็ว

ใช้ตัวช่วยของ Z.ai:

npx @z_ai/coding-helper

Enter fullscreen mode Exit fullscreen mode

ป้อน API key และทำตามขั้นตอนที่เครื่องมือแสดง

ตั้งค่าด้วยตนเอง

เพิ่มค่าเหล่านี้ใน shell profile:

export ANTHROPIC_BASE_URL="https://api.z.ai/api/anthropic"
export ANTHROPIC_AUTH_TOKEN="your-z-ai-key"

Enter fullscreen mode Exit fullscreen mode

จากนั้นเปิด Claude Code ตามปกติ

ข้อควรระวัง:

  • ANTHROPIC_API_KEY ไม่ใช่ ANTHROPIC_AUTH_TOKEN หากมี Anthropic key เก่าถูก export อยู่ ให้ยกเลิกก่อน การตั้งค่าทั้งคู่พร้อมกันอาจทำให้เกิดข้อผิดพลาดการตรวจสอบสิทธิ์
  • ตัวแปรต้องอยู่ใน environment เดียวกับที่เปิด Claude Code หากตั้งไว้ใน .zshrc แต่เปิดเครื่องมือจาก IDE ที่ไม่ได้โหลด shell profile เครื่องมือจะไม่เห็นค่าเหล่านี้ ตรวจสอบด้วย:
echo $ANTHROPIC_BASE_URL
Enter fullscreen mode Exit fullscreen mode

เลือกโมเดล

ตั้งค่าโมเดลเป็น glm-5.3-flash:

{
  "model": "glm-5.3-flash"
}

Enter fullscreen mode Exit fullscreen mode

สำหรับงานที่มีบริบทยาว ให้เพิ่ม timeout:

export API_TIMEOUT_MS=3000000

Enter fullscreen mode Exit fullscreen mode

ค่านี้อ้างอิงจากการตั้งค่า GLM-5.2 และควรปรับตามการใช้งานจริง หากย้ายมาจากเวอร์ชันเดิม ดู คู่มือ GLM-5.2 สำหรับ Claude Code และ Cline

Cline

Cline เชื่อมต่อผ่าน OpenAI-compatible provider:

  1. เปิดการตั้งค่า Cline และเลือก OpenAI Compatible
  2. ตั้งค่า Base URL เป็น https://api.z.ai/api/coding/paas/v4
  3. วาง Z.ai API key
  4. เลือก Custom Model และใส่ glm-5.3-flash

Coding Plan ใช้ endpoint https://api.z.ai/api/coding/paas/v4 ไม่ใช่ standard API endpoint https://api.z.ai/api/paas/v4 การใช้ endpoint มาตรฐานกับ Coding Plan key เป็นสาเหตุทั่วไปของข้อผิดพลาด authorization

สำหรับการเรียก API โดยตรง ดู คู่มือ GLM-5.3-Flash API และตรวจสอบเส้นทางล่าสุดกับเอกสาร Z.ai เสมอ

ตั้งค่า Context Window

Cline อาจตรวจจับ context window ของ custom model ไม่ถูกต้อง หากทำงานกับโค้ดเบสขนาดใหญ่และพบว่าบริบทถูกตัดเร็ว ให้ตั้งค่า context window เป็น 1,000,000 ด้วยตนเอง

อาการนี้เคยเกิดกับ GLM-5.2: Cline ทิ้งบริบทไฟล์ก่อนเวลา แม้โมเดลจะรองรับบริบทนั้นได้

ทำไมใช้ Flash สำหรับ Agentic Coding

เกณฑ์มาตรฐาน GLM-5.3-Flash GLM-5.2
Terminal-Bench 2.1 84.3 ไม่สามารถเปรียบเทียบได้โดยตรง
DeepSWE 63.4 46.2
AutomationBench 48.8 26.2

ตัวเลข Terminal-Bench ประเมินเทียบกับ Claude Code 2.1.207 และควรถือเป็นข้อมูลจากผู้ขายจนกว่าจะมีการทำซ้ำโดยอิสระ

Artificial Analysis ให้ Intelligence Index แก่ GLM-5.3-Flash ที่ 57 เทียบกับ 60 สำหรับ GLM-5.3

จุดเด่นสำคัญคือ รองรับ image input แบบเนทีฟ: คุณสามารถส่งสกรีนช็อตพร้อมโค้ดในคำขอเดียว เหมาะสำหรับงานฟรอนต์เอนด์ เช่น ให้โมเดลวิเคราะห์เลย์เอาต์ที่ผิดจากภาพจริง ดูรายละเอียดในคู่มือ Vision API

ความเร็วและโควตา

  • GLM-5.3-Flash: ประมาณ 49 tokens/s
  • GLM-5.3: ประมาณ 86 tokens/s
  • เวลา token แรก: 1.52 วินาที เทียบกับ 1.57 วินาที

Flash เริ่มตอบได้เร็วใกล้เคียงกัน แต่จะช้ากว่าเมื่อสร้างผลลัพธ์ยาวมาก เช่น การเขียนไฟล์ใหม่หลายร้อยบรรทัด ข้อแลกเปลี่ยนคือโควตาเพิ่ม 3 เท่า แต่ความเร็วในการสร้างผลลัพธ์ลดลงเกือบครึ่ง

กลยุทธ์ใช้งานที่แนะนำ

ใช้ทั้งสองโมเดลตามประเภทงาน:

  • GLM-5.3-Flash: อ่านโค้ด, สำรวจโค้ดเบส, รันคำสั่ง, แก้ไขเล็กน้อย, งานวนซ้ำ และงานที่ใช้รูปภาพ
  • GLM-5.3: ปัญหาเชิงโครงสร้าง, refactor ขนาดใหญ่ และงานที่ Flash เคยทำไม่สำเร็จ

เพียงเปลี่ยน model ID ในการตั้งค่าเครื่องมือ คุณก็ยกระดับไปใช้ GLM-5.3 ได้ภายในไม่กี่วินาที วิธีนี้ช่วยเก็บงานส่วนใหญ่ไว้บนโมเดลโควตา 3 เท่า และใช้โควตา GLM-5.3 เมื่อจำเป็นจริง ๆ

Z.ai ยังระบุว่าการใช้งานนอกช่วงพีคอาจใช้คะแนนเพียงครึ่งหนึ่ง จึงควรจัดงาน agent แบบ batch หรือ background ไว้นอกช่วงดังกล่าว

แก้ไขปัญหาที่พบบ่อย

ทุกคำขอได้ 401 หรือ 403

สาเหตุที่พบบ่อย:

  • Base URL ไม่ตรงกับประเภท key
  • มี ANTHROPIC_API_KEY เก่าบัง ANTHROPIC_AUTH_TOKEN

ทดสอบ endpoint โดยตรงก่อนแก้การตั้งค่าเครื่องมือ

ไม่พบโมเดล

ตรวจสอบ model ID ให้ตรง:

glm-5.3-flash
Enter fullscreen mode Exit fullscreen mode

บน OpenRouter ชื่ออาจเป็น z-ai/glm-5.3-flash แต่ใช้แทน native model ID ของ Z.ai ไม่ได้

Context ถูกตัดเร็วเกินไป

ตั้งค่า context window ใน Cline เป็น 1,000,000 ด้วยตนเอง

คำขอขนาดใหญ่หมดเวลา

เพิ่มค่า API_TIMEOUT_MS เพราะคำขอที่มีบริบทยาวอาจเกินค่า timeout เริ่มต้นของไคลเอนต์ได้

โควตาหมดเร็ว

reasoning_effort มีค่าเริ่มต้นเป็น max และ reasoning tokens ถูกนับรวมในโควตา หากเครื่องมือรองรับ ให้ลดเป็น low สำหรับงานประจำวัน

Tool calling ล้มเหลว

ตรวจสอบว่าเครื่องมือและ endpoint ใช้รูปแบบ tool calling ที่เข้ากันได้ ส่วนนี้ไวต่อเวอร์ชันมากที่สุดและอาจเปลี่ยนหลังการอัปเดตทั้งฝั่งเครื่องมือและ API

เครื่องมืออื่นที่รองรับ

รูปแบบการเชื่อมต่อเดียวกันใช้กับเครื่องมือส่วนใหญ่:

ประเภทเครื่องมือ Endpoint การยืนยันตัวตน
Anthropic-compatible เช่น Claude Code และ agent framework บางตัว https://api.z.ai/api/anthropic ANTHROPIC_AUTH_TOKEN
OpenAI-compatible เช่น Cline, Roo, Kilo, OpenCode, Codex และ Cursor custom model https://api.z.ai/api/coding/paas/v4 API key มาตรฐาน

ใช้ glm-5.3-flash เป็น custom model ID

ดูตัวอย่างการตั้งค่ารุ่นก่อนหน้าได้ที่ GLM-5.1 กับ Claude Code และ Claude Code กับ Cursor และ GLM-4.7

ตรวจสอบการเชื่อมต่อ

ทดสอบ endpoint โดยตรงก่อนเชื่อถือการตั้งค่าในเครื่องมือ:

curl https://api.z.ai/api/coding/paas/v4/chat/completions \
  -H "[REDACTED CREDENTIAL] $ZAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [{"role": "user", "content": "reply with OK"}]
  }'

Enter fullscreen mode Exit fullscreen mode

หากคำขอส่งคืนผลลัพธ์ แต่เครื่องมือยังทำงานไม่ได้ ปัญหาอยู่ที่การกำหนดค่า ไม่ใช่ข้อมูลรับรอง

สำหรับการบันทึกและเปรียบเทียบคำขอ ใช้ Apidog เพื่อเก็บ coding endpoint และ standard endpoint แยกกัน โดยเก็บ key ไว้ใน environment variables เมื่อเกิด authorization error คุณจะตรวจสอบได้ทันทีว่าปัญหาอยู่ที่ endpoint หรือเครื่องมือ

คำถามที่พบบ่อย

ต้องมี Coding Plan หรือใช้ API credits ได้ไหม?

ใช้ได้ทั้งคู่ Coding Plan มักคุ้มกว่าสำหรับนักพัฒนาที่เขียนโค้ดทุกวัน ส่วน API billing เหมาะกับแอปพลิเคชัน ดูการเปรียบเทียบในโพสต์ราคา GLM-5.3-Flash

Flash มีโควตา 3 เท่าของ GLM-5.3 จริงหรือไม่?

เป็นตัวเลขที่ Z.ai ระบุไว้ ตรวจสอบอีกครั้งที่ z.ai/subscribe ก่อนวางแผนใช้งาน

ทำไม Cline ตัดบริบทของฉัน?

ตั้งค่า context window เป็น 1,000,000 ด้วยตนเอง เพราะ Cline อาจตรวจจับค่าของ custom model ไม่ถูกต้อง

ควรใช้ Base URL ใด?

ใช้ https://api.z.ai/api/anthropic สำหรับ Claude Code, https://api.z.ai/api/coding/paas/v4 สำหรับ OpenAI-compatible tools บน Coding Plan และ https://api.z.ai/api/paas/v4 สำหรับการเรียก API โดยตรง

ส่งสกรีนช็อตเข้า Claude Code ด้วย Flash ได้ไหม?

โมเดลรองรับ image input แบบเนทีฟ แต่การรองรับใน Claude Code ขึ้นอยู่กับเวอร์ชันเครื่องมือของคุณ จึงควรทดสอบก่อนนำไปใช้ใน workflow จริง

Top comments (0)