ใช้ Claude Code ฟรีไม่จำกัด ด้วยโมเดลที่รันบนเครื่องตัวเอง, ตั้งค่าเสร็จใน 5 นาที
โดย Nokka (นก-กา) | 11 กันยายน 2026
บทความนี้เขียนโดย AI (deepseek-v4.1-flash) ผ่าน Hermes Agent ตรวจสอบและเรียบเรียงโดย Nokka
Claude Code เป็นเครื่องมือเขียนโค้ดที่คนพูดถึงมากที่สุดในปีนี้ แต่ค่าใช้จ่ายแบบจ่ายตามการใช้งานทำให้หลายคนไม่กล้าใช้เต็มที่
ทางออกที่คนเริ่มรู้จักมากขึ้นคือตั้งค่าให้ Claude Code ทำงานกับโมเดลที่รันบนเครื่องตัวเอง ซึ่งไม่คิดค่าใช้จ่ายต่อคำขอ [1]
หลักการทำงานของวิธีนี้
Claude Code คุยกับโมเดลผ่านตัวแปรสภาพแวดล้อมที่กำหนดที่อยู่เซิร์ฟเวอร์ ถ้าเปลี่ยนที่อยู่ให้ชี้ไปที่เซิร์ฟเวอร์ในเครื่องแทนที่จะเป็นเซิร์ฟเวอร์ของบริษัท คำขอทั้งหมดก็จะวิ่งไปที่เครื่องเรา [2]
แนวคิดนี้ไม่ซับซ้อน แต่เป็นเทคนิคที่คนไม่ค่อยรู้เพราะเอกสารส่วนใหญ่พูดถึงแค่การใช้งานปกติ
ขั้นตอนที่สั้นที่สุด
Ollama มีคำสั่งที่ตั้งค่าทุกอย่างให้อัตโนมัติ ทำให้ขั้นตอนเหลือน้อยมาก [3]
เริ่มจากติดตั้ง Ollama แล้วดึงโมเดลที่ต้องการ จากนั้นใช้คำสั่งเดียวคือ ollama launch claude พร้อมระบุชื่อโมเดลที่ต้องการ
ถ้าต้องการตั้งค่าเอง กำหนดตัวแปรสภาพแวดล้อมสามตัวคือ ที่อยู่เซิร์ฟเวอร์เป็น localhost พอร์ต 11434, ตัวแปรโทเคนให้ตั้งค่าเป็นคำว่า ollama และตัวแปรคีย์ให้ตั้งเป็นค่าว่าง [2]
จุดที่คนมักตั้งผิดคือตัวแปรโทเคน ถ้าตั้งเป็นค่าว่างจะเชื่อมต่อไม่สำเร็จ ต้องเป็นคำว่า ollama ตามที่ระบบกำหนด
เลือกโมเดลอะไรดี
ตัวเลือกที่คนใช้กันมีหลายกลุ่ม [2][3]
โมเดลเฉพาะทางเขียนโค้ด อย่างตระกูลที่ออกแบบมาสำหรับงานนี้โดยตรง ให้ผลลัพธ์ดีที่สุดสำหรับการแก้โค้ด
โมเดลขนาดกลาง 20-30B เหมาะกับเครื่องที่มีแรม 32 GB ขึ้นไป ทำงานได้หลากหลายกว่าโมเดลขนาดเล็ก
โมเดลขนาดเล็ก 7-14B รันได้บนเครื่องทั่วไป แต่ความสามารถในงานซับซ้อนจะจำกัดตามขนาด
จุดที่ต้องเข้าใจคือโมเดล local ยังไม่เก่งเท่าโมเดลชั้นนำในคลาวด์สำหรับงานที่ต้องใช้เหตุผลหลายขั้น การตั้งความคาดหวังให้ตรงจึงสำคัญ
เทียบข้อดีข้อเสียกับแบบจ่ายเงิน
| หัวข้อ | โมเดล local | โมเดลคลาวด์ |
|---|---|---|
| ค่าใช้จ่ายต่อคำขอ | ไม่มี | จ่ายตามปริมาณ |
| ความเร็ว | ขึ้นกับฮาร์ดแวร์ | ขึ้นกับคิวของเซิร์ฟเวอร์ |
| ความเป็นส่วนตัว | โค้ดไม่ออกจากเครื่อง | โค้ดถูกส่งไปประมวลผลที่อื่น |
| ความสามารถ | จำกัดตามขนาดโมเดล | สูงสุดเท่าที่มีในตลาด |
| ใช้งานออฟไลน์ | ได้ | ไม่ได้ |
| ตั้งค่าครั้งแรก | ใช้เวลาพอสมควร | สมัครแล้วใช้ได้เลย |
ข้อควรระวังที่โพสต์ส่วนใหญ่ไม่บอก
หนึ่ง คำว่า "ฟรีไม่จำกัด" ต้องตีความให้ถูก มันฟรีในแง่ค่าบริการ แต่มีต้นทุนค่าไฟและค่าฮาร์ดแวร์ที่จ่ายล่วงหน้าไปแล้ว รวมถึงเวลาที่รอผลลัพธ์นานกว่าถ้าเครื่องไม่แรง
สอง โมเดล local ทำตามคำสั่งซับซ้อนได้ไม่เท่าโมเดลคลาวด์ ถ้าใช้กับงานที่ต้องเข้าใจโครงสร้างโปรเจกต์ใหญ่ อาจได้คำตอบที่ดูเหมือนถูกแต่ใช้ไม่ได้จริง
สาม การกำหนดค่าที่อยู่เซิร์ฟเวอร์ทำให้โค้ดทั้งหมดวิ่งผ่านเครื่องตัวเอง ซึ่งเป็นข้อดีเรื่องความเป็นส่วนตัว แต่ต้องระวังว่าอย่าเผลอตั้งค่าในเครื่องที่ใช้ร่วมกับคนอื่น
สี่ บางฟีเจอร์ของ Claude Code ที่พึ่งความสามารถเฉพาะของโมเดลต้นทางอาจไม่ทำงานเต็มที่เมื่อใช้โมเดลอื่น การทดสอบกับงานจริงของตัวเองเป็นวิธีที่แน่นอนที่สุด
มุมมองจากคนที่ใช้ AI เขียนโค้ดทุกวัน
ผมทำงานกับ AI ทั้งเขียนบทความและเขียนสคริปต์เล็ก ๆ และเคยลองตั้งค่าระบบให้ทำงานกับโมเดล local มาบ้าง
สิ่งที่ผมเรียนรู้คือความเร็วไม่ได้สำคัญเท่าความคาดหวังที่ตรง โมเดล local ที่ตอบช้ากว่าแต่ให้คำตอบที่ใช้ได้ทันที มีค่ากว่าโมเดลเร็วที่ตอบผิดแล้วต้องแก้ซ้ำ
อีกมุมที่คนมักมองข้ามคือเรื่องความเป็นส่วนตัว งานหลายอย่างที่ทำในเครื่องมีข้อมูลที่ไม่อยากส่งออกไปข้างนอก การรู้ว่าโค้ดไม่เคยออกจากเครื่องให้ความสบายใจที่ประเมินเป็นตัวเลขไม่ได้
คำแนะนำของผมคือใช้ทั้งสองแบบผสมกัน งานที่ต้องการความสามารถสูงสุดใช้คลาวด์ งานประจำที่มีความ sensitive ใช้ local และปรับสัดส่วนตามงบที่มีจริง
แหล่งอ้างอิง
[1] DataCamp, "Using Claude Code With Ollama Local Models" (2026), https://www.datacamp.com/tutorial/using-claude-code-with-ollama-local-models
[2] Nguyen, L., "Run Claude Code with Local & Cloud Models in 5 Minutes (Ollama, LM Studio, llama.cpp, OpenRouter)", Medium (2026), https://medium.com/@luongnv89/run-claude-code-on-local-cloud-models-in-5-minutes-ollama-openrouter-llama-cpp-6dfeaee03cda
[3] MindStudio, "How to Run Claude Code for Free Using Ollama and Open Router" (2026), https://www.mindstudio.ai/blog/how-to-run-claude-code-free-ollama-open-router
Top comments (0)