DEV Community

Nokka
Nokka

Posted on

ใช้ Claude Code ฟรีไม่จำกัด ด้วยโมเดลที่รันบนเครื่องตัวเอง, ตั้งค่าเสร็จใน 5 นาที

ใช้ Claude Code ฟรีไม่จำกัด ด้วยโมเดลที่รันบนเครื่องตัวเอง, ตั้งค่าเสร็จใน 5 นาที

โดย Nokka (นก-กา) | 11 กันยายน 2026

บทความนี้เขียนโดย AI (deepseek-v4.1-flash) ผ่าน Hermes Agent ตรวจสอบและเรียบเรียงโดย Nokka

Claude Code เป็นเครื่องมือเขียนโค้ดที่คนพูดถึงมากที่สุดในปีนี้ แต่ค่าใช้จ่ายแบบจ่ายตามการใช้งานทำให้หลายคนไม่กล้าใช้เต็มที่

ทางออกที่คนเริ่มรู้จักมากขึ้นคือตั้งค่าให้ Claude Code ทำงานกับโมเดลที่รันบนเครื่องตัวเอง ซึ่งไม่คิดค่าใช้จ่ายต่อคำขอ [1]

หลักการทำงานของวิธีนี้

Claude Code คุยกับโมเดลผ่านตัวแปรสภาพแวดล้อมที่กำหนดที่อยู่เซิร์ฟเวอร์ ถ้าเปลี่ยนที่อยู่ให้ชี้ไปที่เซิร์ฟเวอร์ในเครื่องแทนที่จะเป็นเซิร์ฟเวอร์ของบริษัท คำขอทั้งหมดก็จะวิ่งไปที่เครื่องเรา [2]

แนวคิดนี้ไม่ซับซ้อน แต่เป็นเทคนิคที่คนไม่ค่อยรู้เพราะเอกสารส่วนใหญ่พูดถึงแค่การใช้งานปกติ

ขั้นตอนที่สั้นที่สุด

Ollama มีคำสั่งที่ตั้งค่าทุกอย่างให้อัตโนมัติ ทำให้ขั้นตอนเหลือน้อยมาก [3]

เริ่มจากติดตั้ง Ollama แล้วดึงโมเดลที่ต้องการ จากนั้นใช้คำสั่งเดียวคือ ollama launch claude พร้อมระบุชื่อโมเดลที่ต้องการ

ถ้าต้องการตั้งค่าเอง กำหนดตัวแปรสภาพแวดล้อมสามตัวคือ ที่อยู่เซิร์ฟเวอร์เป็น localhost พอร์ต 11434, ตัวแปรโทเคนให้ตั้งค่าเป็นคำว่า ollama และตัวแปรคีย์ให้ตั้งเป็นค่าว่าง [2]

จุดที่คนมักตั้งผิดคือตัวแปรโทเคน ถ้าตั้งเป็นค่าว่างจะเชื่อมต่อไม่สำเร็จ ต้องเป็นคำว่า ollama ตามที่ระบบกำหนด

เลือกโมเดลอะไรดี

ตัวเลือกที่คนใช้กันมีหลายกลุ่ม [2][3]

โมเดลเฉพาะทางเขียนโค้ด อย่างตระกูลที่ออกแบบมาสำหรับงานนี้โดยตรง ให้ผลลัพธ์ดีที่สุดสำหรับการแก้โค้ด

โมเดลขนาดกลาง 20-30B เหมาะกับเครื่องที่มีแรม 32 GB ขึ้นไป ทำงานได้หลากหลายกว่าโมเดลขนาดเล็ก

โมเดลขนาดเล็ก 7-14B รันได้บนเครื่องทั่วไป แต่ความสามารถในงานซับซ้อนจะจำกัดตามขนาด

จุดที่ต้องเข้าใจคือโมเดล local ยังไม่เก่งเท่าโมเดลชั้นนำในคลาวด์สำหรับงานที่ต้องใช้เหตุผลหลายขั้น การตั้งความคาดหวังให้ตรงจึงสำคัญ

เทียบข้อดีข้อเสียกับแบบจ่ายเงิน

หัวข้อ โมเดล local โมเดลคลาวด์
ค่าใช้จ่ายต่อคำขอ ไม่มี จ่ายตามปริมาณ
ความเร็ว ขึ้นกับฮาร์ดแวร์ ขึ้นกับคิวของเซิร์ฟเวอร์
ความเป็นส่วนตัว โค้ดไม่ออกจากเครื่อง โค้ดถูกส่งไปประมวลผลที่อื่น
ความสามารถ จำกัดตามขนาดโมเดล สูงสุดเท่าที่มีในตลาด
ใช้งานออฟไลน์ ได้ ไม่ได้
ตั้งค่าครั้งแรก ใช้เวลาพอสมควร สมัครแล้วใช้ได้เลย

ข้อควรระวังที่โพสต์ส่วนใหญ่ไม่บอก

หนึ่ง คำว่า "ฟรีไม่จำกัด" ต้องตีความให้ถูก มันฟรีในแง่ค่าบริการ แต่มีต้นทุนค่าไฟและค่าฮาร์ดแวร์ที่จ่ายล่วงหน้าไปแล้ว รวมถึงเวลาที่รอผลลัพธ์นานกว่าถ้าเครื่องไม่แรง

สอง โมเดล local ทำตามคำสั่งซับซ้อนได้ไม่เท่าโมเดลคลาวด์ ถ้าใช้กับงานที่ต้องเข้าใจโครงสร้างโปรเจกต์ใหญ่ อาจได้คำตอบที่ดูเหมือนถูกแต่ใช้ไม่ได้จริง

สาม การกำหนดค่าที่อยู่เซิร์ฟเวอร์ทำให้โค้ดทั้งหมดวิ่งผ่านเครื่องตัวเอง ซึ่งเป็นข้อดีเรื่องความเป็นส่วนตัว แต่ต้องระวังว่าอย่าเผลอตั้งค่าในเครื่องที่ใช้ร่วมกับคนอื่น

สี่ บางฟีเจอร์ของ Claude Code ที่พึ่งความสามารถเฉพาะของโมเดลต้นทางอาจไม่ทำงานเต็มที่เมื่อใช้โมเดลอื่น การทดสอบกับงานจริงของตัวเองเป็นวิธีที่แน่นอนที่สุด

มุมมองจากคนที่ใช้ AI เขียนโค้ดทุกวัน

ผมทำงานกับ AI ทั้งเขียนบทความและเขียนสคริปต์เล็ก ๆ และเคยลองตั้งค่าระบบให้ทำงานกับโมเดล local มาบ้าง

สิ่งที่ผมเรียนรู้คือความเร็วไม่ได้สำคัญเท่าความคาดหวังที่ตรง โมเดล local ที่ตอบช้ากว่าแต่ให้คำตอบที่ใช้ได้ทันที มีค่ากว่าโมเดลเร็วที่ตอบผิดแล้วต้องแก้ซ้ำ

อีกมุมที่คนมักมองข้ามคือเรื่องความเป็นส่วนตัว งานหลายอย่างที่ทำในเครื่องมีข้อมูลที่ไม่อยากส่งออกไปข้างนอก การรู้ว่าโค้ดไม่เคยออกจากเครื่องให้ความสบายใจที่ประเมินเป็นตัวเลขไม่ได้

คำแนะนำของผมคือใช้ทั้งสองแบบผสมกัน งานที่ต้องการความสามารถสูงสุดใช้คลาวด์ งานประจำที่มีความ sensitive ใช้ local และปรับสัดส่วนตามงบที่มีจริง

แหล่งอ้างอิง

[1] DataCamp, "Using Claude Code With Ollama Local Models" (2026), https://www.datacamp.com/tutorial/using-claude-code-with-ollama-local-models

[2] Nguyen, L., "Run Claude Code with Local & Cloud Models in 5 Minutes (Ollama, LM Studio, llama.cpp, OpenRouter)", Medium (2026), https://medium.com/@luongnv89/run-claude-code-on-local-cloud-models-in-5-minutes-ollama-openrouter-llama-cpp-6dfeaee03cda

[3] MindStudio, "How to Run Claude Code for Free Using Ollama and Open Router" (2026), https://www.mindstudio.ai/blog/how-to-run-claude-code-free-ollama-open-router

Top comments (0)