Ollama v0.33 เปิดตัว, ใช้ Claude Desktop กับโมเดล local ได้ด้วย toggle เดียว
โดย Nokka (นก-กา) | 26 สิงหาคม 2026
บทความนี้เขียนโดย AI (deepseek-v4-pro via ollama-cloud) ผ่าน Hermes Agent ภายใต้การควบคุมและตรวจสอบคุณภาพโดยมนุษย์, Nokka (นก-กา)
ก่อนอื่น, ทำความเข้าใจศัพท์
ก่อนเข้าเรื่อง ขอปูศัพท์ 3 คำที่คนอ่านบทความนี้ต้องรู้ก่อน:
- Ollama: เครื่องมือรันโมเดล AI บนเครื่องตัวเอง (local), โหลดโมเดลแล้วรันได้ทันที ไม่ต้องพึ่ง cloud
- Claude Desktop: แอปเดสก์ท็อปของ Anthropic ที่ใช้ Claude, ปกติใช้ได้แค่โมเดล Claude ผ่าน cloud
- Gateway Provider: "ตัวกลาง" ที่ให้แอปหนึ่ง (Claude Desktop) เรียกใช้โมเดลจากอีกที่หนึ่ง (Ollama) ได้
ถ้าให้อุปมา: Ollama คือ "โรงรถ" ที่เก็บโมเดล local ของคุณ, Claude Desktop คือ "รถ" ที่ปกติเติมน้ำมันจากปั๊ม Anthropic เท่านั้น, v0.33 คือการเปิดให้รถคันนี้เติมน้ำมันจากโรงรถของคุณเองได้
เกิดอะไรขึ้น: Ollama v0.33 เปิดตัว
Ollama ปล่อย v0.33.0 (21 ส.ค. 2026) โดยไฮไลท์ใหญ่คือการเชื่อมกับ Claude Desktop [1]
ข้อความเปิดตัวจาก Ollama [2]:
"ตอนนี้คุณสามารถตั้งค่า Claude Desktop ให้ทำงานกับ Ollama เป็น third-party gateway provider ได้อย่างง่ายดาย, แค่ toggle เดียว cloud และ local models ก็ทำงานร่วมกันได้"
ฟีเจอร์เด่น: Claude Desktop + Ollama
นี่คือหัวใจของ v0.33, และมันสำคัญมากสำหรับคนรัน local AI:
มันทำอะไรได้
| ความสามารถ | รายละเอียด |
|---|---|
| เปิด/ปิดโมเดลจาก menu bar | เลือกโมเดล Ollama ตัวไหนให้ใช้ใน Claude ได้ |
| เลือกโมเดล Ollama ใน Claude | ใช้โมเดล local ตรงจาก Claude Desktop |
| Cloud + local ทำงานร่วมกัน | สลับระหว่าง Claude (cloud) กับโมเดล local ได้ |
ทำไมถึงสำคัญ
เดิม Claude Desktop ใช้ได้แค่โมเดล Claude (ผ่าน cloud), ถ้าอยากใช้โมเดล local ต้องใช้ Claude Code หรือเครื่องมือแยก
ตอนนี้ Claude Desktop ใช้โมเดล Ollama ได้โดยตรง, แปลว่า:
- ✅ ใช้โมเดล local ฟรี (Qwen, Llama, DeepSeek) ใน Claude Desktop
- ✅ ข้อมูลอยู่ในเครื่อง ไม่ส่ง cloud
- ✅ สลับ cloud/local ได้ตามงาน
ฟีเจอร์รอง: ปรับปรุง caching
นอกจาก Claude Desktop แล้ว v0.33 ยังแก้ปัญหา caching ที่สำคัญ [1]:
| การแก้ไข | ปัญหาที่แก้ |
|---|---|
| Prefill restore points | retry ต่อจากจุดที่ค้าง ไม่เริ่มใหม่ |
| KV cache | แก้ Claude Code "tokens left" ที่ทำ cache พัง |
| Cancel long prefill | แก้ hang เมื่อ agent ยกเลิกงานยาว |
ผลลัพธ์: โมเดลที่ใช้ recurrent layers เร็วขึ้นมาก, จากเดิมที่ต้อง reprocess 46k/47k tokens ใหม่ทั้งหมด ตอนนี้ต่อจากจุดเดิมได้
ฟีเจอร์รอง: อื่นๆ
-
DeepSeek Harness launcher, fallback ไป
npxเมื่อ npm install ล้มเหลว + รองรับ Windows - MLX dependency update, อัปเดตสำหรับ Mac (Apple Silicon)
- แก้ packaging, แก้ bug ที่ macOS-specific assumptions ทำให้ Linux/Windows พัง
ข้อควรระวัง: มุมที่ต้องสมดุล
ก่อนสรุป ขอวางมุมให้ตรง:
| ข้อดี | ข้อควรระวัง |
|---|---|
| Claude Desktop ใช้โมเดล local ได้ | ยังเป็น pre-release (rc2), อาจมี bug |
| ข้อมูลอยู่ในเครื่อง (privacy) | โมเดล local เก่งน้อยกว่า Claude cloud |
| สลับ cloud/local ได้ | ต้องมี RAM พอสำหรับโมเดล local |
สรุปมุมมองของผม
ผมมองว่า v0.33 คือ "ก้าวสำคัญ" ของวงการ local AI เพราะมันเชื่อม 2 โลกที่เคยแยกกัน:
- โลก cloud (Claude Desktop), สะดวก แต่จ่ายเงิน + ข้อมูลออกนอกเครื่อง
- โลก local (Ollama), ฟรี + privacy แต่ต้อง setup เอง
ตอนนี้ทั้ง 2 โลก "คุยกันได้" ผ่าน toggle เดียว, และนี่สอดคล้องกับเทรนด์ที่เราคุยกันตลอด: AI กำลังย้ายจาก cloud ลงมาที่เครื่อง
สำหรับคนรัน local AI (อย่างผม) นี่คือข่าวดีมาก, เพราะแปลว่าเราสามารถใช้ Claude Desktop (interface ที่ดี) กับโมเดล local (ฟรี + privacy) ได้แล้ว
คุณได้ลอง v0.33 แล้วหรือยังครับ? แล้วคิดว่า "Claude Desktop + Ollama" จะทำให้คนหันมาใช้ local AI มากขึ้นไหม? คอมเมนต์แลกเปลี่ยนกันได้ครับ
ถ้าชอบบทความแนววิเคราะห์ AI แบบนี้ ติดตาม Nokka ได้ที่ dev.to/sarantoon
แหล่งอ้างอิง
[1] Ollama. "Release v0.33.0". GitHub. 2026. https://github.com/ollama/ollama/releases/tag/v0.33.0
[2] Ollama. "Ollama v0.33 is here!". X. 2026. https://x.com/ollama/status/2092453536634380763
บทความนี้วิเคราะห์จาก release notes ทางการของ Ollama v0.33.0 ข้อมูล ณ 26 สิงหาคม 2026 Nokka

Top comments (0)