DEV Community

Nokka
Nokka

Posted on

Ollama v0.33 เปิดตัว, ใช้ Claude Desktop กับโมเดล local ได้ด้วย toggle เดียว

Ollama v0.33 เปิดตัว, ใช้ Claude Desktop กับโมเดล local ได้ด้วย toggle เดียว

โดย Nokka (นก-กา) | 26 สิงหาคม 2026

บทความนี้เขียนโดย AI (deepseek-v4-pro via ollama-cloud) ผ่าน Hermes Agent ภายใต้การควบคุมและตรวจสอบคุณภาพโดยมนุษย์, Nokka (นก-กา)

Ollama v0.33

ก่อนอื่น, ทำความเข้าใจศัพท์

ก่อนเข้าเรื่อง ขอปูศัพท์ 3 คำที่คนอ่านบทความนี้ต้องรู้ก่อน:

  • Ollama: เครื่องมือรันโมเดล AI บนเครื่องตัวเอง (local), โหลดโมเดลแล้วรันได้ทันที ไม่ต้องพึ่ง cloud
  • Claude Desktop: แอปเดสก์ท็อปของ Anthropic ที่ใช้ Claude, ปกติใช้ได้แค่โมเดล Claude ผ่าน cloud
  • Gateway Provider: "ตัวกลาง" ที่ให้แอปหนึ่ง (Claude Desktop) เรียกใช้โมเดลจากอีกที่หนึ่ง (Ollama) ได้

ถ้าให้อุปมา: Ollama คือ "โรงรถ" ที่เก็บโมเดล local ของคุณ, Claude Desktop คือ "รถ" ที่ปกติเติมน้ำมันจากปั๊ม Anthropic เท่านั้น, v0.33 คือการเปิดให้รถคันนี้เติมน้ำมันจากโรงรถของคุณเองได้

เกิดอะไรขึ้น: Ollama v0.33 เปิดตัว

Ollama ปล่อย v0.33.0 (21 ส.ค. 2026) โดยไฮไลท์ใหญ่คือการเชื่อมกับ Claude Desktop [1]

ข้อความเปิดตัวจาก Ollama [2]:

"ตอนนี้คุณสามารถตั้งค่า Claude Desktop ให้ทำงานกับ Ollama เป็น third-party gateway provider ได้อย่างง่ายดาย, แค่ toggle เดียว cloud และ local models ก็ทำงานร่วมกันได้"

ฟีเจอร์เด่น: Claude Desktop + Ollama

นี่คือหัวใจของ v0.33, และมันสำคัญมากสำหรับคนรัน local AI:

มันทำอะไรได้

ความสามารถ รายละเอียด
เปิด/ปิดโมเดลจาก menu bar เลือกโมเดล Ollama ตัวไหนให้ใช้ใน Claude ได้
เลือกโมเดล Ollama ใน Claude ใช้โมเดล local ตรงจาก Claude Desktop
Cloud + local ทำงานร่วมกัน สลับระหว่าง Claude (cloud) กับโมเดล local ได้

ทำไมถึงสำคัญ

เดิม Claude Desktop ใช้ได้แค่โมเดล Claude (ผ่าน cloud), ถ้าอยากใช้โมเดล local ต้องใช้ Claude Code หรือเครื่องมือแยก

ตอนนี้ Claude Desktop ใช้โมเดล Ollama ได้โดยตรง, แปลว่า:

  • ✅ ใช้โมเดล local ฟรี (Qwen, Llama, DeepSeek) ใน Claude Desktop
  • ✅ ข้อมูลอยู่ในเครื่อง ไม่ส่ง cloud
  • ✅ สลับ cloud/local ได้ตามงาน

ฟีเจอร์รอง: ปรับปรุง caching

นอกจาก Claude Desktop แล้ว v0.33 ยังแก้ปัญหา caching ที่สำคัญ [1]:

การแก้ไข ปัญหาที่แก้
Prefill restore points retry ต่อจากจุดที่ค้าง ไม่เริ่มใหม่
KV cache แก้ Claude Code "tokens left" ที่ทำ cache พัง
Cancel long prefill แก้ hang เมื่อ agent ยกเลิกงานยาว

ผลลัพธ์: โมเดลที่ใช้ recurrent layers เร็วขึ้นมาก, จากเดิมที่ต้อง reprocess 46k/47k tokens ใหม่ทั้งหมด ตอนนี้ต่อจากจุดเดิมได้

ฟีเจอร์รอง: อื่นๆ

  • DeepSeek Harness launcher, fallback ไป npx เมื่อ npm install ล้มเหลว + รองรับ Windows
  • MLX dependency update, อัปเดตสำหรับ Mac (Apple Silicon)
  • แก้ packaging, แก้ bug ที่ macOS-specific assumptions ทำให้ Linux/Windows พัง

ข้อควรระวัง: มุมที่ต้องสมดุล

ก่อนสรุป ขอวางมุมให้ตรง:

ข้อดี ข้อควรระวัง
Claude Desktop ใช้โมเดล local ได้ ยังเป็น pre-release (rc2), อาจมี bug
ข้อมูลอยู่ในเครื่อง (privacy) โมเดล local เก่งน้อยกว่า Claude cloud
สลับ cloud/local ได้ ต้องมี RAM พอสำหรับโมเดล local

สรุปมุมมองของผม

ผมมองว่า v0.33 คือ "ก้าวสำคัญ" ของวงการ local AI เพราะมันเชื่อม 2 โลกที่เคยแยกกัน:

  • โลก cloud (Claude Desktop), สะดวก แต่จ่ายเงิน + ข้อมูลออกนอกเครื่อง
  • โลก local (Ollama), ฟรี + privacy แต่ต้อง setup เอง

ตอนนี้ทั้ง 2 โลก "คุยกันได้" ผ่าน toggle เดียว, และนี่สอดคล้องกับเทรนด์ที่เราคุยกันตลอด: AI กำลังย้ายจาก cloud ลงมาที่เครื่อง

สำหรับคนรัน local AI (อย่างผม) นี่คือข่าวดีมาก, เพราะแปลว่าเราสามารถใช้ Claude Desktop (interface ที่ดี) กับโมเดล local (ฟรี + privacy) ได้แล้ว

คุณได้ลอง v0.33 แล้วหรือยังครับ? แล้วคิดว่า "Claude Desktop + Ollama" จะทำให้คนหันมาใช้ local AI มากขึ้นไหม? คอมเมนต์แลกเปลี่ยนกันได้ครับ

ถ้าชอบบทความแนววิเคราะห์ AI แบบนี้ ติดตาม Nokka ได้ที่ dev.to/sarantoon

แหล่งอ้างอิง

[1] Ollama. "Release v0.33.0". GitHub. 2026. https://github.com/ollama/ollama/releases/tag/v0.33.0

[2] Ollama. "Ollama v0.33 is here!". X. 2026. https://x.com/ollama/status/2092453536634380763


บทความนี้วิเคราะห์จาก release notes ทางการของ Ollama v0.33.0 ข้อมูล ณ 26 สิงหาคม 2026 Nokka

Top comments (0)