โดย Nokka (นก-กา) | 23 กันยายน 2569
บทความนี้เขียนโดย AI (โมเดล glm-5.3 ของผู้ให้บริการ ollama-cloud) ผ่าน Hermes Agent จาก Nous Research ตรวจสอบและเรียบเรียงโดย Nokka
สัปดาห์นี้โซเชียลไทยจัดดอกไม้ให้ข่าวหนึ่งเต็มไปหมด: Xiaomi เปิดตัวโมเดล MiMo-V2.6 ที่ "ความฉลาดชนะ GLM-5.3 และ Kimi" พร้อมแพ็กเกจรายเดือน 6 ดอลลาร์ที่คนอวดว่าคุ้มเท่ากับจ่ายยี่สิบดอลลาร์ของค่ายอื่น ตามสไตล์ประจำของเรา ก่อนเชื่อข่าวไวรัลขอแค่ไล่ตรวจจากต้นทางจริงก่อนว่าอะไรจริง อะไรเพี้ยน อะไรไม่มีใครพูดถึง
บอกก่อนว่าเรื่องนี้ "จริงเกินกว่าที่คิด" เพราะเจ้าตัวเปิดซอร์สให้จริงใบอนุญาต MIT [1] แต่ก็มีสามจุดที่ข่าวกระจายพาดพูดเพี้ยน มาดูทีละข้อ
ข้อที่หนึ่ง: ชนะจริงไหม ตรวจจากตารางคะแนนอิสระ
ตัวเลขที่ทุกฝ่ายอ้างถึงคือ Artificial Analysis Intelligence Index (ฉบับ v4.3) ซึ่งเป็นดัชนีอิสระที่วัดโมเดลจากทั่วโลกเดือนละรอบ ตัวเลขจริงคือ [1] [2]
- MiMo-V2.6-Pro ได้ 46 (บางรายงานระบุเป็น 46.32 แบบละเอียด) ซึ่งเป็นคะแนนสูงสุดในบรรดาโมเดล open weights ตอนนี้จริง
- Qwen3.8 Max ได้ 45 · GLM-5.3 (โหมด max) ได้ 45 · Kimi K3 (โหมด max) ได้ 44 · DeepSeek V4.1 Flash (โหมด max) ได้ 39
แปลว่าข่าวที่ว่า "ชนะ" นั้นจริงแต่แบบชนะฉิบ คือนำขาด GLM-5.3 อยู่หนึ่งคะแนนและนำ Kimi สองคะแนน ไม่ใช่การพังคาเข้าโมเดลคู่แข่งอย่างที่ภาพกราฟิกบางกองหลอกให้รู้สึก และมีจุดที่โพสต์ไวรัลพาให้เพี้ยนจริง: คู่แข่งฝั่ง Kimi ที่ถูกเทียบคือรุ่น K3 ไม่ใช่ K2 อย่างที่บางโพสต์เขียน
ข้อจำกัดที่ต้องกำกับให้เต็มปาก: รองนี้ยังไม่ได้แปลว่ามันขึ้นแท่นโมเดลที่เก่งที่สุดในโลก เพราะเหนือกว่ามันยังมีกลุ่มโมเดลปิดอยู่หลายตัว ทั้งตระกูล Fable, Astra, Opus, Sol และ Muse Spark ที่คะแนนสูงกว่าอยู่ [2] สรุปตรงประเด็นคือมันคือแชมป์เฉพาะสาย open weights ไม่ใช่แชมป์เรือธง
สิ่งที่ไม่ค่อยมีใครเล่า: บททดสอบอิสระฝั่งการใช้จริง
สื่ออิสระ kingy.ai จับ MiMo-V2.6-Pro กับ Claude Opus 5 มาวิ่งโจทย์เดียวกันใน OpenCode (23 เช็กซ่อนอยู่) ผลคือสองตัวผ่านครบ 23/23 เท่ากันเป๊ะ แต่ค่าใช้จ่ายต่างกันคือราว 0.03 ดอลลาร์กับ 1.03 ดอลลาร์ ต่อรอบเดียว [2] นี่คือตัวเลขที่อธิบายว่าทำไมคนถึงตื่นเต้น ขณะที่คำเตือนจากงานเดียวกันคือ ตามบทวิเคราะห์ที่ไล่อ่านตาราง benchmark ทางการของ Xiaomi โมเดลนี้แพ้ Claude Opus 5 ถึง 10 จาก 14 รายการที่ทดสอบร่วมกัน [2]
ข้อที่สอง: แพ็กเกจ 6 ดอลลาร์จริงไหม อ่านตารางทางการแล้ว
เรื่องนี้จริงทั้งหมด และหน้า pricing ทางการอ่านได้ชัดกว่าที่โพสต์บอก [3]
- Lite: 6 ดอลลาร์/เดือน (จีน 39 หยวน) ได้ 4.1 พันล้านเครดิตต่อเดือน
- Standard: 16 ดอลลาร์ ได้ 11 พันล้าน · Pro: 50 ดอลลาร์ ได้ 38 พันล้าน · Max: 100 ดอลลาร์ ได้ 82 พันล้าน
- ซื้อรายปีลดราว 12% (Lite เหลือ 63.36 ดอลลาร์ต่อปี)
จุดขายที่โพสต์ไวรัลพูดถูกจริงคือ "ไม่มีลิมิตต่อช่วงเวลา" หน้าเอกสารทางการเขียนตรง ๆ ว่าไม่มีลิมิตการใช้ 5 ชั่วโมงแบบที่ค่ายอื่นเขามีกัน ใครอยากเบิร์นเครดิตให้หมดในคืนเดียวก็เชิญ [3] แต่มีรายละเอียดเชิงเทคนิคที่โพสต์ส่วนใหญ่ไม่บอก ตัวเลข "เครดิต" ไม่เท่ากับ "โทเคน" เสมอไป หน้าเอกสารระบุว่าเรียกโมเดลรุ่น pro ที่บริบท 256K กินเครดิตสองเท่าของโทเคน (1 โทเคน = 2 เครดิต) และถ้าเรียกที่บริบทสูงสุดหนึ่งล้านโทเคนจะกินสี่เท่า (1 โทเคน = 4 เครดิต) [4] ดังนั้น 4.1 พันล้านเครดิตหากใช้กับโมเดลรองทั้งหมดจะเท่ากับโทเคนสองพันล้านตัว แต่ถ้าจับงานหนักบริบทยาวจริง ๆ อาจเหลือแค่หลักพันล้าน ตรงนี้เองที่ทำให้คนใช้จริงรู้สึกว่าเครดิตหมดเร็วกว่าที่คิด ซึ่งก็คือประสบการณ์เดียวกับที่โพสต์ไวรัลเล่าไว้เอง แต่เหตุผลเป็นเรื่องตัวคูณที่จดไว้ในเอกสาร ไม่ใช่ระบบกลืนเครดิตลึกลับ ๆ
ผมมองว่าการเทียบ "6 ดอลลาร์ของ Xiaomi เท่ากับ 20 ดอลลาร์ของค่ายอื่น" เป็นความเห็นจากประสบการณ์ใช้จริงของแต่ละคน ไม่ใช่สูตรคำนวณที่ประกาศได้ เพราะขึ้นกับว่างานของคุณหนักบริบทยาวแค่ไหนและเรียกโมเดลรุ่นไหน ใครทำงานสั้น ๆ ทั่วไปจะได้ความคุ้มใกล้เคียงโพสต์ ส่วนใครยัดเอกสารแสนโทเคนเป็นประจำจะรู้สึกว่าเครดิตเดินเร็วกว่าภาพลวงตาที่หัวโพสต์สร้างไว้
ข้อที่สาม: สิ่งที่เก็บไว้ท้ายแต่น่าสนใจไม่แพ้กัน
สเปกที่คนลืมพูดถึงในคลื่นกระแส: โมเดลเป็นแบบ MoE ขนาดรวม 1.02 ล้านล้านพารามิเตอร์ (ทำงานจริง 42 พันล้าน) บริบทสูงสุดหนึ่งล้านโทเคน · ราคา API แบบจ่ายรายการคือ Pro ที่ 0.435 ดอลลาร์ต่อล้านโทเคนเข้า / 0.87 ออก ส่วน Flash รุ่นเบาอยู่ที่ 0.14 / 0.28 ดอลลาร์ [1] [2] และมีรุ่น UltraSpeed ที่เร็วขึ้นถึงยี่สิบเท่าในราคาแพงกว่าสิบเท่า สำหรับงานที่ความหน่วงสำคัญ
ตัวเลขที่ผมว่าเจ๋งที่สุดในเชิงวิศวกรรมคือวิธีฝึก: Xiaomi รันการเรียนรู้เสริมแรง (RL) 30 รอบบนโจทย์ตรวจสอบได้จริงภายในหกวัน ใช้เส้นทางประมาณเจ็ดแสนห้าหมื่นเส้น ค่าใช้จ่ายราว 850,000 ดอลลาร์สำหรับ Flash และ 2.62 ล้านดอลลาร์สำหรับ Pro ผลคือคะแนนงานสร้างซอฟต์แวร์ DeepSWE กระโดดจาก 58.4 เป็น 72.57 ในเวลาไม่ถึงสัปดาห์ [1] เป็นตัวอย่างครั้งใหม่ของกระแสที่ว่า การฝึกแบบเน้นโจทย์จริงตรวจได้กำลังให้ผลเร็วกว่าการเทรนยักษ์แบบเก่า
ส่วนข้อสังเกตเชิงความระมัดระวัง คะแนนส่วนใหญ่ที่ได้ยินตอนนี้ยังเป็นผลที่ Xiaomi รายงานเองปนกับดัชนีอิสระหนึ่งตัว การใช้จริงระยะยาวเรื่องความเสถียรและงานภาษาไทยยังต้องรอใครสักคนลองจริงเป็นระยะ และสำหรับคนไทยควรรู้ว่าโพสต์ต้นทางที่ชวนลองพร้อมโค้ดส่วนลดนั้นเป็นลิงก์แนะนำแบบมีส่วนแบ่ง บทความนี้ไม่มีโค้ดแนะนำใด ๆ ทั้งสิ้น
สรุปคำตอบสั้น ๆ ว่าข่าวไวรัลจริงแค่ไหน: โมเดลเก่งจริงและเปิดซอร์สจริง · ชนะแบบนำหนึ่งถึงสองคะแนนในสาย open weights (แต่ระบุรุ่นคู่แข่งผิดจาก K3 เป็น K2 ในหลายโพสต์) · ยังไม่ใช่ระดับหนึ่งของโลกรวม · แพ็กเกจ 6 ดอลลาร์จริงและไม่มีลิมิตชั่วโมงจริง แต่ตัวคูณเครดิตที่ 2 เท่าและ 4 เท่าคือจุดที่ต้องคิดก่อนเทียบกับค่ายอื่น ถ้าถามว่าคุ้มไหม สำหรับสายเขียนโค้ดงานปากกลางที่เสีย 20 ดอลลาร์ต่อเดือนอยู่กับค่ายอื่น คำตอบของผมคือคุ้มพอลองหนึ่งเดือนเพื่อวัดกับงานตัวเองก่อน
เขียนโดย Nokka (นก-กา) นักเขียนอิสระแกะรอยเทคโนโลยี สนใจเรื่องการตรวจข่าวให้เจอความจริงก่อนกระแส ติดตามได้ที่ dev.to/sarantoon
อ้างอิง:
[1] TestingCatalog. "Xiaomi open-sources MiMo-V2.6 Pro and Flash models." testingcatalog.com, 21 กันยายน 2026. https://www.testingcatalog.com/xiaomi-open-sources-mimo-v2-6-pro-and-flash-models/
[2] Kingy.ai. "MiMo-V2.6-Pro Benchmarks & Hands-On Test vs Claude Opus 5." kingy.ai, กันยายน 2026. https://kingy.ai/blog/mimo-v2-6-pro-benchmarks-specs-comparison/
[3] Xiaomi MiMo. "MiMo Token Plan Brand New Release." mimo.mi.com/docs, กันยายน 2026. https://mimo.mi.com/docs/en-US/news/latest/token-plan-release
[4] Xiaomi MiMo Open Platform. "Token Plan: Subscription Instructions." platform.xiaomimimo.com/docs, กันยายน 2026. https://platform.xiaomimimo.com/docs/en-US/price/tokenplan/subscription

Top comments (0)