Google เปิดตัว Gemini 4 Argon ถูกกว่า GPT-6 Astra 5 เท่า แต่ยังใช้ไม่ได้
โดย Nokka (นก-กา) | 1 ตุลาคม 2026
บทความนี้เขียนโดย AI (โมเดล deepseek-v4.1-flash ของผู้ให้บริการ ollama-cloud) ผ่าน Hermes Agent จาก Nous Research ตรวจสอบและเรียบเรียงโดย Nokka
TL;DR
Google เปิดตัว Gemini 4 Argon เมื่อวันที่ 30 กันยายน 2026 พร้อมราคาช่วงแนะนำที่ 2 ดอลลาร์ต่อล้านโทเคนขาเข้า และ 10 ดอลลาร์ต่อล้านโทเคนขาออก ซึ่งเป็นหนึ่งในห้าของราคา GPT-6 Astra ที่ตั้งไว้ 10 และ 50 ดอลลาร์[1][6] โมเดลรองรับผลลัพธ์ได้ถึง 1 ล้านโทเคน เพิ่มจาก 64,000 ของรุ่นก่อน[3][6] และนำตาราง benchmark ที่ Google เปิดเองอยู่ 13 จาก 19 รายการ[2][4] แต่ข้อที่คนอ่านต้องรู้ก่อนคือ ตอนนี้ยังไม่มีใครใช้ได้นอกจากกลุ่มผู้ป้องกันไซเบอร์ที่ผ่านการคัดกรอง กับทีมงาน Google เอง[1][5][8]
Google หายจากสนามไปสี่เดือน
การเปิดตัวครั้งนี้ไม่ใช่การออกโมเดลใหม่ตามรอบปกติ[1][3] ถ้าย้อนดูไทม์ไลน์ จะเห็นว่า Google หายไปจากสนามแข่งโมเดลแนวหน้าอยู่หลายเดือน
เดือนพฤษภาคม Sundar Pichai บอกว่าบริษัทจะออกโมเดลเรือธงรุ่นถัดไปในเดือนมิถุนายน[7] คนทั้งวงการเข้าใจว่านั่นคือ Gemini 3.5 Pro แต่เดือนมิถุนายนผ่านไปโดยไม่มีอะไรเกิดขึ้น Google ออกแต่รุ่น Flash ขนาดเล็กตลอดฤดูร้อน[3]
Axios รายงานในเดือนกรกฎาคมว่าขวัญกำลังใจของพนักงาน Google DeepMind ต่ำลง และเป็นเหตุผลส่วนหนึ่งที่งานล่าช้า[7] ช่วงเดียวกัน Alphabet งดส่ง Gemini 3.5 Pro ที่สัญญาไว้ว่าจะมาเดือนมิถุนายน และราคาหุ้นในเดือนนั้นปรับลงราว 4.4%[10][11]
แล้ว Google ก็กระโดดข้ามชื่อรุ่นไปเลย Gemini 3.5 Pro ไม่มีอยู่จริง กลายเป็น Gemini 4 Argon แทน[3][7] ซึ่งหมายความว่าโมเดลเรือธงรุ่นนี้ห่างจาก Gemini 3 เกือบหนึ่งปีพอดี[7]
ตัวเลขที่ Google เปิดเอง
คะแนนเด่นและคะแนนที่เป็นรอง
Google แนบตาราง benchmark 19 รายการมาในเอกสารที่แจกให้สื่อ โดยคำนวณจากตารางผลลัพธ์ฉบับเต็มที่แนบมากับเอกสารวิธีวัดของ DeepMind[2][4]
ตัดสินจากตารางนี้ Argon ได้คะแนนสูงสุดหรือเสมอสูงสุดมากกว่าคู่แข่งทั้งสองค่าย โดยนำขาด 13 รายการ เสมอ 1 รายการ และตามหลังอยู่ 5 รายการ[2][4]
Google เน้นหนักที่ DeepSWE v1.1 การทดสอบงานวิศวกรรมซอฟต์แวร์แบบยาว ที่ Argon ทำได้ 77.9% เทียบกับ Claude Opus 5.5 ที่ 74.2% และ GPT-6 Astra ที่ 74.1%[3][6] ตัวเลขนี้ห่างจาก Gemini 3.6 Flash ที่ออกในเดือนกรกฎาคมซึ่งได้ 49%[10]
| การทดสอบ | Argon | GPT-6 Astra | Opus 5.5 | Fable 5.1 |
|---|---|---|---|---|
| DeepSWE v1.1 (งานโค้ดยาว) | 77.9% | 74.1% | 74.2% | 67.4% |
| Harvey Legal Agent | 19.6% | 5.4% | 3.8% | 6.7% |
| AutomationBench (Zapier) | 51.3% | 41.4% | 42.5% | 31.4% |
| Vals Finance Agent v2 | 65.4% | 53.5% | 58.6% | 58.9% |
| Vals Index | 68.9% | 63.1% | 67.0% | 65.8% |
| FrontierSWE v2 | 55.0% | 65.5% | 62.3% | 56.3% |
ที่ห่างกันมากที่สุดคือ Harvey Legal Agent งานด้านกฎหมาย ที่ Argon ได้ 19.6% ขณะที่ Astra ได้ 5.4% และ Opus 5.5 ได้ 3.8%[4]
ส่วน AutomationBench ของ Zapier ซึ่งวัดงานธุรกิจแบบครบวงจร Argon ได้ 51.3% เทียบกับ Opus 5.5 ที่ 42.5% และ Astra ที่ 41.4%[3][4]
กับดักในตารางที่ต้องอ่านให้ครบ
วิธีวัดของแต่ละคอลัมน์ไม่เหมือนกัน
หน้าประเมินของ Google เขียนไว้ตรงๆ ว่าคะแนน DeepSWE v1.1 ของ Argon นั้น Google คำนวณเอง ในขณะที่คะแนนของ GPT-6 Astra มาจาก leaderboard สาธารณะ ส่วน Fable 5.1 กับ Opus 5.5 มาจาก system card ของแต่ละเจ้า[2]
ความหมายคือคอลัมน์ในตารางเดียวกันมาจากวิธีวัดคนละแบบ จึงเทียบกันแบบตัวต่อตัวได้ไม่ตรงทั้งหมด
จุดที่ตรงไปตรงมาที่สุดอยู่ที่ FrontierSWE v2 ที่ Argon ได้ 55.0% เป็นรองทั้ง Astra ที่ 65.5% และ Opus 5.5 ที่ 62.3% ขณะที่ Terminal-Bench 4.0 ยังเป็นของ Opus 5.5 อยู่[2][4]
Bloomberg รายงานเพิ่มว่า พนักงาน Google บางส่วนเห็นว่าโมเดลทำคะแนนได้ดีแต่ใช้งานจริงสู้ไม่เท่า และติดงานโค้ดบางประเภท โดยอ้างแหล่งที่เข้าถึงโครงการโดยตรง[5]
Google ตอบ Bloomberg ว่าไม่ถูกต้องที่จะบอกว่า Gemini 4 อ่อนด้านโค้ด และมีพนักงานคนหนึ่งบอกว่ามีความเห็นพ้องเป็นวงกว้างภายในบริษัทว่าโมเดลอยู่ระดับแนวหน้า[5]
ผมมองว่าตารางของผู้ผลิตเป็นจุดเริ่มต้นที่ดี แต่การอ่านบรรทัดที่ผู้ผลิตยอมรับว่าแพ้เอง ให้ข้อมูลมากกว่าการอ่านช่องที่ชนะ
ราคา: หนึ่งในห้าของ Astra
ช่วงแนะนำกับราคาปกติ
ราคาช่วงแนะนำของ Argon คือ 2 ดอลลาร์ต่อล้านโทเคนขาเข้า และ 10 ดอลลาร์ต่อล้านโทเคนขาออก โดยโทเคนขาเข้าที่แคชไว้ลดลง 95%[6] หลังหมดช่วงแนะนำ ราคาจะขยับเป็น 4 และ 20 ดอลลาร์[6]
เทียบกับ GPT-6 Astra ที่ตั้งไว้ 10 และ 50 ดอลลาร์ ซึ่งเป็นระดับเดียวกับ Claude Fable 5.1[6]
แปลว่าช่วงแนะนำ Argon ถูกกว่าอยู่ห้าเท่า และหลังหมดโปรยังถูกกว่าอยู่สองเท่าครึ่ง
Google ไม่ได้ระบุว่าช่วงแนะนำจะอยู่นานเท่าไร[6] ประเด็นนี้สำคัญสำหรับคนที่วางแผนงบ เพราะประโยคที่ว่า "ถูกกว่าห้าเท่า" เป็นจริงเฉพาะในช่วงที่ราคายังไม่ปรับ
ในวันที่ประกาศ หุ้น Alphabet ปิดบวก 0.9% ที่ 344.15 ดอลลาร์ และขยับขึ้นต่อในตลาดหลังเวลาเทรด[6]
ผลลัพธ์ 1 ล้านโทเคน
ข้อเปลี่ยนแปลงทางเทคนิคที่ชัดที่สุดคือเพดานผลลัพธ์ Argon รองรับผลลัพธ์ได้ถึง 1 ล้านโทเคน เพิ่มจาก 64,000 ของรุ่นก่อน[3][6] คิดเป็นราว 15.6 เท่า
ถ้าแปลงเป็นคำ สมมติฐานมาตรฐานที่ใช้กันคือ 1 โทเคนประมาณ 0.75 คำ เพดานใหม่จึงเทียบได้ราว 750,000 คำ จากเดิมที่ราว 48,000 คำ
ความหมายเชิงปฏิบัติคือ งานที่ต้องให้โมเดลเขียนโค้ดทั้งไฟล์ เขียนเอกสารยาว หรือวิเคราะห์ชุดข้อมูลขนาดใหญ่จบในรอบเดียว ทำได้มากขึ้นโดยไม่ต้องแบ่งเป็นท่อน
Google ใช้ Argon ทำงานในบ้านตัวเองแล้ว
งานที่ Google วัดผลได้
หลักฐานที่น่าสนใจกว่าตัวเลข benchmark คือผลงานที่ Google บอกว่าเกิดขึ้นจริงภายในบริษัท โดยพนักงานหลายพันคนใช้ Argon อยู่แล้ว[1][6]
ทีมของ Argon ย้ายโค้ด C และ C++ ไปเป็น Rust รวมถึงโค้ดของ re2, libgav1 และ Fuchsia Zircon kernel ที่ยาวกว่า 800,000 บรรทัด[1]
งานชิ้นหนึ่งที่วัดผลได้คือ libgav1 ซึ่งเขียนโค้ด SIMD ใหม่ 32,000 บรรทัด แล้วได้ผลลัพธ์วิดีโอเท่าเดิมแต่เร็วขึ้น 2.7 เท่า[1]
เอเจนต์ของ Argon ยังหาจุดปรับหน่วยความจำที่ประหยัดได้กว่า 300 TiB ทั่วศูนย์ข้อมูลของ Google แล้ว โดยประเมินว่าเมื่อทำครบจะประหยัดได้ระหว่าง 500 TiB ถึง 1 PiB[1][6]
ฝั่งงานวิทยาศาสตร์ Google บอกว่าทีมใช้ Argon ปรับการจัดสรร qubit และ gate ในงานควอนตัม จนทำผลลัพธ์ได้ดีกว่า baseline ที่ตีพิมพ์ไว้ราว 40% ภายในไม่กี่นาที[1]
ใครได้ใช้ Argon แล้ว และที่เหลือต้องรออะไร
ลำดับการเปิดให้ใช้
กลุ่มแรกที่ได้ใช้คือผู้ป้องกันไซเบอร์ที่ผ่านการตรวจสอบในโครงการ Fairwind ซึ่ง Google เปิดตัวเมื่อวันที่ 2 กันยายน 2026 และมีพันธมิตรมากกว่า 650 องค์กร รวมถึง CrowdStrike, Datadog, Menlo Security, Palo Alto Networks และ Snowflake โดยเปิดให้กลุ่มลูกค้า Google Cloud หน่วยงานรัฐ และพันธมิตรด้านความปลอดภัย[9]
กลุ่มนี้ได้ Argon แบบที่ Google เรียกว่า "ไม่มีกำแพงกันไซเบอร์" เพื่อให้ใช้ความสามารถได้เต็มที่[5]
บริษัทความปลอดภัย Wiz ใช้ Argon ผ่านโครงการ Scan for Good และพบช่องโหว่ระดับวิกฤตในซอฟต์แวร์สุขภาพที่โรงพยาบาลทั่วโลกใช้งาน ซึ่งโมเดลแนวหน้ารุ่นก่อนหาช่องนี้ไม่เจอ[5]
ลำดับถัดไปที่ Google ประกาศคือลูกค้า API แบบเสียเงิน และสมาชิก Google AI Ultra[1][5] แต่ยังไม่ระบุว่าเมื่อไร ทั้งสองกลุ่มนี้จึงยังไม่มีกำหนดชัดเจนว่าวันไหน
ข้อควรระวัง
ผมยังไม่ได้ทดลองใช้ Argon ด้วยตัวเอง และตอนนี้ก็ยังไม่มีช่องทางให้คนทั่วไปเข้าถึงได้ ทุกตัวเลขในบทความนี้จึงมาจากเอกสารที่ Google เผยแพร่และรายงานของสำนักข่าว
ตัวเลข benchmark ทั้งหมดเป็นตัวเลขที่ Google รวบรวมและเผยแพร่เอง โดยเฉพาะคะแนนของ Argon ที่บริษัทคำนวณเอง ส่วนคะแนนคู่แข่งมาจากแหล่งที่ Google หยิบมาใช้
วิธีที่ต่างกันทำให้การเทียบไม่ได้มาตรฐานเดียวกันทั้งหมด[2]
ราคาช่วงแนะนำเป็นราคาที่จะเปลี่ยน Google ยังไม่ประกาศกรอบเวลา ตัวเลขที่มีความหมายในระยะยาวคือราคาปกติที่ 4 และ 20 ดอลลาร์[6]
รายงานของ Bloomberg เรื่องความเห็นพนักงานภายในเป็นข้อมูลจากแหล่งไม่เปิดเผยชื่อที่ Google ปฏิเสธ และความเห็นนั้นเป็นเรื่องการใช้งานจริงระยะสั้น ไม่ใช่ผลการทดสอบที่เผยแพร่ต่อสาธารณะ
สรุป
ถ้าดูที่ราคากับเพดานผลลัพธ์ Gemini 4 Argon คือการตอบโต้ที่ตรงจุดของ Google ในสงครามราคาโมเดลแนวหน้า หลังปล่อยให้ OpenAI กับ Anthropic นำอยู่หลายเดือน
แต่ถ้าดูที่การเข้าถึง คำถามคือ Google กล้าปล่อยโมเดลที่แข็งที่สุดให้คนทั่วไปใช้เมื่อไร
การให้กลุ่มผู้ป้องกันไซเบอร์ใช้ก่อน โดยเปิดกำแพงความปลอดภัยออก เป็นการตัดสินใจที่มีเหตุผลของตัวเอง
ใครทำงานด้านโค้ดยาวหรือเอกสารยาว แล้วกำลังตัดสินใจเรื่องเครื่องมือ สิ่งที่ทำได้ตอนนี้คือเฝ้าดูราคาตอนเปิดกว้าง เพราะช่วงแนะนำมักไม่ยืนนาน และตัวเลขที่ควรจับตาคือราคาปกติ ไม่ใช่ราคาเปิดตัว
พี่ตูนอ่านแล้วเห็นว่าบริบทไหนของเรื่องนี้มีค่ากับคนทำงานไทยมากที่สุดครับ
REF
[1] Google, "Gemini 4 Argon: our next era of frontier intelligence" (ประกาศทางการ · Koray Kavukcuoglu · ทีม Argon ย้าย C และ C++ ไป Rust รวม Fuchsia Zircon kernel 800,000 บรรทัด · libgav1 SIMD 32,000 บรรทัด เร็วขึ้น 2.7 เท่า · ประหยัดหน่วยความจำ 300 TiB คาดถึง 500 TiB ถึง 1 PiB · งานควอนตัมดีกว่า baseline 40%), 30 กันยายน 2026. https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
[2] Google DeepMind, "Gemini 4 Argon Model evaluation: Approach, methodology & results" (วิธีวัด · คะแนน Argon เป็น pass@1 · DeepSWE v1.1 ของ Argon self computed ด้วย mini-swe agent harness · คะแนน GPT-6 Astra จาก leaderboard สาธารณะ · Fable 5.1 และ Opus 5.5 จาก system card · FrontierSWE v2 จาก leaderboard ของ Proximal), 30 กันยายน 2026. https://deepmind.google/models/evals-methodology/gemini-4-argon
[3] Ars Technica, "Google announces Gemini 4 Argon AI model, but you can't use it yet" (ประกาศเปิดตัว · Google ออกแต่รุ่น Flash ตลอดฤดูร้อนหลังสัญญา Gemini 3.5 Pro ไว้เดือนมิถุนายน · เพดานผลลัพธ์ 1 ล้านโทเคนจาก 64,000 · DeepSWE v1.1 ที่ 77.9%), 30 กันยายน 2026. https://arstechnica.com/google/2026/09/google-announces-gemini-4-argon-ai-model-but-you-cant-use-it-yet/
[4] VentureBeat, "Google unveils Gemini 4 Argon, retaking benchmark lead over OpenAI and Anthropic, but in limited release" (ตารางของ VentureBeat นับ 18 รายการ · Argon นำ 12 เสมอ 1 ตามหลัง 5 · เป็นคนละเกณฑ์การนับกับตารางของ Google เองซึ่งมี 19 แถวและ Argon นำ 13 เสมอ 1 ตามหลัง 5 · Harvey Legal Agent 19.6% เทียบ 5.4% และ 3.8% · AutomationBench 51.3% · GraphWalks 84.2%), 30 กันยายน 2026. https://venturebeat.com/technology/google-unveils-gemini-4-argon-retaking-benchmark-lead-over-openai-and-anthropic-but-in-limited-release
[5] The Next Web, "Google unveils Gemini 4 Argon, and cyber defenders get it first" (โครงการ Fairwind ให้กลุ่มผู้ป้องกันใช้ก่อน · ผู้ป้องกันได้ Argon แบบไม่มี cyber guardrails · Wiz พบช่องโหว่วิกฤตในซอฟต์แวร์โรงพยาบาล · Bloomberg รายงานว่า Google ยกเลิก Gemini 3.5 Pro ที่สัญญาไว้สำหรับเดือนมิถุนายน และรายงานความเห็นพนักงานภายในที่ Google ปฏิเสธ · Google ระบุว่าอยู่ในกระบวนการสมัครใจให้รัฐบาลสหรัฐเข้าถึงโมเดลก่อนเปิดตัว · Tulsee Doshi หัวหน้าผลิตภัณฑ์ Gemini ที่ Google DeepMind ให้สัมภาษณ์ Axios · Gemini 4 เป็นรุ่นเรือธงรุ่นแรกนับจาก Gemini 3 เมื่อเดือนพฤศจิกายน 2025), 30 กันยายน 2026. https://thenextweb.com/news/google-gemini-4-argon-cyber-defenders-fairwind
[6] AIStockWire, "Google unveils Gemini 4 Argon at one-fifth of GPT-6 Astra's token prices, with cyber defenders getting first access" (ราคาช่วงแนะนำ 2 และ 10 ดอลลาร์ · หลังช่วงแนะนำ 4 และ 20 ดอลลาร์ · แคชขาเข้าลด 95% · GPT-6 Astra 10 และ 50 ดอลลาร์ เท่ากับ Claude Fable 5.1 · Alphabet หุ้นปิดบวก 0.9% ที่ 344.15 ดอลลาร์ในวันพุธ · พนักงานหลายพันคนใช้ Argon · Bloomberg รายงานว่าทำคะแนนได้ดีแต่ใช้งานจริงสู้ไม่เท่า), 30 กันยายน 2026. https://aistockwire.com/blog/google-gemini-4-argon-googl-cyber-defenders-price-gpt-6-astra-september-2026
[7] Axios, "Google unveils Gemini 4, long-awaited answer to OpenAI and Anthropic" (Tulsee Doshi หัวหน้าผลิตภัณฑ์ Gemini ที่ Google DeepMind · Pichai บอกในเดือนพฤษภาคมว่ารุ่นถัดไปจะมาเดือนมิถุนายน · Axios รายงานเองในเดือนกรกฎาคมว่าขวัญกำลังใจที่ตกต่ำของพนักงาน Google DeepMind เป็นเหตุผลส่วนหนึ่งของความล่าช้า และ The Next Web [5] อ้างถึงรายงานฉบับนั้นด้วย · Gemini 4 ออกห่างจาก Gemini 3 เกือบหนึ่งปี · Google แจ้ง Bloomberg ว่าความเห็นเรื่องผลงานต่ำไม่ถูกต้อง · หมายเหตุการเข้าถึง: หน้าบทความของ Axios ตอบ Cloudflare กับ curl และเบราว์เซอร์ทั่วไป (ยืนยันสด 1 ต.ค. 2026) โดยเนื้อหาในป้ายนี้ตรวจเทียบได้ผ่านเครื่องมือดึงเนื้อหาแบบอ่านหน้าเว็บ และ The Next Web [5] กับ AIStockWire [6] อ้างรายงานฉบับเดียวกันนี้), 30 กันยายน 2026. https://www.axios.com/2026/09/30/google-gemini-4
[8] 9to5Google, "Google announces Gemini 4 Argon as its new frontier model" (รายงานการประกาศเปิดตัวโมเดลแนวหน้าของ Google และการจำกัดการเข้าถึง), 30 กันยายน 2026. https://9to5google.com/2026/09/30/gemini-4-argon-announcement/
[9] The Hacker News, "Google, Anthropic, and OpenAI Unveil Cyber AI Models, Safeguards, and Access Programs" (รายงานของ Ravie Lakshmanan · Google ประกาศ Gemini 3.8 Flash Cyber และโครงการ Fairwind · ระบุว่าทำงานกับพันธมิตรมากกว่า 650 รายทั่วโลก รวมถึง CrowdStrike, Datadog, Menlo Security, Palo Alto Networks และ Snowflake · โครงการเปิดให้กลุ่มลูกค้า Google Cloud หน่วยงานรัฐ และพันธมิตรด้านความปลอดภัย), 2 กันยายน 2026. https://thehackernews.com/2026/09/google-anthropic-and-openai-unveil.html
[10] Decrypt, "Gemini 4 Is Here, and Google's Flagship Tops All Other AI Models on Cybersecurity" (Alphabet หุ้นปรับลงราว 4.4% ในเดือนกรกฎาคมหลังงดส่ง Gemini 3.5 Pro · Gemini 3.6 Flash ทำ DeepSWE v1.1 ได้ 49% ในเดือนกรกฎาคม · Gray Swan IPI · Fairwind 650+ พันธมิตร), 30 กันยายน 2026. https://decrypt.co/379784/gemini-4-google-flagship-tops-ai-models-cybersecurity
[11] Yahoo Tech (เผยแพร่ซ้ำจาก Decrypt), "Gemini 4 Is Here, and Google's Flagship Tops All Other AI Models on Cybersecurity" (เนื้อหาเดียวกับ [10] · ยืนยันตัวเลข Alphabet ปรับลงราว 4.4% ในเดือนกรกฎาคม), 30 กันยายน 2026. https://tech.yahoo.com/ai/gemini/articles/gemini-4-google-flagship-tops-232059706.html
Top comments (0)