DEV Community

Cover image for Gemini 4 Argon เทียบกับ Gemini 3.8 Flash: ควรรอ Argon หรือใช้งาน Flash ตอนนี้ดี?
Thanawat Wongchai
Thanawat Wongchai

Posted on Originally published at apidog.com

Gemini 4 Argon เทียบกับ Gemini 3.8 Flash: ควรรอ Argon หรือใช้งาน Flash ตอนนี้ดี?

Gemini 3.8 Flash พร้อมใช้งานแล้ววันนี้ในสถานะโมเดลเสถียร พร้อมแพ็กเกจ API ฟรี ราคาอยู่ที่ 0.75 ดอลลาร์สำหรับอินพุต และ 3.75 ดอลลาร์สำหรับเอาต์พุตต่อ 1 ล้านโทเค็นจนถึงวันที่ 31 ธันวาคม 2569 หลังจากนั้นจะเปลี่ยนเป็น 1.50 ดอลลาร์และ 7.50 ดอลลาร์ตามลำดับ โดยเอาต์พุตสูงสุดคือ 64K โทเค็น ส่วน Gemini 4 Argon ยังไม่เปิดให้ใช้งานทั่วไป โพสต์เปิดตัว ของ Google ระบุราคาแนะนำที่ 2 ดอลลาร์และ 10 ดอลลาร์ ก่อนเปลี่ยนเป็น 4 ดอลลาร์และ 20 ดอลลาร์ โดยยังไม่ระบุวันสิ้นสุดของราคาแนะนำ Argon รองรับเอาต์พุตได้สูงสุด 1 ล้านโทเค็นตามที่ Google ระบุ แต่ปัจจุบันเปิดให้เฉพาะผู้เข้าร่วมโครงการ Fairwind เท่านั้น หากต้องเปิดตัวในไตรมาสนี้ ให้เริ่มด้วย Flash และออกแบบคอนฟิกให้สลับไป Argon ได้ด้วยการเปลี่ยนตัวแปรเดียว

ลองใช้ Apidog วันนี้

บทความนี้เปรียบเทียบความพร้อมใช้งาน ราคา เกณฑ์มาตรฐาน ความปลอดภัยไซเบอร์ และต้นทุนของคำขอเดียวกัน เพื่อช่วยตัดสินใจเลือกโมเดล สำหรับข้อมูลพื้นฐาน ดู Gemini 4 Argon คืออะไร และ Gemini 3.8 Flash คืออะไร ส่วนท้ายของบทความจะแสดงวิธีตั้งค่า Apidog เพื่อสลับโมเดลโดยแก้ตัวแปรเดียว

เปรียบเทียบ: สิ่งที่เรียกใช้งานได้แล้ววันนี้

Gemini 3.8 Flash Gemini 4 Argon
ความพร้อมใช้งาน เสถียรบน Gemini API, AI Studio, Antigravity และ Gemini Enterprise พาร์ทเนอร์บางรายในโครงการ Fairwind ในฐานะโมเดลที่ได้รับการจัดการบน Gemini Enterprise
Model ID gemini-3.8-flash ยังไม่เผยแพร่
ราคาต่อ 1 ล้านโทเค็น (อินพุต / เอาต์พุต) 0.75 ดอลลาร์ / 3.75 ดอลลาร์ จนถึง 31 ธ.ค. 2569 จากนั้น 1.50 ดอลลาร์ / 7.50 ดอลลาร์ 2 ดอลลาร์ / 10 ดอลลาร์ในช่วงแนะนำ จากนั้น 4 ดอลลาร์ / 20 ดอลลาร์
อินพุตที่แคชต่อ 1 ล้าน 0.075 ดอลลาร์ จากนั้น 0.15 ดอลลาร์ 0.10 ดอลลาร์ในช่วงแนะนำ จากนั้น 0.20 ดอลลาร์ (ลด 95% สำหรับอินพุต)
ขีดจำกัดเอาต์พุต 65,536 โทเค็น 1 ล้านโทเค็น ตามขีดจำกัดที่ Google ระบุ
Input window 1,048,576 โทเค็น ยังไม่เผยแพร่
ระดับการคิด low, medium (ค่าเริ่มต้น), high; minimal จะคืนค่า HTTP 400 ไม่ได้ระบุในเอกสาร
แพ็กเกจ API ฟรี มี แต่จำกัดอัตราการใช้งาน ยังไม่มีประกาศ
การเข้าถึงสำหรับผู้ใช้ แอป Gemini บน AI Pro และ Ultra, โหมด AI ใน Search ยังไม่พร้อมใช้งาน; ผู้สมัครสมาชิก AI Ultra อยู่ในกลุ่มแรก แต่ยังไม่มีวันที่

มีรายละเอียดสำคัญที่ต้องระวัง:

  • Google ยังไม่เผยแพร่ Input window ของ Argon แม้ว่าการประเมิน context แบบยาวของบริษัทจะใช้ prompt สูงสุด 1 ล้านโทเค็น
  • Google ระบุเอาต์พุตสูงสุดของ Argon ที่ 1 ล้านโทเค็น แต่ Vals AI รายงานเอาต์พุตสูงสุด 262K สำหรับการตั้งค่าที่ใช้ทดสอบ
  • การประเมิน Argon ใช้ “การตั้งค่าการคิดสูงสุด” จึงมีแนวโน้มว่าระดับสูงจะมีอยู่จริง แต่ Google ยังไม่ได้ระบุชื่อระดับหรือค่าเริ่มต้น
  • Flash รองรับระดับการคิดตาม เอกสารเกี่ยวกับการคิด ของ Google และ คู่มือระดับการคิดของ 3.8 Flash

แพ็กเกจฟรีของ Flash มี rate limit และ Google ระบุว่าข้อมูลจากแพ็กเกจฟรี “ถูกนำไปใช้เพื่อปรับปรุงผลิตภัณฑ์ของเรา” ขณะที่ Argon ยังไม่มีประกาศเรื่องการใช้งานฟรี หากต้องการตัวเลือกสำหรับทดลองใช้งาน ดู คำอธิบายการเข้าถึง Argon ฟรี

แถวเกณฑ์มาตรฐานที่โพสต์เปิดตัวทั้งสองฉบับระบุไว้

ตารางเปิดตัวของ Google สำหรับทั้งสองโมเดลมีเกณฑ์มาตรฐานสองรายการที่ระบุในข้อความ ตัวเลขทั้งหมดเป็นข้อมูลที่ Google รายงาน และระเบียบวิธีของ Argon อ้างอิง Vals AI สำหรับทั้งสองแถว

เกณฑ์มาตรฐาน Gemini 3.8 Flash (ตาราง 2 ก.ย.) Gemini 4 Argon (ตาราง 30 ก.ย.)
Vals Finance Agent v2 61.4% 65.4%
Harvey Legal Agent Benchmark 10.0% 19.6%

Google เผยแพร่ตารางเหล่านี้ห่างกันหนึ่งเดือน และเปรียบเทียบกับคู่แข่งคนละชุด จึงควรใช้ตัวเลขเป็นแนวทาง ไม่ใช่การทดสอบแบบควบคุมโดยตรง

อย่างไรก็ตาม ช่องว่างด้านกฎหมายมีนัยสำคัญ: Argon ได้ 19.6% เทียบกับ Flash ที่ 10.0% ส่วนงานการเงินต่างกัน 4 จุด

ตาราง Argon ยังมีข้อมูลอีกหลายรายการที่ไม่มีคู่เทียบตรงกับ Flash ในโพสต์เดียวกัน ตัวอย่างเช่น ตาราง Flash มี HLE-Verified แต่ตาราง Argon ไม่มี ขณะที่คะแนน DeepSWE ของ Flash ปรากฏเฉพาะในภาพการ์ดโมเดล

บนกระดานผู้นำ Text ของ Arena ซึ่งเป็นการจัดอันดับจากบุคคลที่สาม Argon (High) อยู่ที่อันดับ 1 ในผลโหวตเบื้องต้น ส่วน Gemini 3.8 Flash (High) อยู่อันดับ 11 ดูตาราง Argon แบบเต็ม 19 แถวและแหล่งวัดของแต่ละแถวได้ที่ รายละเอียดเกณฑ์มาตรฐานของ Argon

ความปลอดภัยไซเบอร์: Argon เทียบกับ 3.8 Flash Cyber

หน้าความปลอดภัยไซเบอร์ของ DeepMind เปรียบเทียบ Argon กับ Gemini 3.8 Flash Cyber ซึ่งเป็นรุ่นด้านความปลอดภัยไซเบอร์ของ Flash ที่มีการควบคุมการเข้าถึงผ่าน Fairwind

การประเมินความปลอดภัยไซเบอร์ Gemini 4 Argon Gemini 3.8 Flash Cyber
การค้นพบช่องโหว่ในโลกจริง 85.8% 71.0%
Wiz Penetration Test Benchmark 70.9% 58.2%

ทั้งสองโมเดลมีข้อจำกัดด้านการเข้าถึง:

  • Gemini 3.8 Flash Cyber เปิดให้ใช้งานทั่วไปเฉพาะบัญชีที่อยู่ใน allowlist บน Gemini Enterprise Agent Platform
  • Argon ใช้งานได้เฉพาะผู้เข้าร่วม Fairwind

หากคุณไม่ใช่พาร์ทเนอร์ Fairwind ตัวเลขเหล่านี้ไม่ได้เปลี่ยนตัวเลือกที่นำไปพัฒนาได้ในวันนี้: Gemini 3.8 Flash รุ่นทั่วไปคือโมเดลที่พร้อมใช้งาน

ค่าใช้จ่ายของคำขอเดียวกันในทั้งสองโมเดล

สมมติคำขอหนึ่งครั้งใช้:

  • อินพุต 100,000 โทเค็น
  • เอาต์พุต 8,000 โทเค็น

โมเดล Gemini ปัจจุบันรวมถึง 3.8 Flash คิดค่า thinking tokens เป็นเอาต์พุต ดังนั้น 8,000 โทเค็นนี้รวม thinking tokens แล้ว Google ยังไม่ได้ระบุวิธีคิดค่าบริการ thinking tokens ของ Argon จึงคำนวณโดยสมมติว่าใช้แนวทางเดียวกับโมเดล Gemini ปัจจุบัน

โมเดลและช่วงเวลา ค่าใช้จ่ายอินพุต ค่าใช้จ่ายเอาต์พุต รวมต่อคำขอ
3.8 Flash, ช่วงแนะนำ 0.1M × $0.75 = $0.075 0.008M × $3.75 = $0.030 $0.105
3.8 Flash, ตั้งแต่ 2027-01-01 0.1M × $1.50 = $0.150 0.008M × $7.50 = $0.060 $0.210
Argon, ช่วงแนะนำ 0.1M × $2 = $0.200 0.008M × $10 = $0.080 $0.280
Argon, มาตรฐาน 0.1M × $4 = $0.400 0.008M × $20 = $0.160 $0.560

Argon มีอัตราต่อโทเค็นเป็น 8/3 หรือประมาณ 2.67 เท่าของ Flash ทั้งในช่วงแนะนำและราคามาตรฐาน

หากมีคำขอลักษณะนี้ 1,000 ครั้งต่อวัน:

  • Flash ช่วงแนะนำ: 105 ดอลลาร์ต่อวัน
  • Argon ช่วงแนะนำ: 280 ดอลลาร์ต่อวัน

ก่อนนำตัวเลขนี้ไปใช้วางงบประมาณ ต้องพิจารณา 3 จุด:

  1. จำนวนโทเค็นอาจไม่เท่ากัน

    Prompt เดียวกันอาจใช้เอาต์พุตและ thinking tokens ไม่เท่ากันในแต่ละโมเดล การประเมิน Argon ใช้การคิดระดับสูงสุด และ Google เตือนว่าระดับความพยายามที่สูงขึ้นของ Flash อาจใช้โทเค็นมากกว่า

  2. เอาต์พุตยาวเปลี่ยนรูปแบบการคิดต้นทุน

    คำตอบ 200,000 โทเค็นเกินขีดจำกัด 65,536 โทเค็นของ Flash จึงต้องแบ่งเป็นหลายคำขอ แต่ภายใต้ขีดจำกัดที่ Google ระบุ Argon อาจตอบได้ในครั้งเดียว:

    • ช่วงแนะนำ: 0.2M × $10 = $2.00
    • ราคามาตรฐาน: 0.2M × $20 = $4.00

สำหรับเอาต์พุต 1 ล้านโทเค็นเต็ม:

  • ช่วงแนะนำ: 10 ดอลลาร์
  • ราคามาตรฐาน: 20 ดอลลาร์
  1. วันสิ้นสุดราคาแนะนำไม่เท่ากัน ราคาแนะนำของ Flash สิ้นสุดวันที่ 31 ธันวาคม 2569 แต่ Google ยังไม่ระบุว่า Argon จะสิ้นสุดราคาแนะนำเมื่อใด

Flash ยังมี Batch ที่ลดราคา 50% — 0.375 ดอลลาร์สำหรับอินพุต และ 1.875 ดอลลาร์สำหรับเอาต์พุตจนถึงวันที่ 31 ธันวาคม — ตาม หน้าการกำหนดราคา Gemini API ขณะที่ Google ยังไม่เผยแพร่ราคา Batch ของ Argon

ดูรายละเอียดเพิ่มเติมได้ที่ คู่มือการกำหนดราคา Argon และ คู่มือการกำหนดราคา 3.8 Flash

คุณควรรอ Argon หรือใช้ Flash?

ใช้ 3.8 Flash ตอนนี้เมื่อ

  • งบประมาณเป็นข้อจำกัดหลัก

    Flash มีราคา 3/8 ของ Argon ต่อโทเค็น และ Batch ลดราคาได้อีกครึ่งหนึ่ง

  • คุณมีทราฟฟิกปริมาณมาก

    งานจัดหมวดหมู่ ดึงข้อมูล กำหนดเส้นทาง และแชตจำนวนมากจะสะสมต้นทุนอย่างรวดเร็วเมื่อเอาต์พุตอยู่ที่ 10 ดอลลาร์ต่อ 1 ล้านโทเค็น

  • ต้องเปิดใช้งานวันนี้

    Flash มี Model ID ที่เสถียร แพ็กเกจฟรีสำหรับทำ prototype และตารางราคาที่เผยแพร่แล้ว

  • เอาต์พุตไม่เกิน 65,536 โทเค็น

    งาน API ส่วนใหญ่อยู่ในขอบเขตนี้

วางแผนใช้ Argon เมื่อ

  • งานมี context และขั้นตอนการให้เหตุผลระยะยาว

    Google ระบุว่า Argon “สร้างขึ้นเพื่อรองรับการให้เหตุผลเชิงลึกในเวิร์กโฟลว์ที่ซับซ้อนและมีขอบเขตระยะยาว”

  • ต้องการเอาต์พุตเกิน 64K

    เช่น การเขียนโมดูลใหม่ทั้งหมด รายงานขนาดยาว หรือการย้ายข้อมูลขนาดใหญ่

  • คุณสร้าง agent ด้านกฎหมายหรือการเงิน

    เป็นสองหมวดที่ Google เผยแพร่ผลเปรียบเทียบทั้งสองโมเดล และ Argon ทำคะแนนสูงกว่า

  • คุณเป็นผู้เข้าร่วม Fairwind ที่มีสิทธิ์

    Argon คือโมเดลที่โครงการนี้เปิดให้ใช้งานอยู่ในขณะนี้

แนวทางที่เหมาะกับระบบจริงคือส่งงานส่วนใหญ่ไป Flash และกำหนดเส้นทางงานที่ยากกว่าไป Argon เมื่อโมเดลเปิดให้ใช้งาน โดยใช้โครงสร้างคอนฟิกเดียวกัน

หนึ่งคำขอที่บันทึกไว้, สองโมเดล

เก็บชื่อโมเดลไว้ใน environment variable ใช้ 3.8 Flash สำหรับคำขอจริงวันนี้ และสลับค่าเมื่อ Google เผยแพร่ Model ID ของ Argon อย่าคาดเดา ID ล่วงหน้า เพราะ Google ยังไม่ได้ประกาศ

MODEL="${GEMINI_MODEL:-gemini-3.8-flash}"

curl -s -X POST \
  "https://generativelanguage.googleapis.com/v1beta/models/${MODEL}:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"contents":[{"parts":[{"text":"Summarize this contract clause in 3 bullets."}]}],
       "generationConfig":{"thinkingConfig":{"thinkingLevel":"medium"},"maxOutputTokens":8192}}'
Enter fullscreen mode Exit fullscreen mode

นำคำขอนี้ไปใช้เป็น baseline ด้วยขั้นตอนต่อไปนี้:

  1. สร้าง environment เช่น flash-baseline
  2. เพิ่มตัวแปร GEMINI_API_KEY
  3. เพิ่มตัวแปร GEMINI_MODEL=gemini-3.8-flash
  4. บันทึกคำขอ generateContent
  5. เพิ่ม assertion อย่างน้อย:
    • HTTP status ต้องเป็น 200
    • ฟิลด์ผลลัพธ์ที่แอปพลิเคชันอ่านต้องมีอยู่
    • usageMetadata.thoughtsTokenCount ต้องไม่เกินเพดานตามงบประมาณ
  6. ตั้ง maxOutputTokens เพื่อป้องกันคำตอบยาวเกินคาด
  7. รันใน test scenario และเก็บรายงานไว้เป็น baseline

การตอบกลับ generateContent ทุกครั้งมี usageMetadata ใช้ Apidog เก็บตัวแปรสภาพแวดล้อม บันทึกคำขอ และเปรียบเทียบผลลัพธ์ระหว่างโมเดลในภายหลังได้

มีข้อควรระวังสำหรับวันเปิดตัว Argon สองข้อ:

  • Google ระบุว่า “โมเดลใหม่ทั้งหมด” จะเปิดตัวบน Interactions API แต่ยังไม่ได้ยืนยันว่า Argon รองรับ generateContent หรือไม่
  • ควรบันทึกคำขอ Interactions API ไว้คู่กัน:
POST https://generativelanguage.googleapis.com/v1beta/interactions
Enter fullscreen mode Exit fullscreen mode

โดยใช้ generation_config.thinking_level

นอกจากนี้ Google ยังไม่ได้ระบุชื่อระดับการคิดของ Argon ดังนั้น medium อาจใช้ไม่ได้ เมื่อ Argon เปิดตัว ให้เปลี่ยนเฉพาะ GEMINI_MODEL รันชุดทดสอบเดิม แล้วเปรียบเทียบเอาต์พุตและ usageMetadata แบบเคียงข้างกัน

คำถามที่พบบ่อย

Gemini 4 Argon ดีกว่า Gemini 3.8 Flash หรือไม่?

จากสองแถวที่ตารางเปิดตัวทั้งสองระบุไว้ ใช่: Argon ได้ 65.4% เทียบกับ Flash ที่ 61.4% ใน Vals Finance Agent v2 และ 19.6% เทียบกับ 10.0% ใน Harvey’s Legal Agent Benchmark อย่างไรก็ตาม Argon มีค่าใช้จ่ายต่อโทเค็นประมาณ 2.67 เท่า และยังเรียกใช้งานทั่วไปไม่ได้

ควรรอ Gemini 4 Argon หรือไม่?

ไม่ หากคุณต้องเปิดตัวตอนนี้ Google ยังไม่ได้ประกาศวันวางจำหน่ายทั่วไป โดยระบุเพียงว่าจะเริ่มจากลูกค้า API แบบชำระเงินและผู้สมัครสมาชิก AI Ultra โดยเร็วที่สุด

สำหรับโครงการใหม่ ควรเลือก Gemini 3.8 Flash หรือ Argon?

เริ่มด้วย 3.8 Flash และเก็บชื่อโมเดลไว้ในตัวแปร ย้ายเฉพาะคำขอที่ต้องการเอาต์พุตยาว หรืองานกฎหมายและการเงินที่ซับซ้อนไป Argon หลังจากทดสอบด้วย prompt จริงของคุณแล้ว

มีวิธีใช้งาน Argon ฟรีหรือไม่?

ไม่มี Google ยังไม่ได้ประกาศแพ็กเกจฟรี ดู คำอธิบายการเข้าถึง Argon ฟรี สำหรับโมเดล Gemini ฟรีที่ใช้ได้ในวันนี้

Argon จะมาแทนที่ Gemini 3.8 Flash หรือไม่?

Google ยังไม่ได้กล่าวเช่นนั้น Google เรียก Argon ว่าเป็นโมเดลแนวหน้าใหม่ และ Reuters รายงานว่ามีขนาดใหญ่กว่า Pro line ก่อนหน้า จึงเป็นโมเดลคนละระดับกับ Flash

ขั้นตอนถัดไป

ตั้งค่าคำขอของคุณวันนี้ รันบน Gemini 3.8 Flash และเก็บรายงานต้นทุนกับ usageMetadata ไว้ เมื่อ Argon เปิดตัว คุณจะเปรียบเทียบคุณภาพ เวลา และค่าใช้จ่ายกับ workload จริงได้ภายในไม่กี่นาที

ดาวน์โหลด Apidog เพื่อสร้างและบันทึกชุดทดสอบเปรียบเทียบโมเดลของคุณ

Top comments (0)