Gemini 4 Argon เปิดตัวแล้ว แต่คนทั่วไปยังใช้ไม่ได้

|ผู้เขียน: กองบรรณาธิการ QUASA|2 นาทีในการอ่าน| 8
Gemini 4 Argon เปิดตัวแล้ว แต่คนทั่วไปยังใช้ไม่ได้

Gemini 4 Argon เปิดตัวตามประกาศของ Google ลงวันที่ 30 กันยายน 2026 และกำลังทยอยให้ผู้ป้องกันภัยไซเบอร์ที่คัดเลือกผ่าน Fairwind Program ใช้ก่อน สำหรับบุคคลทั่วไปและธุรกิจไทย ยังไม่มีวันเปิดให้เข้าถึงโมเดลผ่าน API หรือแอปที่ประกาศไว้ การมีชื่อโมเดลและราคาเผยแพร่แล้วจึงยังไม่เท่ากับการมีสิทธิ์เรียกใช้ในบัญชีทั่วไป

รายงานของ Axios ระบุว่าการเปิดใช้ระยะแรกจำกัดอยู่ในกลุ่มพันธมิตรด้านไซเบอร์ขนาดเล็ก และ Tulsee Doshi หัวหน้าฝ่ายผลิตภัณฑ์ Gemini ของ Google DeepMind อธิบายความสามารถของโมเดลว่า “Argon is a well-rounded model that has frontier capabilities across several domains” คำกล่าวนี้ครอบคลุมหลายประเภทงาน แต่ยังไม่ได้ตอบคำถามว่าผู้ใช้ในไทยจะได้รับสิทธิ์เมื่อใด ซึ่งต้องแยกจากผลทดสอบความสามารถและแผนเปิดบริการในระยะถัดไป

สิทธิ์ที่เริ่มเปิดอยู่กับกลุ่มใด

Fairwind Program เป็นช่องทางของการเข้าถึงระยะแรกสำหรับผู้ป้องกันภัยไซเบอร์ที่ผ่านการคัดเลือก ขอบเขตของการเปิดใช้จึงอยู่ที่องค์กรและทีมที่ได้รับสิทธิ์ ไม่ได้ขยายโดยอัตโนมัติไปยังทุกคนที่ใช้แอป Gemini หรือทุกองค์กรที่ชำระค่าบริการ Google อยู่แล้ว ความแตกต่างนี้มีผลโดยตรงต่อผู้ที่เห็นคำว่าเปิดตัวแล้วต้องการนำ Argon ไปใช้ทันที: ประกาศผลิตภัณฑ์เกิดขึ้นแล้ว แต่สิทธิ์ใช้งานยังผูกกับกลุ่มเฉพาะ

งานของกลุ่มแรกเกี่ยวข้องกับการค้นหา ตรวจสอบ และแก้ไขช่องโหว่ของซอฟต์แวร์ จึงมีบริบทต่างจากการถามตอบทั่วไปหรือการเรียก API เพื่อพัฒนาแอป การเปิดให้กลุ่มนี้ใช้เป็นการนำโมเดลไปทำงานจริงในวงจำกัด ไม่ใช่เพียงการแสดงตัวอย่างความสามารถ อย่างไรก็ตาม สิทธิ์ของพันธมิตร Fairwind ไม่สามารถใช้อนุมานได้ว่าบัญชีผู้ใช้ส่วนบุคคลหรือบัญชีธุรกิจในไทยจะเห็นตัวเลือกเดียวกัน

ลำดับการขยายที่เปิดเผยไว้เริ่มจากลูกค้า API แบบชำระเงินและสมาชิก Google AI Ultra ก่อนจะขยายสู่กลุ่มนักพัฒนา องค์กร และผู้บริโภคในวงกว้างขึ้น ข้อความนี้ระบุ ลำดับกลุ่มผู้ใช้ ไม่ใช่วันเปิดบริการ หรือคำรับรองว่าสมาชิกทุกประเทศจะได้รับสิทธิ์พร้อมกัน ผู้ถือบัญชีแบบชำระเงินจึงยังแยกให้ออกระหว่างการถูกระบุว่าอยู่ในกลุ่มถัดไปกับการมีสิทธิ์ใช้งานแล้ว

การทยอยเปิดมีอีกขั้นอยู่ก่อนหน้าการขยายวง คือรับผลจากผู้ทดสอบกลุ่มแรกและปรับมาตรการป้องกัน Google ยังเข้าร่วมกระบวนการให้หน่วยงานรัฐบาลสหรัฐฯ เข้าถึงโมเดลก่อนเผยแพร่ตามความสมัครใจของบริษัทด้วย ขั้นเหล่านี้อธิบายว่าทำไมแผนเปิดตัวจึงระบุทิศทางได้ แต่ยังไม่ระบุวันเปิด API สำหรับตลาดไทย การประเมินความปลอดภัยและการกำหนดสิทธิ์เป็นคนละเรื่องกับการวัดว่าโมเดลตอบโจทย์ทดสอบได้ดีเพียงใด

ราคา API บอกอะไรได้ก่อนเปิดบริการ

อัตราช่วงแนะนำที่ประกาศไว้คือ 2 ดอลลาร์สหรัฐต่อโทเคนขาเข้าหนึ่งล้านหน่วย และ 10 ดอลลาร์ต่อโทเคนขาออกหนึ่งล้านหน่วย โทเคนขาเข้าที่ใช้แคชมีส่วนลด 95% จากอัตราขาเข้า เมื่อพ้นช่วงแนะนำ อัตราที่ระบุไว้จะเป็น 4 ดอลลาร์สำหรับขาเข้าและ 20 ดอลลาร์สำหรับขาออกในปริมาณเดียวกัน แต่ยังไม่มีวันสิ้นสุดช่วงแนะนำที่ระบุเป็นปฏิทิน

ตัวเลขเหล่านี้เป็นอัตราต่อหน่วยของช่องทาง API ที่วางแผนเปิดให้ใช้ ไม่ใช่หลักฐานว่าขณะนี้บัญชีธุรกิจทุกบัญชีส่งคำขอไปยัง Argon ได้แล้ว ราคาโทเคนยังไม่ใช่ค่าใช้จ่ายต่อหนึ่งงาน เพราะงานแต่ละชนิดส่งข้อมูลเข้าและสร้างคำตอบยาวต่างกัน งานที่ให้โมเดลวิเคราะห์หลายขั้นตอนอาจใช้โทเคนมากกว่างานถามตอบสั้นอย่างมาก แม้อัตราต่อหน่วยจะเท่ากัน

ส่วนลดแคชใช้กับโทเคนขาเข้าที่เข้าเงื่อนไข จึงไม่ควรนำไปหักจากค่าโทเคนขาออกทั้งหมด ขณะเดียวกัน ราคาหลังช่วงแนะนำไม่ใช่อัตราที่ผู้ใช้ทุกคนต้องจ่ายตั้งแต่วันแรกที่ได้รับสิทธิ์ สิ่งที่ประกาศแล้วช่วยให้เห็นโครงสร้างราคาในอนาคต แต่การคำนวณต้นทุนจริงของระบบในไทยยังต้องมีเงื่อนไขการเข้าถึง ช่องทางเรียกใช้ และรายละเอียดการคิดค่าบริการเมื่อเปิดให้ใช้

งานโค้ดและไซเบอร์ที่ถูกยกเป็นจุดแข็ง

ความสามารถด้านโค้ดที่เปิดเผยครอบคลุมตั้งแต่การแก้บั๊กประจำวันไปจนถึงการย้ายฐานโค้ดขนาดใหญ่ ตัวอย่างภายใน Google มีทั้งงานแปลงโค้ด C/C++ เป็น Rust และงานปรับปรุง libgav1 ซึ่งเป็นซอฟต์แวร์ถอดรหัสวิดีโอ ตัวอย่างเหล่านี้ทำให้เห็นชนิดงานที่โมเดลถูกนำไปใช้ มากกว่าคำกล่าวกว้าง ๆ ว่าเขียนโค้ดได้ดี แต่ยังเป็นผลภายในสภาพแวดล้อมการพัฒนาของบริษัท

กรณี libgav1 มีรายละเอียดสำคัญ: เอเจนต์ที่ใช้ Argon ปรับโค้ด SIMD ประมาณ 32,000 บรรทัดในพอร์ต Rust ที่มีอยู่แล้ว และผลลัพธ์ทำงานเร็วขึ้น 2.7 เท่าเมื่อเทียบกับพอร์ต Rust เดิม ตัวเปรียบเทียบจึงเป็นพอร์ต Rust รุ่นก่อน ไม่ใช่ข้ออ้างว่าเร็วกว่าซอฟต์แวร์ C++ ทุกแบบ ส่วนโครงการย้ายฐานโค้ดอื่นยังต้องผ่านการตรวจสอบอัตโนมัติ การจำลองการทำงาน และการทบทวนโดยมนุษย์ก่อนเข้าสู่ระบบผลิตจริง

ขั้นตรวจทานนั้นสำคัญต่อการอ่านตัวอย่างภายใน โมเดลอาจสร้างหรือแก้โค้ดได้ แต่ผลที่นำไปใช้งานได้เกิดจากกระบวนการที่มีเครื่องมือทดสอบและผู้รับผิดชอบร่วมอยู่ด้วย จึงไม่สามารถนำผลของโครงการหนึ่งไปแปลงเป็นอัตราความสำเร็จของผู้ใช้ API ทั่วไปได้โดยตรง โดยเฉพาะงานย้ายโค้ดที่ต้องรักษาพฤติกรรมเดิมของระบบพร้อมจัดการความปลอดภัยและประสิทธิภาพ

ด้านไซเบอร์ กรณีที่เปิดเผยคือ Wiz ใช้ Argon ผ่านโครงการ Scan for Good เพื่อค้นหาและแก้ความเสี่ยงในโครงสร้างพื้นฐานสาธารณะ คำอธิบายกรณีนี้ระบุว่ามีการพบช่องโหว่ร้ายแรงในซอฟต์แวร์ด้านสาธารณสุขที่โรงพยาบาลหลายแห่งใช้ โดยเป็นกรณีใช้งานที่ผู้พัฒนายกขึ้นมาเอง ความสำเร็จในกรณีดังกล่าวจึงมีขอบเขตชัดเจน: เป็นเหตุการณ์เฉพาะ ไม่ใช่ผลประเมินอิสระว่าระบบทุกแห่งจะพบช่องโหว่ลักษณะเดียวกัน

ผู้พัฒนาระบุด้วยว่า Argon สามารถช่วยค้นหา ยืนยัน และเสนอแพตช์สำหรับช่องโหว่ได้ งานทั้งสามขั้นไม่เหมือนกัน การพบสัญญาณผิดปกติยังต้องแยกจากการยืนยันว่ามีช่องโหว่จริง และแพตช์ที่เสนอจำเป็นต้องผ่านการตรวจผลกระทบก่อนใช้กับระบบที่ทำงานอยู่ การให้สิทธิ์กับผู้ป้องกันภัยที่คัดเลือกก่อนจึงสอดคล้องกับลักษณะงานที่อาจกระทบซอฟต์แวร์และข้อมูลจริง

มาตรการก่อนขยายบริการครอบคลุมการป้องกันการใช้โมเดลในทางที่ผิด การรับมือคำสั่งแทรกในข้อมูลที่โมเดลอ่าน และการติดตามพฤติกรรมของเอเจนต์ขณะทำงาน บริษัทระบุว่ามีการทดสอบโดยทีมภายในและภายนอก รวมถึงการแยกสภาพแวดล้อมสำหรับงานเสี่ยงสูง แต่การมีมาตรการเหล่านี้ไม่ได้กำหนดวันเปิดใช้งานให้ผู้บริโภค การเปิดสิทธิ์กว้างขึ้นยังขึ้นกับผลตอบรับและการปรับระบบหลังช่วงทดสอบแรก

ผลวัดอิสระแข็งแรงบางงาน อ่อนกว่าบางงาน

ตารางผลประเมินของ Vals AI ให้ Argon ได้ 68.90% และอันดับ 1 จาก 44 โมเดลใน Vals Index; งาน Code Migration ได้ 68.17% อันดับ 2 จาก 74 และ CyberBench v1.1 ได้ 77.86% อันดับ 2 จาก 44 ขณะที่ CUA-bench ได้ 4.83% อันดับ 7 จาก 8 และ MedScribe ได้ 87.43% อันดับ 15 จาก 107 ผลบนหน้าเดียวกันจึงแสดงทั้งความแข็งแรงด้านย้ายโค้ดและไซเบอร์ และอันดับที่ไม่เด่นเท่ากันในงานควบคุมคอมพิวเตอร์กับงานบันทึกข้อมูลทางการแพทย์

จำนวนโมเดลในตารางปัจจุบันต่างจากข้อความอัปเดตเดิมบนหน้าเดียวกัน ซึ่งยังระบุจำนวนผู้เข้าแข่งขันน้อยกว่า ตัวเลขอันดับข้างต้นอ้างตามตารางปัจจุบันเพื่อให้คะแนนและตัวหารมาจากภาพเดียวกัน ความต่างนี้ไม่ได้แปลว่าคะแนนความแม่นยำของ Argon เปลี่ยนตามทุกครั้งที่มีโมเดลใหม่เข้าตาราง แต่อันดับและจำนวนคู่แข่งเป็นข้อมูลที่อาจขยับเมื่อฐานเปรียบเทียบเพิ่มขึ้น

Vals Index รวบรวมงานหลายประเภท ไม่ได้วัดเพียงการเขียนโค้ดหรือการป้องกันภัยไซเบอร์ การได้อันดับสูงในดัชนีรวมจึงไม่ใช่คำตอบว่าทุกงานเฉพาะทางจะนำหน้าคู่แข่ง เช่นเดียวกับคะแนน CyberBench ที่วัดโจทย์ภายในชุดทดสอบ ไม่ได้รวมขั้นอนุมัติแพตช์ การตรวจผลข้างเคียง หรือข้อจำกัดการเข้าถึงระบบขององค์กรจริง การอ่านคะแนนตามชื่อชุดทดสอบช่วยรักษาขอบเขตของข้อสรุปได้ตรงกว่าอ่านเป็นคะแนนความสามารถทั่วไป

การตั้งค่าที่ Vals แสดงสำหรับการประเมินใช้ระดับการให้เหตุผลแบบสูง อุณหภูมิ 1 และเพดานเอาต์พุต 262,144 โทเคน โดยเตือนว่าบางชุดทดสอบอาจใช้ผู้ให้บริการหรือพารามิเตอร์ต่างกัน เงื่อนไขเหล่านี้เป็นส่วนของผลที่วัดได้ ผลจากการตั้งค่าอื่นหรือจากการใช้เครื่องมือประกอบอาจเปลี่ยนไปได้ จึงไม่ควรนำคะแนนไปอ้างว่าเป็นผลรับประกันของทุกบัญชีเมื่อเปิด API

ค่าใช้จ่ายต่อหนึ่งการทดสอบใน Vals Index ที่แสดงคือ 15.68 ดอลลาร์ และสูงกว่านั้นในงานเอเจนต์บางชุด ตัวเลขนี้เป็นต้นทุนภายใต้วิธีประเมินของ Vals ไม่ใช่ใบเสนอราคาสำหรับงานของลูกค้าแต่ละราย อีกทั้งหน้าประเมินแสดงราคาโทเคนที่อัตราหลังช่วงแนะนำ ขณะที่ประกาศเปิดตัวระบุอัตราช่วงแนะนำต่ำกว่า ความต่างเกิดจากการกล่าวถึงคนละช่วงราคา จึงไม่ควรเลือกเพียงตัวเลขจากหน้าใดหน้าหนึ่งไปใช้เป็นราคาปัจจุบันของบัญชีไทยที่ยังไม่มีสิทธิ์เข้าถึง

สถานะที่เปิดเผย ผลที่วัดได้ และข้อมูลที่ยังรอ

ข้อมูลทั้งสามประเภทตอบคนละคำถาม การวางไว้ข้างกันทำให้เห็นชัดว่าเหตุใดคะแนนทดสอบและราคา API จึงยังตอบคำถามเรื่องวันเริ่มใช้ในไทยไม่ได้

  • สิ่งที่เปิดเผยแล้ว: โมเดลได้รับการประกาศและเริ่มทยอยให้ผู้ป้องกันภัยไซเบอร์ที่คัดเลือกผ่าน Fairwind Program ใช้ มีอัตรา API สำหรับช่วงแนะนำและหลังช่วงแนะนำ พร้อมระบุกลุ่มลูกค้าที่ตั้งใจขยายสิทธิ์ให้ก่อน
  • สิ่งที่มีผลวัดอิสระ: Argon อยู่แถวหน้าของดัชนีรวม งานย้ายโค้ด และงานไซเบอร์บางชุดของ Vals AI ขณะที่ผลใน CUA-bench และ MedScribe อยู่ต่ำกว่าอันดับเด่นของโมเดลเดียวกัน การจัดอันดับเหล่านี้เป็นผลตามโจทย์และการตั้งค่าของผู้ประเมิน
  • สิ่งที่ยังไม่ทราบ: วันเปิด API และแอปให้กลุ่มผู้ใช้ถัดไป วันเริ่มสิทธิ์ของสมาชิก Google AI Ultra ในไทย ขอบเขตประเทศที่รองรับ และวันสิ้นสุดช่วงราคาแนะนำ ยังไม่มีรายละเอียดที่ประกาศเป็นกำหนดการ

สำหรับผู้ใช้และธุรกิจไทย เหตุการณ์ถัดไปที่เปลี่ยนสถานะได้จริงคือประกาศเปิดสิทธิ์ในช่องทาง API หรือ Google AI Ultra พร้อมรายละเอียดประเทศและบัญชีที่รองรับ เมื่อนั้นจึงจะระบุวันเริ่มใช้และค่าใช้จ่ายที่เกี่ยวข้องกับการใช้งานจริงได้ โดยไม่ต้องตีความจากวันเปิดตัวหรืออันดับทดสอบแทนข้อมูลการให้บริการ

อ่านเพิ่มเติม:

แชร์:

สมัครรับจดหมายข่าวของเรา

รับข่าวสารล่าสุดเกี่ยวกับ Web3, AI และคริปโตส่งตรงถึงกล่องจดหมายของคุณ

0