วันเดียวกัน ทั้งสองบริษัทต่างพูดเรื่องเดียวกัน: โมเดลเร็วพอแล้ว ความต่างคือ ของ Google อยู่ในมือคุณแล้ว ส่วนของ OpenAI ยังล็อกอยู่หลังลิสต์รายชื่อ
Google เปิดตัว Gemini 3.7 Flash เมื่อวันพฤหัสบดี เจาะกลุ่มงานเขียนโค้ดและระบบอัตโนมัติ เปิดให้ใช้งานทั่วโลกทันที ปัจจุบันเปิดใช้แล้วในกว่า 160 ประเทศ โมเดลนี้รองรับอินพุตสูงสุด 1 ล้านโทเคน (ประมาณ 750,000 คำ) เอาต์พุตสูงสุด 64,000 โทเคน รองรับทั้งข้อความ ภาพ วิดีโอ เสียง และ PDF พร้อมความสามารถเรียกใช้เครื่องมือและควบคุมอินเทอร์เฟซคอมพิวเตอร์ได้ ในการทดสอบจริง มันทำแบบทดสอบเขียนโค้ดภายในชุดเดียวกันเสร็จภายใน 2 นาที 13 วินาที ขณะที่ Flash รุ่นก่อนใช้เวลากว่า 5 นาที ความต่างของความเร็วเห็นได้ชัดด้วยตาเปล่า ข้อมูลการทดสอบของ Google เองระบุว่า Gemini 3.7 Flash นำหน้าคู่แข่งอย่าง Claude Sonnet 5 และ GPT-5.6 Terra ใน 11 จาก 18 การทดสอบ ทำคะแนน 1,588 Elo ในหมวดพัฒนาเว็บของ Code Arena และได้ 30.4% ในการทดสอบระบบอัตโนมัติสำหรับองค์กร AutomationBench ตัวเลขเหล่านี้คำนวณจากวิธีการของ Google เอง จึงควรพิจารณาระยะห่างที่นำหน้าด้วยความระมัดระวังพอสมควร
ราคาก็ถูกลงครึ่งหนึ่ง: ก่อนสิ้นปีนี้ อยู่ที่ 0.75 ดอลลาร์ต่อล้านโทเคนอินพุต และ 3.75 ดอลลาร์สำหรับเอาต์พุต ซึ่งเป็นครึ่งหนึ่งของราคาปกติของ Flash รุ่นก่อน ราคาพิเศษนี้จะสิ้นสุดวันที่ 31 ธันวาคม หลังจากนั้นจะปรับกลับไปที่ 1.5 ดอลลาร์และ 7.5 ดอลลาร์ แม้จะเป็นเช่นนั้น เมื่อเทียบกับโมเดลอื่นๆ ของ Google ก็ยังถือว่าราคาถูก
ในวันเดียวกัน OpenAI เปิดพรีวิว GPT-5.6 Sol Ultrafast ซึ่งแท้จริงแล้วไม่ใช่โมเดลใหม่ แต่เป็นการนำ GPT-5.6 Sol ที่มีอยู่เดิม ซึ่งผ่านการทดสอบทีมแดงและเสริมความสามารถป้องกันการฉีดพรอมต์ (prompt injection) มาแล้ว ไปรันบนชิปของ Cerebras อีกครั้ง ความเร็วเอาต์พุตสูงสุดพุ่งถึง 750 โทเคนต่อวินาที คิดเป็นประมาณ 560 คำภาษาอังกฤษต่อวินาที เร็วกว่า Sol เวอร์ชันเดิมถึง 14 เท่า ชิประดับเวเฟอร์ของ Cerebras คือกุญแจสำคัญ — ความเร็วระดับนี้ทำให้ผู้ช่วยเสียงสามารถคิดไปพร้อมๆ กับการสนทนาทางโทรศัพท์ได้แบบเรียลไทม์ ปัญหาคือ เวอร์ชันนี้ตอนนี้เปิดให้เฉพาะกลุ่มลูกค้า OpenAI API จำนวนน้อยเท่านั้น เป็นระบบเชิญเข้าใช้ และยังไม่มีการเปิดเผยตัวเลขเปรียบเทียบกับโมเดลอื่นต่อสาธารณะแต่อย่างใด
John Crepezzi วิศวกร AI จาก Jane Street กล่าวในบล็อกเปิดตัวของ OpenAI ว่าความเร็วระดับนี้ "ทำให้โมเดลมีวิธีใช้งานที่แตกต่างไป" ส่วน Courtland Lykins หัวหน้าฝ่ายผลิตภัณฑ์ของ Podium กล่าวว่าสิ่งนี้ "มีค่าอย่างยิ่ง" สำหรับระบบเสียงของพวกเขา และ "เปลี่ยนแปลงประสบการณ์การโทรไปโดยสิ้นเชิง" คำพูดเหล่านี้เป็นคำรับรองจากลูกค้า ไม่ใช่ผลการทดสอบที่เปิดเผยต่อสาธารณะ
จังหวะเวลาของการเปิดตัวก็น่าสนใจไม่แพ้กัน โมเดลเรือธงตัวจริงของ Google อย่าง Gemini 3.5 Pro ยังไม่มีกำหนดวางจำหน่ายจนถึงตอนนี้ ห่างจากการเปิดตัว 3.6 Flash มาแล้วสามสัปดาห์ และเกิดขึ้นเพียงไม่กี่วันหลังจากการปรับโครงสร้างผู้บริหารระดับสูงของ DeepMind — ที่ Demis Hassabis ส่งไม้ต่อให้รองของเขา Koray Kavukcuoglu ฝั่ง OpenAI เลือกใช้พลังประมวลผลที่เช่ามาจาก Cerebras เพื่อเร่งความเร็ว แทนที่จะรอให้โครงสร้างพื้นฐานของตัวเองตามทัน ทั้งสองฝ่ายต่างใช้ "ความเร็ว" เบี่ยงเบนประเด็น แต่มีเพียง Google เท่านั้นที่ส่งของถึงมือนักพัฒนาจริงๆ แล้ว
Gemini 3.7 Flash เปิดให้ใช้งานทั่วโลกแล้วในขณะนี้ ส่วน GPT-5.6 Sol Ultrafast ยังคงเป็นพรีวิวแบบเชิญเข้าใช้เท่านั้น และยังไม่มีกำหนดเปิดตัวต่อสาธารณะ






