Z.ai เรียก GLM-5.3 ว่าเป็น "โมเดล coding โอเพนซอร์สที่มีความสามารถสูงที่สุด" แต่พอเปิดตารางคะแนนทดสอบที่บริษัทโพสต์เอง เรื่องราวกลับไม่ราบรื่นขนาดนั้น ในการทดสอบ Terminal Bench 3.0 GLM-5.3 ทำได้ 28.3 คะแนน แพ้ให้กับ Claude Fable 5 (33.7) และ GPT-5.6 Sol (34.6) ซึ่งเป็นโมเดลปิด ส่วนในการทดสอบ DeepSWE v1.1 ที่จำลองการแก้ไข GitHub issue จริง คะแนน 66.9 ของมันก็สู้ Kimi K3 คู่แข่งโอเพนซอร์สที่ทำได้ 67.5 และ Fable 5 ที่ทำได้ 69.7 ไม่ได้ เอกสารทางการที่ตั้งใจจะพิสูจน์ว่าตัวเองแข็งแกร่งที่สุด กลับเขียนไว้ชัดเจนว่า "ไม่ใช่ที่สุด"
GLM-5.3 เปิดให้ใช้งานตั้งแต่วันพฤหัสบดีผ่านการสมัครสมาชิก GLM Coding Plan และ ZCode ส่วน API และไฟล์น้ำหนักที่ดาวน์โหลดได้จะต้องรอผ่านการตรวจสอบความปลอดภัยก่อนแล้วจึงทยอยปล่อยออกมา โมเดลนี้มีพารามิเตอร์ 7.43 หมื่นล้านตัว สร้างขึ้นจากฐานของ GLM-5.2 โดยขยายปริมาณการเทรน post-training ต่อเนื่อง — Z.ai ระบุในโพสต์เปิดตัวว่า "Scaling post-training is all we did for GLM-5.3" โดยในช่วงเดือนที่ผ่านมาได้เพิ่ม environment มากขึ้น งานที่หลากหลายขึ้น และพลังประมวลผลมากขึ้น
จุดเน้นของครั้งนี้ไม่ใช่การดันคะแนนให้สูงขึ้น แต่เป็นการประหยัด token ในการทดสอบ Code Bench ของ Z.ai เอง GLM-5.3 ในโหมด Max effort ทำได้ 34.5% โดยใช้ output token เฉลี่ยราว 75,000 โทเคนต่องาน ขณะที่ GLM-5.2 ทำได้ 23.4% แต่ต้องใช้ถึง 96,000 โทเคน พูดง่ายๆ คือโมเดลใหม่คะแนนสูงขึ้นแต่กินทรัพยากรน้อยลง เมื่อเทียบกับ Claude Opus 4.8 Z.ai บอกว่า GLM-5.3 มีความคุ้มค่าด้าน token ที่ดีกว่า แต่ก็ยอมรับเช่นกันว่า "remains behind Claude Fable 5, which reaches 39.5% at Max effort" — ประโยคนี้เขียนไว้เองในบล็อก
จุดเด่นที่แท้จริงอยู่ที่การทดสอบด้านความปลอดภัยไซเบอร์ GLM-5.3 ทำคะแนนได้ 84.5% ใน CyberGym ซึ่งเป็นคะแนนมากกว่าสองเท่าของ GLM-5.2 ในกลุ่มการทดสอบด้านการค้นหาช่องโหว่ Z.ai ระบุว่าโมเดลนี้ตรวจพบช่องโหว่ 2,436 รายการใน 269 โปรเจกต์โอเพนซอร์ส โดย 1,097 รายการถูกจัดว่ามีความเสี่ยงระดับกลางถึงสูง นี่คือส่วนน้อยของการเปิดตัวครั้งนี้ที่ไม่ได้ถูกข้อมูลของตัวเองทำลายความน่าเชื่อถือ
ราคาคือจุดที่โมเดลโอเพนซอร์สยังพอสู้ได้ ราคา API ทางการของ GLM-5.2 อยู่ที่ 1.40 ดอลลาร์สหรัฐต่อล้านโทเคนสำหรับ input และ 4.40 ดอลลาร์สำหรับ output โดย Z.ai ระบุว่าราคา API โดยรวมอยู่ที่ประมาณหนึ่งในสิบของโมเดลชั้นนำของสหรัฐฯ เมื่อเทียบกันแล้ว GPT-5.3-Codex คิดราคา 1.75 ดอลลาร์สำหรับ input และ 14 ดอลลาร์สำหรับ output ส่วน Claude Opus 4.8 มีราคาอยู่ในระดับสูงสุดของตารางราคา Anthropic ขณะที่ GLM Coding Plan เองใช้ระบบโควตาแต้ม และมีส่วนลดครึ่งราคาในช่วงเวลานอกพีค
ป้าย "open-weights" ตอนนี้ยังไม่เป็นจริงตามที่กล่าวอ้าง โพสต์เปิดตัวเขียนไว้ชัดเจนว่าน้ำหนักโมเดลจะเปิดให้ใช้งานสาธารณะในอีกประมาณสองสัปดาห์ข้างหน้า สิ่งที่ใช้ได้ตอนนี้คือระบบสมัครสมาชิก GLM Coding Plan และ ZCode ไม่ใช่ไฟล์ที่ดาวน์โหลดมารันเองได้ Z.ai เป็นห้องแล็บจากปักกิ่งที่ถูกขึ้นบัญชี Entity List ของสหรัฐฯ ทำให้บริษัทอเมริกันไม่สามารถส่งออกเทคโนโลยีที่ถูกควบคุมให้ได้ — แม้จะเป็นเช่นนั้น การใช้งาน token ของโมเดลโอเพนซอร์สจากจีนบน OpenRouter ก็แซงหน้าโมเดลประเภทเดียวกันจากสหรัฐฯ ไปแล้ว และตระกูล GLM เองก็ได้รับความนิยมค่อนข้างมาก
สรุปประกาศที่แฉจุดอ่อนตัวเองฉบับนี้: GLM-5.3 เอาชนะรุ่นก่อนหน้าของตัวเองได้ และยังเหนือกว่าคู่แข่งโอเพนซอร์สบางตัวด้วย แต่บนบอร์ดจัดอันดับ coding ที่จับตามองที่สุด โมเดลแนวหน้าแบบปิดจากสหรัฐฯ ก็ยังยืนอยู่แถวหน้าเหนือกว่า ส่วนคำว่า "โอเพนซอร์ส" ที่มันภาคภูมิใจนักหนา ตอนนี้ก็ยังเป็นแค่เช็คเปล่าที่รอวันขึ้นเงิน






