มาดูตัวเลขที่ดูขัดแย้งกันชุดหนึ่งก่อน โมเดลเรือธงล่าสุดของ ChatGPT คือ GPT 5.6 Sol (Max) มีอัตราการพูดมั่ว (Hallucination Rate) ในเบนช์มาร์ก AA-Omniscience อยู่ที่ 89% ซึ่งสูงกว่ารุ่นก่อนหน้า GPT-4o ที่อยู่ที่ 38% อย่างมาก แต่ในเบนช์มาร์กเดียวกันนี้ ความแม่นยำด้านความรู้ของ GPT 5.6 Sol กลับดีขึ้นกว่ารุ่นก่อน นั่นหมายความว่าโมเดลตัวนี้ “รู้มากขึ้น” แต่เมื่อเจอคำถามที่ไม่รู้คำตอบ โอกาสที่มันจะเลือกแต่งคำตอบขึ้นมาเองแทนการยอมรับว่าไม่รู้ก็สูงขึ้นตามไปด้วย
ฝั่งตรงข้ามคือ Claude Fable 5 (Max) ของ Anthropic ที่มีอัตราการพูดมั่วอยู่ที่ 55% ความแม่นยำ 61% ซึ่งดีกว่า GPT 5.6 Sol ที่อยู่ที่ 59% ทั้งสองด้าน ความแตกต่างยิ่งชัดเจนขึ้นในกลุ่มโมเดลระดับกลาง โดย Claude Sonnet 5 มีความแม่นยำ 38% อัตราพูดมั่ว 37% ในขณะที่ ChatGPT 5.6 Terra แม้ความแม่นยำจะนำอยู่ที่ 46% แต่อัตราพูดมั่วพุ่งสูงถึง 85% พูดง่ายๆ คือทั้งสองบริษัทตอบถูก “มากขึ้น” ในระดับพอๆ กัน แต่พอเจอคำถามที่ไม่รู้ โมเดลตระกูล ChatGPT มีแนวโน้มจะมั่วคำตอบมากกว่าเห็นได้ชัด
ด้านฟีเจอร์ก็แบ่งบทบาทกันชัดเจน Cowork ที่ Claude เปิดตัวเมื่อเดือนมกราคมที่ผ่านมา ทำหน้าที่จัดการงานที่ต้องใช้ความรู้แทนผู้ใช้ เช่น จัดระเบียบไฟล์ ผู้ใช้สามารถสร้างชุดคำสั่งที่เรียกว่า skills แล้วเรียกใช้ในบทสนทนาได้ทันทีด้วยการพิมพ์ “/” โดย skills นี้ใช้ข้ามได้ทั้งใน Claude แชท, Cowork และ Claude Code ส่วน Claude Artifacts สามารถเรนเดอร์โค้ด, เว็บไซต์ HTML หน้าเดียว, คอมโพเนนต์ React และกราฟได้แบบทันที ผลงานที่ทำออกมาสามารถเผยแพร่แชร์ได้เลย และยังดึงข้อมูลแบบเรียลไทม์ผ่านตัวเชื่อมต่อ Model Context Protocol ได้ด้วย ในขณะที่ ChatGPT ก็มี skills เหมือนกัน แต่จำกัดให้ใช้ได้เฉพาะใน Codex และบัญชีส่วนตัวใน API เท่านั้น ใช้ในหน้าต่างแชททั่วไปไม่ได้ ส่วนฟีเจอร์ที่เทียบเท่า Artifacts เรียกว่า Sites ซึ่งเน้นการใช้งานภายในองค์กร และเปิดให้ใช้ได้เฉพาะใน Codex เช่นกัน แถมยังดึงข้อมูลเรียลไทม์ไม่ได้ด้วย
ในทางกลับกัน ChatGPT มีประสบการณ์ด้านเสียงที่พัฒนาไปไกลกว่าอย่างชัดเจน เสียงพูดฟังเป็นธรรมชาติ สามารถแทรกพูดคั่นกลางได้โดยที่มันไม่หลุดลืมบทสนทนาก่อนหน้า ควบคู่กับฟีเจอร์ภาพเรียลไทม์ใน Advanced Voice Mode ที่หันกล้องไปถามเรื่องตรงหน้าได้ทันที ด้านการสร้างภาพก็เป็นจุดแข็งของ ChatGPT เช่นกัน สามารถสร้างภาพที่ใกล้เคียงภาพถ่ายจริงได้ ในขณะที่ Claude ทำได้แค่วาดกราฟและไอคอนผ่าน HTML กับ SVG เท่านั้น








