ขอเริ่มจากรายละเอียดที่มักถูกมองข้ามก่อน: โหมดเสียงของ Claude เป็นแบบ "ผลัดกันพูด" คือคุณพูดจบประโยคหนึ่งแล้ว มันถึงจะเริ่มคิดว่าจะตอบยังไง ซึ่งต่างจากที่ OpenAI เพิ่งอัปเกรด ChatGPT ให้เป็นสถาปัตยกรรมแบบ "duplex" โดยสิ้นเชิง — ตระกูล GPT-Live สามารถฟังคุณพูดไปพร้อมๆ กับสร้างคำตอบไปด้วยในเวลาเดียวกัน เหมือนการสนทนาของมนุษย์จริงๆ ที่แย่งพูด แทรกพูดได้หมด แต่ Claude ทำแบบนั้นไม่ได้ มันจะรอให้คุณหยุดพูดก่อน แล้วค่อยตอบสนอง ทาง Anthropic เองก็ยอมรับข้อจำกัดนี้ และแนะนำว่าถ้าผู้ใช้ต้องการถามหลายคำถาม ควรถามทีละคำถาม อย่าใส่สามคำถามรวมในลมหายใจเดียว เพราะระบบมักจะเข้าใจผิดว่าจังหวะหยุดพักหายใจคือการพูดจบประโยคแล้ว
ความแตกต่างด้านสถาปัตยกรรมนี้เอง ที่เป็นตัวกำหนดว่าโหมดเสียงของ Claude ควรใช้งานอย่างไรจึงจะลื่นไหล
วิธีเปิดใช้งานและการเลือกโมเดล
โหมดเสียงมีมาตั้งแต่ปี 2025 แต่ในเดือนกรกฎาคมปีนี้ Anthropic ได้ทำการอัปเกรดครั้งใหญ่: แต่ก่อนโหมดเสียงใช้งานได้แค่ผ่านโมเดล Haiku ที่ตอบสนองเร็วที่สุดแต่ความสามารถน้อยที่สุด เพื่อลดความหน่วง ตอนนี้โมเดลที่แข็งแกร่งกว่าอย่าง Sonnet และ Opus ก็สามารถใช้สนทนาด้วยเสียงได้แล้ว แถมยังดึงเนื้อหาจากแอปที่คุณเชื่อมต่อไว้มาใช้เป็นบริบทได้โดยตรง วิธีใช้งานคือ เปิดแอปในมือถือ (ใช้ได้ทั้ง iOS และ Android โดย Anthropic บอกว่าประสบการณ์บนมือถือดีที่สุด) แตะไอคอนคลื่นเสียงสีดำที่มุมขวาล่าง — ไม่ใช่ไอคอนไมโครโฟนที่อยู่ข้างๆ — จากนั้นอนุญาตสิทธิ์ไมโครโฟนก็เริ่มพูดได้เลย พูดจบ Claude จะสร้างคำตอบให้อัตโนมัติ กดปุ่ม Stop อีกครั้งถึงจะออกจากโหมดเสียง ส่วนโมเดลสามารถสลับได้จากตัวเลือกด้านล่างของหน้าจอ: Haiku เน้นความเร็ว, Sonnet ตอบโจทย์งานประจำวันได้อย่างสบายๆ, Opus เก็บไว้สำหรับงานที่ซับซ้อนแต่ใช้ได้เฉพาะบัญชีแบบเสียเงินเท่านั้น










