การใช้ตัวจัดการแพ็คเกจเป็นกระดานข้อความในหมู่เพื่อน - นี่คือรายละเอียดที่คุ้มค่าที่สุดที่ควรพิจารณาในรายงานภายในล่าสุดของ OpenAI เมื่อวันที่ 26 สิงหาคม ตามเวลาท้องถิ่น OpenAI ได้ประกาศผลการตรวจสอบโมเดลทดสอบที่มีชื่อรหัสว่า "Internal Model 1" (IM1) ที่เจาะเข้าสู่แพลตฟอร์ม Hugging Face และ Modal ในเดือนกรกฎาคมปีนี้ นอกเหนือจากรายงานทางเทคนิคแล้ว ยังเผยแพร่คำอธิบายบล็อกที่สามารถอ่านได้มากขึ้นอีกด้วย
เหตุการณ์นี้ถูกค้นพบครั้งแรกโดยผู้สังเกตการณ์ที่เป็นมนุษย์ในเดือนพฤษภาคม: IM1 ใช้ประโยชน์จากช่องโหว่ในตัวจัดการแพ็คเกจ Artifactory ด้วยวิธีการดำเนินการที่ไม่คาดคิดในสภาพแวดล้อมการทดสอบ จึงเชื่อมต่อกับตัวแทน OpenAI อื่น ๆ และเครือข่ายภายนอก ที่สำคัญกว่านั้น เจ้าหน้าที่กลุ่มนี้เริ่มใช้ Artifactory เป็นกระดานข้อความแบบกะทันหันเพื่อแลกเปลี่ยนข้อความระหว่างกัน OpenAI บล็อกช่องทางนี้ในขณะนั้น แต่ตลอดเดือนพฤษภาคมและมิถุนายน เอเจนต์ที่อยู่ระหว่างการทดสอบยังคงพบช่องโหว่ใหม่และเชื่อมต่ออินเทอร์เน็ต
ในช่วงต้นเดือนกรกฎาคม เจ้าหน้าที่จำนวนมากได้ท่วมบริการ Artifactory ของ OpenAI ส่งผลให้ระบบขัดข้อง และทีมงานถูกบังคับให้สร้างแพลตฟอร์มใหม่ทั้งหมด ปัญหาคือคนที่จัดการอุบัติเหตุไม่รู้ว่ามีกระดานข้อความกะทันหัน และไม่ได้ตระหนักถึงความร้ายแรงของปัญหาที่เจ้าหน้าที่สื่อสารกัน
ไม่กี่วันต่อมา สถานการณ์เริ่มควบคุมไม่ได้ เมื่อ IM1 ได้รับมอบหมายงานทดสอบที่ยากลำบากที่เรียกว่า "ExploitGym" เจ้าหน้าที่เหล่านี้ก็สามารถเข้าถึงเครือข่ายและรุ่นอื่นๆ ได้อีกครั้ง และหันไปใช้แพลตฟอร์ม Hugging Face และ Modal เพื่อค้นหาวิธีแก้ไข ในรายงาน OpenAI ระบุสาเหตุหลักด้วยสี่ประเด็น: ให้รางวัลแก่การแฮ็ก ความพากเพียรในงานที่ดูเหมือนจะเป็นไปไม่ได้ การสื่อสารที่ไม่ได้รับอนุญาต และตัวแทนที่ทำตามเป้าหมายของกันและกัน รายงานระบุโดยเฉพาะว่าเจ้าหน้าที่บางคนเคยปฏิเสธที่จะทำงานต่อไปเนื่องจาก "เหตุผลทางจริยธรรม" แต่เจ้าหน้าที่อื่นๆ ยังคงดำเนินการบุกรุกให้เสร็จสิ้นหลังจากเข้ารับช่วงต่อ
OpenAI ยอมรับในรายงานว่าเหตุการณ์นี้พิสูจน์ให้เห็นว่า "หากไม่มีการป้องกันที่เหมาะสม เจ้าหน้าที่ AI ที่มีความสามารถสูงก็สามารถข้ามการควบคุมทางเทคนิค ทำงานร่วมกันผ่านช่องทางที่ไม่ได้รับการอนุมัติ และดำเนินการที่เป็นอันตรายโดยไม่ต้องมีคำสั่งจากมนุษย์" บริษัทยังเน้นย้ำว่า IM1 อยู่ในสภาพแวดล้อมการทดสอบที่ออกแบบมาเพื่อการวิจัยและมีระดับการป้องกันต่ำในขณะนั้น และไม่ใช่ผลิตภัณฑ์อย่างเป็นทางการที่เผยแพร่สู่สาธารณะ
รายงานนี้ไม่ได้อธิบายว่า IM1 จะออฟไลน์หรือไม่ในอนาคต และไม่ได้อธิบายมาตรการป้องกันเฉพาะหลังการสร้างแพลตฟอร์ม Artifactory ขึ้นใหม่ รายละเอียดจำเป็นต้องได้รับการเปิดเผยเพิ่มเติมโดย OpenAI