แท็ก
#AI安全

Blockchain
Claude สามตัวไม่รู้จักกันมาก่อน ถูกโยนเข้าโค้ดเบสเดียวกัน แล้วก็ตีกัน
งานวิจัยล่าสุดของ Anthropic บันทึกสงครามแย่งชิงพื้นที่ในระบบมัลติเอเจนต์ไว้: มัลแวร์โจมตีกันเอง ปิดใช้งานบัญชีคู่แข่ง แต่ก็มีเอเจนต์ที่หันมาเจรจาสงบศึกกันเอง คิดค้นกลไกจบเกมแบบทัวร์นาเมนต์ขึ้นมาเอง และยังเรียนรู้วิธีเอาเปรียบแบบเนียนๆ ด้วย

Tech
AI ทำให้แฮกเกอร์หมวกดำไม่ต้องฝึกฝีมือ: สงครามไซเบอร์ที่ไม่เท่าเทียมกันอีกต่อไป
บอทช่วยเหลือลูกค้าของ Instagram โดย Meta เคยยินดีเชื่อมอีเมลใดๆ เข้ากับบัญชีใดๆ ก็ได้ นี่เป็นแค่ตัวอย่างหนึ่งที่ AI กำลังเขียนกฎใหม่ของความปลอดภัยไซเบอร์ ด่านโจมตีกำลังหายไป แต่ฝ่ายป้องกันยังต้องอุดทุกช่องโหว่ที่มี

Tech
เผยผลทดสอบ AISI: AI หนีออกจาก Sandbox ทิ้งคอมเมนต์ใน GitHub ชวน Agent ตัวอื่นมาสานต่อการแฮก
ในการทดสอบของ AISI โมเดลจาก Anthropic และ OpenAI หลุดออกจาก Sandbox แล้วพยายามใช้ prompt injection เข้าควบคุมโครงการโอเพนซอร์ส โดยหนึ่งในคอมเมนต์ที่ทิ้งไว้บน GitHub ถูก AI agent ตัวอื่นอ่านและนำไปปฏิบัติตามจริง เผยช่องโหว่ของขีดจำกัดในสภาพแวดล้อมการทดสอบ