งานวิจัยล่าสุดจาก New York Times พบว่า AI safety controls ไม่มีประสิทธิภาพมากนัก นักวิจัยสามารถใช้ poetic language หรือภาษาที่มีความงดงามแต่ซับซ้อนในการหลอกล่อ AI systems ให้ละเว้น internal safety controls
ผลการวิจัย:
นักวิจัยทดลองกับ 31 ระบบ AI ส่วนใหญ่สามารถถูกหลอกได้เมื่อใช้ภาษาที่มีความซับซ้อนและงดงาม ระบบป้องกันปัจจุบันไม่สามารถตรวจจับการหลอกล่อที่ใช้ภาษาที่ซับซ้อนได้ การวิจัยนี้ทำให้เกิดคำถามเกี่ยวกับความน่าเชื่อถือของ AI safety mechanisms ในปัจจุบัน
ตัวอย่างการหลอกล่อ:
นักวิจัยใช้ภาษาที่มีความงดงามแต่ซับซ้อนเพื่อทำให้ AI ละเว้นกฎป้องกัน โดยเฉพาะการใช้คำศัพท์ทางกวีและสัญลักษณ์ที่ทำให้ระบบป้องกันไม่สามารถตรวจจับได้
ความสำคัญ:
การวิจัยนี้แสดงให้เห็นว่า AI safety controls ปัจจุบันยังไม่แข็งแรงพอ และต้องมีการพัฒนาวิธีการป้องกันใหม่ที่สามารถตรวจจับการหลอกล่อที่ใช้ภาษาที่ซับซ้อนได้
What's next:
คาดว่าจะมีการวิจัยเพิ่มเติมเกี่ยวกับวิธีการป้องกัน AI ที่แข็งแรงขึ้น และบริษัท AI ต้องพัฒนากลไกการป้องกันที่สามารถตรวจจับการหลอกล่อจากภาษาที่ซับซ้อนได้ Source: New York Times อ่านต้นฉบับ: https://www.nytimes.com/2026/05/14/technology/artificial-intelligence-safety-controls.html