Industry

NYT: AI Safety Controls ไม่ได้ผล! นักวิจัยใช้ภาษากวีเล่นงาน 31 ระบบ AI ให้ละเว้นกฎป้องกัน

2026-06-03 · ~1 นาที · Industry

งานวิจัยล่าสุดจาก New York Times พบว่า AI safety controls ไม่มีประสิทธิภาพมากนัก นักวิจัยสามารถใช้ poetic language หรือภาษาที่มีความงดงามแต่ซับซ้อนในการหลอกล่อ AI systems ให้ละเว้น internal safety controls

ผลการวิจัย:

นักวิจัยทดลองกับ 31 ระบบ AI ส่วนใหญ่สามารถถูกหลอกได้เมื่อใช้ภาษาที่มีความซับซ้อนและงดงาม ระบบป้องกันปัจจุบันไม่สามารถตรวจจับการหลอกล่อที่ใช้ภาษาที่ซับซ้อนได้ การวิจัยนี้ทำให้เกิดคำถามเกี่ยวกับความน่าเชื่อถือของ AI safety mechanisms ในปัจจุบัน

ตัวอย่างการหลอกล่อ:

นักวิจัยใช้ภาษาที่มีความงดงามแต่ซับซ้อนเพื่อทำให้ AI ละเว้นกฎป้องกัน โดยเฉพาะการใช้คำศัพท์ทางกวีและสัญลักษณ์ที่ทำให้ระบบป้องกันไม่สามารถตรวจจับได้

ความสำคัญ:

การวิจัยนี้แสดงให้เห็นว่า AI safety controls ปัจจุบันยังไม่แข็งแรงพอ และต้องมีการพัฒนาวิธีการป้องกันใหม่ที่สามารถตรวจจับการหลอกล่อที่ใช้ภาษาที่ซับซ้อนได้

What's next:

คาดว่าจะมีการวิจัยเพิ่มเติมเกี่ยวกับวิธีการป้องกัน AI ที่แข็งแรงขึ้น และบริษัท AI ต้องพัฒนากลไกการป้องกันที่สามารถตรวจจับการหลอกล่อจากภาษาที่ซับซ้อนได้ Source: New York Times อ่านต้นฉบับ: https://www.nytimes.com/2026/05/14/technology/artificial-intelligence-safety-controls.html

📌 Source: https://www.nytimes.com/2026/05/14/technology/artificial-intelligence-safety-con...