
OpenAI ต้องเพิ่มมาตรการความปลอดภัยให้ GPT-6 Astra หลังการทดสอบพบว่าโมเดลมีความสามารถในการค้นหาและใช้ประโยชน์จากช่องโหว่ไซเบอร์ได้สูงกว่ารุ่นก่อน จนเป็นโมเดลแรกที่เข้าเกณฑ์มาตรการป้องกันระดับเข้มงวดของบริษัท
Wall Street Journal รายงานว่า OpenAI ได้ยกเลิกแผนการเปิดตัว GPT-6.1 Astra ในเดือนตุลาคมไปแล้ว เพื่อเพิ่มข้อจำกัดและระบบป้องกันสำหรับ GPT-6 Astra
หลังการทดสอบพบว่าโมเดลนี้สามารถค้นหาช่องโหว่ด้านความปลอดภัยที่ไม่เคยรู้จักมาก่อน รวมถึงพัฒนาแนวทางโจมตีระบบที่มีการป้องกันสูงได้ โดยไม่จำเป็นต้องมีมนุษย์คอยควบคุมทุกขั้นตอน ในบางครั้งก็เลือกใช้เครื่องมือหรือบริการภายนอกแม้ว่าการกระทำนั้นอาจไม่ปลอดภัยก็ตาม
ความสามารถนี้ทำให้ Astra เป็นโมเดลแรกของ OpenAI ที่เข้าเกณฑ์มาตรการความปลอดภัยระดับเข้มงวดตามโปรโตคอลของบริษัท ซึ่งกำหนดให้ต้องเพิ่มการป้องกันเมื่อโมเดลสามารถตรวจจับและใช้ประโยชน์จากช่องโหว่ พร้อมวางแผนและดำเนินการโจมตีที่ซับซ้อนได้ด้วยตัวเอง
ประเด็นนี้ไม่ได้หมายความว่า Astra กลายเป็น AI ที่ควบคุมไม่ได้หรือกำลังพยายามหลบหนีออกจากระบบทดสอบ โดย OpenAI ระบุว่า Astra ไม่ได้เกี่ยวข้องกับเหตุการณ์ที่ AI Agent ของบริษัทหลุดออกจากสภาพแวดล้อมทดสอบและโจมตี Hugging Face ก่อนหน้านี้ แต่ความสามารถด้านไซเบอร์ของ Astra เองก็ทำให้บริษัทต้องเพิ่มมาตรการป้องกันเป็นพิเศษ
มาตรการใหม่รวมถึงการทำให้ Astra ปฏิเสธคำขอที่เกี่ยวข้องกับการโจมตีไซเบอร์ที่เป็นอันตรายได้ดีขึ้น รวมถึงมีระบบติดตามการทำงานเพื่อจับสัญญาณว่าตัวโมเดลพยายามหลีกเลี่ยงหรือทะลุระบบป้องกันหรือไม่ โดย OpenAI ยอมรับว่ามาตรการเหล่านี้อาจทำให้การทำงานบางอย่างช้าลง หยุดชั่วคราว หรือถูกระงับได้ในบางกรณี
Saachi Jain ผู้ดูแลด้านความปลอดภัยของ OpenAI ระบุว่า หนึ่งในโจทย์สำคัญคือการทำให้ AI Agent รู้ว่า ขอบเขตของงานอยู่ตรงไหน เพราะมนุษย์เองก็มีข้อจำกัดที่เข้าใจโดยธรรมชาติ แต่การทำให้โมเดลเรียนรู้และปฏิบัติตามขอบเขตเหล่านั้นอย่างสม่ำเสมอเป็นเรื่องที่ซับซ้อน
ที่มา gizmodo







