OpenAI ประกาศระงับกิจกรรมการพัฒนาภายในบางส่วนของ “Astra” โมเดลปัญญาประดิษฐ์รุ่นใหม่เป็นการชั่วคราว หลังการประเมินประสิทธิภาพล่าสุดตามกรอบความปลอดภัย Preparedness Framework พบว่าโมเดลมีความสามารถด้านการเขียนโค้ดอัตโนมัติ (Agentic Coding) และความปลอดภัยทางไซเบอร์ก้าวหน้าอย่างก้าวกระโดด จนไม่อาจมองข้ามความเสี่ยงในระดับวิกฤต (Critical Threshold) ได้
การตัดสินใจดังกล่าวเกิดขึ้นหลังจากทีมประเมินภายในพบว่า โมเดล Astra มีศักยภาพสูงเกินกว่าขีดความปลอดภัยที่กำหนดไว้ โดยกรอบ Preparedness Framework ระบุว่า โมเดลจะจัดอยู่ในระดับวิกฤตด้านไซเบอร์ หากสามารถค้นหาและพัฒนาเครื่องมือเจาะระบบ (Zero-day Exploits) ในระบบสำคัญของโลกจริงได้โดยไม่ต้องพึ่งพามนุษย์ หรือสามารถวางแผนและโจมตีทางไซเบอร์แบบครบวงจรได้ด้วยการรับคำสั่งเพียงเป้าหมายระดับสูงเท่านั้น
เพื่อป้องกันความเสี่ยงและพฤติกรรมที่ไม่พึงประสงค์ OpenAI จึงประกาศยกระดับมาตรการควบคุมความปลอดภัยอย่างเข้มงวด โดยกำหนดให้กระบวนการทดสอบและพัฒนาโมเดลชั้นสูง ต้องดำเนินการผ่านสภาพแวดล้อมที่แยกเดี่ยว (Isolated Testing Environments) จำกัดการเข้าถึงเครือข่ายและเครื่องมือ เข้ารหัสและคุ้มครองน้ำหนักของโมเดล (Model Weights) รวมถึงใช้ระบบการประเมินและติดตามการคิดของโมเดล (Chain of Thought) แบบสากล หากกิจกรรมใดของ Astra ยังไม่ผ่านเกณฑ์ความปลอดภัยใหม่นี้ จะต้องถูกระงับไว้ก่อนทั้งหมด
นอกจากนี้ OpenAI ได้ชี้แจงเพิ่มเติมว่า โมเดล Astra ไม่ได้มีส่วนเกี่ยวข้องกับเหตุการณ์ความปลอดภัยกับทาง Hugging Face ก่อนหน้านี้ พร้อมยืนยันว่าจะร่วมมือกับหน่วยงานรัฐบาล สถาบันความปลอดภัย AI และองค์กรภาคประชาสังคม เพื่อทดสอบและเปิดตัวโมเดลขั้นสูงอย่างมีความรับผิดชอบ ปลอดภัย และเกิดประโยชน์สูงสุดต่อสังคม







