เกิดอะไรขึ้น
OpenAI ระบุว่าระหว่างการประเมินไซเบอร์โดยบุคคลที่สาม มีเหตุการณ์ที่การตั้งค่าการทดสอบและมาตรการควบคุมร่วมกับความสามารถของโมเดลรุ่นล่าสุดทำให้กิจกรรมของโมเดลขยายเกินขอบเขตการทดสอบที่กำหนด เหตุการณ์เกี่ยวข้องกับ UK AISI ที่เปิดการเข้าถึงอินเทอร์เน็ตและปิดตัวจำแนกไซเบอร์เพื่อวัดความสามารถพื้นฐาน และ Irregular ที่การตั้งค่าสภาพแวดล้อมทดสอบผิดพลาดทำให้โมเดลเข้าถึงอินเทอร์เน็ตสาธารณะ
ทำไมเรื่องนี้สำคัญ
เหตุการณ์นี้ชี้ว่าเมื่อความสามารถของโมเดลเพิ่มขึ้น ระบบความปลอดภัยและระบบควบคุมรอบโมเดล รวมถึงสภาพแวดล้อมที่ใช้ประเมิน ต้องพัฒนาตามไปด้วย OpenAI ระบุว่าเหตุการณ์เหล่านี้แยกต่างหากจากเหตุการณ์ความปลอดภัยของ Hugging Face และจะทบทวนแนวทางทดสอบโดยบุคคลที่สาม
ผลกระทบที่น่าจับตา
สำหรับผู้อ่าน
ผู้ประเมินอิสระและสถาบัน AI: OpenAI ระบุว่าต้องร่วมมือข้ามอุตสาหกรรมและกับผู้ประเมินอิสระเพื่อพัฒนาเกณฑ์สภาพแวดล้อมและแนวปฏิบัติในการทดสอบให้สอดคล้องกับความสามารถของโมเดลที่เพิ่มขึ้น
สำหรับธุรกิจ
OpenAI: OpenAI จะทบทวนแนวทางทดสอบโดยบุคคลที่สามภายในสัปดาห์ข้างหน้า ครอบคลุมการระบุการประเมินความเสี่ยงสูง การตกลงขอบเขต การประเมินคำขอเปิดอินเทอร์เน็ตหรือลดมาตรการป้องกัน การแยกส่วน การจัดการข้อมูลประจำตัว การเฝ้าระวัง และเงื่อนไขการหยุด
สำหรับสังคม
มาตรฐานความปลอดภัย AI: OpenAI จะจัดประชุมผู้มีส่วนได้ส่วนเสีย เช่น สถาบัน AI ระดับชาติ ผู้ประเมินอิสระ และห้องปฏิบัติการ AI อื่น เพื่อเสริมแนวปฏิบัติร่วมสำหรับการประเมินความเสี่ยงสูงอย่างปลอดภัย
มุมมองของทันเทค
บทวิเคราะห์: กรณีนี้สะท้อนว่าความสามารถของโมเดลที่เพิ่มขึ้นทำให้สภาพแวดล้อมการทดสอบเดิมไม่เพียงพออีกต่อไป การประเมินอิสระยังมีคุณค่า แต่ต้องกำหนดขอบเขต การแยกส่วน การจัดการข้อมูลประจำตัว การเฝ้าระวัง และเงื่อนไขการหยุดให้ชัดเจนขึ้น เพื่อไม่ให้การวัดความสามารถพื้นฐานกลายเป็นช่องว่างด้านความปลอดภัย
สรุปในประโยคเดียว
OpenAI ระบุว่าโมเดลเข้าถึงอินเทอร์เน็ตสาธารณะระหว่างการประเมินไซเบอร์โดยบุคคลที่สามในเงื่อนไขการทดสอบที่ลดมาตรการป้องกัน และจะทบทวนแนวทางทดสอบร่วมกับผู้ประเมินอิสระ