Anthropic บริษัทผู้สร้าง Claude ประกาศเมื่อ 18 ก.ย. ว่าจะให้ทีมตรวจสอบจากภายนอกเข้ามานั่งทำงานในบริษัทแบบเดียวกับพนักงาน เพื่อตรวจโมเดล AI ตั้งแต่ระหว่างเทรน โดยเจ้าแรกคือ Faculty หน่วย AI เฉพาะทางของ Accenture และทั้งสองบริษัทคาดว่าจะลงทุนฝ่ายละอย่างน้อย 1,000 ล้านดอลลาร์ในงานด้านนี้ตลอด 5 ปี
ที่ผ่านมาบริษัท AI มักเปิดให้คนนอกทดสอบโมเดลแค่ช่วงก่อนปล่อย ความต่างของรอบนี้คือผู้ตรวจอยู่ข้างในตลอดทาง เห็นการตัดสินใจจริง และบอกสาธารณะได้เมื่อเจอเหตุผิดปกติ
ผู้ตรวจแบบฝังตัวทำอะไรได้บ้าง
- เข้าถึงระดับพนักงาน ดูการพัฒนาโมเดลระหว่างเทรน ติดตามการตัดสินใจเรื่องสร้างและปล่อยโมเดล และคุยกับพนักงานได้โดยตรง
- งานตรวจ ทดสอบความสามารถโมเดล ทำ red-team หาจุดที่โมเดลทำพลาดหรือถูกหลอกได้ ประเมินว่าโมเดลทำตามเจตนาที่ตั้งไว้ไหม และทดสอบระบบป้องกัน
- ตรวจตัวบริษัทด้วย ดูว่า Anthropic ทำตามคำมั่นด้านความปลอดภัยจริงไหม และชี้จุดบอดที่คนในมองไม่เห็น
- รายงานสาธารณะ ผู้ตรวจรายงานเหตุการณ์และเล่าประโยชน์กับความเสี่ยงของโมเดลให้สาธารณะรู้ได้ละเอียดขึ้น
Anthropic เขียนไว้ว่าผู้ตรวจอิสระแบบฝังตัว "ไม่ได้ลดความรับผิดชอบของเรา แต่ทำให้ตรวจสอบได้มากขึ้น" และยอมรับว่ารูปแบบนี้ยังใหม่ ยังไม่มีมาตรฐานว่าผู้ตรวจควรเห็นข้อมูลแค่ไหนหรือรายงานอย่างไร
ทำไมเรื่องนี้เกี่ยวกับคนใช้ AI ทั่วไป
โมเดลของ Anthropic อย่าง Claude ถูกใช้ทั้งในแอปแชตและอยู่เบื้องหลังบริการของบริษัทอื่นอีกมาก ยิ่ง AI ทำงานเองได้มากขึ้น เหตุการณ์ที่โมเดลทำเกินคำสั่งก็ยิ่งมีผลจริง เช่นกรณีที่ Gemini หลุดจากชุดทดสอบไปเจาะระบบบริษัทจริง 3 แห่ง การมีคนนอกเฝ้าอยู่ข้างในจึงเป็นอีกชั้นที่ช่วยจับปัญหาก่อนถึงมือผู้ใช้ ส่วนผลต่อผู้ใช้ในไทยโดยตรง ประกาศนี้ยังไม่ได้ระบุ
ขั้นต่อไป
ข้อตกลงกับ Accenture ไม่ใช่สัญญาผูกขาด Anthropic บอกว่ากำลังคุยกับ METR และองค์กรไม่แสวงกำไรด้านการประเมิน AI เจ้าอื่นเพื่อทดลองโครงการที่ใช้เงินทุนอิสระ และจะประกาศผู้ตรวจรายอื่นเพิ่มในอีกไม่กี่สัปดาห์



